| 2026 | AAAI | TTA-Bench: A Comprehensive Benchmark for Evaluating Text-to-Audio Models. | Hui Wang, Cheng Liu, Junyang Chen, Haoze Liu, Yuhang Jia, Shiwan Zhao, Jiaming Zhou, Haoqin Sun, Hui Bu, Yong Qin |
| 2026 | AAAI | DIFFA: Large Language Diffusion Models Can Listen and Understand. | Jiaming Zhou, Hongjie Chen, Shiwan Zhao, Jian Kang, Jie Li, Enzhi Wang, Yujie Guo, Haoqin Sun, Hui Wang, Aobo Kong, Yong Qin, Xuelong Li |
| 2026 | ACL | AudioPrivacy: Parallel Audio Dataset for Speaker Profiling with Diverse Audio Types and Rich Attributes. | Jiabei He, Yanzhe Zhang, Jiaming Zhou, Hui Wang, Haoqin Sun, Yong Qin |
| 2026 | ACL | RealTalk-CN: A Realistic Chinese Speech Task-Oriented Dialogue Benchmark with Cross-Modal Analysis. | Enzhi Wang, Jiaming Zhou, Yuhang Jia, Aobo Kong, Qicheng Li, Yong Qin |
| 2026 | ACL | SpeechLLM-as-Judges: Towards General and Interpretable Speech Quality Evaluation. | Hui Wang, Jinghua Zhao, Yifan Yang, Shujie Liu, Junyang Chen, Yanzhe Zhang, Shiwan Zhao, Jinyu Li, Jiaming Zhou, Haoqin Sun, Yan Lu, Yong Qin |
| 2026 | ACL | DIFFA-2: A Practical Diffusion Large Language Model for General Audio Understanding. | Jiaming Zhou, Xuxin Cheng, Shiwan Zhao, Yuhang Jia, Cao Liu, Ke Zeng, Xunliang Cai, Yong Qin |
| 2026 | ACL | ChildTalk: A Multi-Dialect Chinese Child Speech Corpus with Full-Length Child-Caregiver Conversations for Speech Recognition. | Jiaming Zhou, Yujie Guo, Shiwan Zhao, Yao Lu, Jianye Wang, Haoqin Sun, Hui Wang, Yong Qin |
| 2025 | ACL | SDPO: Segment-Level Direct Preference Optimization for Social Agents. | Aobo Kong, Wentao Ma, Shiwan Zhao, Yongbin Li, Yuchuan Wu, Ke Wang, Xiaoqian Liu, Qicheng Li, Yong Qin, Fei Huang |
| 2025 | ACL | ChildMandarin: A Comprehensive Mandarin Speech Dataset for Young Children Aged 3-5. | Jiaming Zhou, Shiyao Wang, Shiwan Zhao, Jiabei He, Haoqin Sun, Hui Wang, Cheng Liu, Aobo Kong, Yujie Guo, Xi Yang, Yequan Wang, Yonghua Lin, Yong Qin |
| 2025 | ASRU | The AudioMOS Challenge 2025. | Wen-Chin Huang, Hui Wang, Cheng Liu, Yi-Chiao Wu, Andros Tjandra, Wei-Ning Hsu, Erica Cooper, Yong Qin, Tomoki Toda |
| 2025 | ICASSP | Emotion-Preserving Prosody Anonymization Network for Voice Privacy Protection. | Jiabei He, Shiwan Zhao, Jiaming Zhou, Haoqin Sun, Hui Wang, Yong Qin |
| 2025 | ICASSP | AudioEditor: A Training-Free Diffusion-Based Audio Editing Framework. | Yuhang Jia, Yang Chen, Jinghua Zhao, Shiwan Zhao, Wenjia Zeng, Yong Chen, Yong Qin |
| 2025 | ICASSP | MusicEval: A Generative Music Dataset with Expert Ratings for Automatic Text-to-Music Evaluation. | Cheng Liu, Hui Wang, Jinghua Zhao, Shiwan Zhao, Hui Bu, Xin Xu, Jiaming Zhou, Haoqin Sun, Yong Qin |
| 2025 | ICASSP | Enhancing Emotion Recognition in Incomplete Data: A Novel Cross-Modal Alignment, Reconstruction, and Refinement Framework. | Haoqin Sun, Shiwan Zhao, Shaokai Li, Xiangyu Kong, Xuechen Wang, Jiaming Zhou, Aobo Kong, Yong Chen, Wenjia Zeng, Yong Qin |
| 2025 | ICASSP | Enhancing Multimodal Emotion Recognition through Multi-Granularity Cross-Modal Alignment. | Xuechen Wang, Shiwan Zhao, Haoqin Sun, Hui Wang, Jiaming Zhou, Yong Qin |
| 2025 | ICASSP | M2R-Whisper: Multi-stage and Multi-scale Retrieval Augmentation for Enhancing Whisper. | Jiaming Zhou, Shiwan Zhao, Jiabei He, Hui Wang, Wenjia Zeng, Yong Chen, Haoqin Sun, Aobo Kong, Yong Qin |
| 2025 | ICASSP | Improving Zero-Shot Chinese-English Code-Switching ASR with kNN-CTC and Gated Monolingual Datastores. | Jiaming Zhou, Shiwan Zhao, Hui Wang, Tian-Hao Zhang, Haoqin Sun, Xuechen Wang, Yong Qin |
| 2025 | Interspeech | RA-CLAP: Relation-Augmented Emotional Speaking Style Contrastive Language-Audio Pretraining For Speech Retrieval. | Haoqin Sun, Jingguang Tian, Jiaming Zhou, Hui Wang, Jiabei He, Shiwan Zhao, Xiangyu Kong, Desheng Hu, Xinkang Xu, Xinhui Hu, Yong Qin |
| 2025 | Interspeech | A Self-Training Approach for Whisper to Enhance Long Dysarthric Speech Recognition. | Shiyao Wang, Jiaming Zhou, Shiwan Zhao, Yong Qin |
| 2025 | IECON | A Detection-Driven Two-Stage Approach for Knee Cartilage MRI Image Segmentation with Memory Enhancement. | Hancheng Qin, Dingzhou Li, Hao Luo, Yong Qin, Songcen Lv, Yuchen Jiang |
| 2024 | ICASSP | Fine-Grained Disentangled Representation Learning For Multimodal Emotion Recognition. | Haoqin Sun, Shiwan Zhao, Xuechen Wang, Wenjia Zeng, Yong Chen, Yong Qin |
| 2024 | ICASSP | KNN-CTC: Enhancing ASR via Retrieval of CTC Pseudo Labels. | Jiaming Zhou, Shiwan Zhao, Yaqi Liu, Wenjia Zeng, Yong Chen, Yong Qin |
| 2024 | INDIN | Auxiliary Diagnosis of Knee-Joint Edema Using A Multi-Dimensional Feature Extraction and Fusion Network. | Hancheng Qin, Yuchen Jiang, Hao Luo, Yong Qin, Minglei Li, Pengfei Yan, Jiangqi Li |
| 2024 | Interspeech | AS-70: A Mandarin stuttered speech dataset for automatic speech recognition and stuttering event detection. | Rong Gong, Hongfei Xue, Lezhi Wang, Xin Xu, Qisheng Li, Lei Xie, Hui Bu, Shaomei Wu, Jiaming Zhou, Yong Qin, Binbin Zhang, Jun Du, Jia Bin, Ming Li |
| 2024 | Interspeech | LAFMA: A Latent Flow Matching Model for Text-to-Audio Generation. | Wenhao Guan, Kaidi Wang, Wangjin Zhou, Yang Wang, Feng Deng, Hui Wang, Lin Li, Qingyang Hong, Yong Qin |
| 2024 | Interspeech | Iterative Prototype Refinement for Ambiguous Speech Emotion Recognition. | Haoqin Sun, Shiwan Zhao, Xiangyu Kong, Xuechen Wang, Hui Wang, Jiaming Zhou, Yong Qin |
| 2024 | Interspeech | Enhancing Dysarthric Speech Recognition for Unseen Speakers via Prototype-Based Adaptation. | Shiyao Wang, Shiwan Zhao, Jiaming Zhou, Aobo Kong, Yong Qin |
| 2024 | Interspeech | Uncertainty-Aware Mean Opinion Score Prediction. | Hui Wang, Shiwan Zhao, Jiaming Zhou, Xiguang Zheng, Haoqin Sun, Xuechen Wang, Yong Qin |
| 2024 | NAACL | Better Zero-Shot Reasoning with Role-Play Prompting. | Aobo Kong, Shiwan Zhao, Hao Chen, Qicheng Li, Yong Qin, Ruiqi Sun, Xin Zhou, Enzhi Wang, Xiaohang Dong |
| 2023 | ACL | PromptRank: Unsupervised Keyphrase Extraction Using Prompt. | Aobo Kong, Shiwan Zhao, Hao Chen, Qicheng Li, Yong Qin, Ruiqi Sun, Xiaoyan Bai |
| 2023 | ICASSP | MADI: Inter-Domain Matching and Intra-Domain Discrimination for Cross-Domain Speech Recognition. | Jiaming Zhou, Shiwan Zhao, Ning Jiang, Guoqing Zhao, Yong Qin |
| 2023 | IJCNN | CyFormer: Accurate State-of-Health Prediction of Lithium-Ion Batteries via Cyclic Attention. | Zhiqiang Nie, Jiankun Zhao, Qicheng Li, Yong Qin |
| 2023 | Interspeech | Supervised Contrastive Learning with Nearest Neighbor Search for Speech Emotion Recognition. | Xuechen Wang, Shiwan Zhao, Yong Qin |
| 2023 | Interspeech | RAMP: Retrieval-Augmented MOS Prediction via Confidence-based Dynamic Weighting. | Hui Wang, Shiwan Zhao, Xiguang Zheng, Yong Qin |
| 2019 | Interspeech | Few-Shot Audio Classification with Attentional Graph Neural Networks. | Shilei Zhang, Yong Qin, Kewei Sun, Yonghua Lin |
| 2018 | AMIA | Mining Disease-Symptom Relation from Massive Biomedical Literature and Its Application in Severe Disease Diagnosis. | Eryu Xia, Wen Sun, Jing Mei, Enliang Xu, Ke Wang, Yong Qin |
| 2018 | IJCAI | Pairwise-Ranking based Collaborative Recurrent Neural Networks for Clinical Event Prediction. | Zhi Qiao, Shiwan Zhao, Cao Xiao, Xiang Li, Yong Qin, Fei Wang |
| 2018 | UIC | Characteristics Analysis and Impact Cluster on Urban Rail Transit Perturbations: A Real Case in Beijing. | Mingming Wang, Li Wang, Xinyue Xu, Yong Qin |
| 2017 | ICMI | Emotion recognition with multimodal features and temporal models. | Shuai Wang, Wenxuan Wang, Jinming Zhao, Shizhe Chen, Qin Jin, Shilei Zhang, Yong Qin |
| 2017 | IECON | Snow fluff detection and removal from video images. | Tangwen Yang, Venant Nsabimana, Bufang Wang, Yantao Sun, Xiaoqing Cheng, Honghui Dong, Yong Qin, Bin Zhang, Felix Ingrabire |
| 2017 | UIC | Research on propagation of passenger flow in urban rail transit network for large-scale events. | Yuan Liu, Mingming Wang, Qian Li, Yong Qin, Jian Li, Fang Sun, Minghui Zhan |
| 2016 | CIKM | Sentiment Domain Adaptation with Multi-Level Contextual Sentiment Knowledge. | Fangzhao Wu, Sixing Wu, Yongfeng Huang, Songfang Huang, Yong Qin |
| 2016 | ICMI | Video emotion recognition in the wild based on fusion of multimodal features. | Shizhe Chen, Xinrui Li, Qin Jin, Shilei Zhang, Yong Qin |
| 2016 | ICPR | Wake-up-word spotting using end-to-end deep neural network system. | Shilei Zhang, Wen Liu, Yong Qin |
| 2016 | ICPR | Rapid feature space MLLR speaker adaptation for deep neural network acoustic modeling. | Shilei Zhang, Yong Qin |
| 2016 | SEKE | Sensor-Based Detection Approach for Passenger Flow Safety in Chinese High-speed Railway Transport Hub. | Zhengyu Xie, Yong Qin |
| 2016 | SEKE | Traffic Safety Region Estimation Based on SFS-PCA-LSSVM: An Application to Highway Crash Risk Evaluation. | Yanfang Yang, Yong Qin |
| 2015 | SEKE | Study on the Accident-causing Model Based on Safety Region and Applications in China Railway Transportation System. | Yong Qin, Hui Ma, Miao Du, Limin Jia |
| 2014 | ACL | Encoding Relation Requirements for Relation Extraction via Joint Inference. | Liwei Chen, Yansong Feng, Songfang Huang, Yong Qin, Dongyan Zhao |
| 2013 | ICASSP | Semi-supervised accent detection and modeling. | Shilei Zhang, Yong Qin |
| 2013 | ICMLC | Movement prediction assisted timely L2 trigger in FMIPv6. | Ming Tao, Wenhong Wei, Yong Qin, Huaqiang Yuan |
| 2012 | ICASSP | Model dimensionality selection in bilinear transformation for feature space MLLR rapid speaker adaptation. | Shilei Zhang, Yong Qin |
| 2012 | Interspeech | Investigating Performance of the Discriminative Methods for Long-Term Speaker Adaptation. | Danning Jiang, Dimitri Kanevsky, Vaibhava Goel, Yong Qin |
| 2011 | ICASSP | Defining the controlling parameter in constrained discriminative linear transform for supervised speaker adaptation. | Danning Jiang, Dimitri Kanevsky, Emmanuel Yashchin, Yong Qin |
| 2011 | ICASSP | Rapid feature space MLLR speaker adaptation with bilinear models. | Shilei Zhang, Peder A. Olsen, Yong Qin |
| 2011 | ICASSP | Generating compound words with high order n-gram information in large vocabulary speech recognition systems. | Jie Zhou, Qin Shi, Yong Qin |
| 2010 | CHI | Effects of automated transcription quality on non-native speakers' comprehension in real-time computer-mediated communication. | Yingxin Pan, Danning Jiang, Lin Yao, Michael Picheny, Yong Qin |
| 2010 | ICASSP | The 2009 IBM GALE Mandarin broadcast transcription system. | Stephen M. Chu, Daniel Povey, Hong-Kwang Kuo, Lidia Mangu, Shilei Zhang, Qin Shi, Yong Qin |
| 2010 | ICMLC | A theoretical framework for runtime analysis of ant colony optimization. | Zhongming Yang, Han Huang, Zhaoquan Cai, Yong Qin |
| 2010 | ICPR | Comparison of Syllable/Phone HMM Based Mandarin TTS. | Quansheng Duan, Shiyin Kang, Zhiyong Wu, Lianhong Cai, Zhiwei Shuang, Yong Qin |
| 2010 | ICPR | Modeling Syllable-Based Pronunciation Variation for Accented Mandarin Speech Recognition. | Shilei Zhang, Qin Shi, Yong Qin |
| 2010 | ICPR | Automatic Pronunciation Transliteration for Chinese-English Mixed Language Keyword Spotting. | Shilei Zhang, Zhiwei Shuang, Yong Qin |
| 2010 | ICPR | Improved Mandarin Keyword Spotting Using Confusion Garbage Model. | Shilei Zhang, Zhiwei Shuang, Qin Shi, Yong Qin |
| 2010 | Interspeech | HMM based TTS for mixed language text. | Zhiwei Shuang, Shiyin Kang, Yong Qin, Li-Rong Dai, Lianhong Cai |
| 2009 | CHI | Effects of real-time transcription on non-native speaker's comprehension in computer-mediated communications. | Yingxin Pan, Danning Jiang, Michael Picheny, Yong Qin |
| 2009 | ICASSP | Utterance verification using improved confidence measures based on alignment confusion rate in Chinese digits recognition. | Shilei Zhang, Danning Jiang, Yong Qin |
| 2009 | ICASSP | Main vowel domain tone modeling with lexical and prosodic analysis for Mandarin ASR. | Shilei Zhang, Qin Shi, Stephen M. Chu, Yong Qin |
| 2009 | ICNC | An Experiment Study on Level of Service for the Regional Road Traffic. | Honghui Dong, Limin Jia, Xiaoliang Sun, Yong Qin, Chenxi Li |
| 2009 | Interspeech | Voiced/unvoiced decision algorithm for HMM-based speech synthesis. | Shiyin Kang, Zhiwei Shuang, Quansheng Duan, Yong Qin, Lianhong Cai |
| 2009 | Interspeech | Syllable HMM based Mandarin TTS and comparison with concatenative TTS. | Zhiwei Shuang, Shiyin Kang, Qin Shi, Yong Qin, Lianhong Cai |
| 2008 | ICASSP | Recent advances in the IBM GALE Mandarin transcription system. | Selina M. Chu, Hong-Kwang Kuo, Lidia Mangu, Yi Liu, Yong Qin, Qin Shi, Shilei Zhang, Hagai Aronowitz |
| 2008 | ICASSP | Voice conversion by combining frequency warping with unit selection. | Zhiwei Shuang, Fanping Meng, Yong Qin |
| 2008 | Interspeech | Search and classification based language model adaptation. | Qin Shi, Stephen M. Chu, Wen Liu, Hong-Kwang Jeff Kuo, Yi Liu, Yong Qin |
| 2007 | ICA3PP | GDED-X Schemes for Load Balancing on Heterogeneous OTIS-Networks. | Yong Qin, Wenjun Xiao, Chenggui Zhao |
| 2007 | ICA3PP | Hybrid Diffusion Schemes for Load Balancing on OTIS-Networks. | Chenggui Zhao, Wenjun Xiao, Yong Qin |
| 2007 | ICASSP | The IBM Mandarin Broadcast Speech Transcription System. | Stephen M. Chu, Hong-Kwang Jeff Kuo, Yi Y. Liu, Yong Qin, Qin Shi, Geoffrey Zweig |
| 2007 | ICASSP | Voice-Melody Transcription Under a Speech Recognition Framework. | Danning Jiang, Michael Picheny, Yong Qin |
| 2007 | ICASSP | Mandarin Accent Analysis Based on Formant Frequencies. | Kun Liu, Zhiwei Shuang, Yong Qin, Jianping Zhang, Yonghong Yan |
| 2007 | ICCS | An ACO Algorithm with Adaptive Volatility Rate of Pheromone Trail. | Zhifeng Hao, Han Huang, Yong Qin, Ruichu Cai |
| 2007 | ICCS | Extended Clustering Coefficients of Small-World Networks. | Wenjun Xiao, Yong Qin, Behrooz Parhami |
| 2007 | Interspeech | Combining length distribution model with decision tree in prosodic phrase prediction. | Qin Shi, Danning Jiang, Fanping Meng, Yong Qin |
| 2007 | WWW | A search-based Chinese word segmentation method. | Xin-Jing Wang, Yong Qin, Wen Liu |
| 2006 | Interspeech | Frequency warping based on mapping formant parameters. | Zhiwei Shuang, Raimo Bakis, Slava Shechtman, Dan Chazan, Yong Qin |
| 2000 | Interspeech | The measurement of acoustic similarity and its applications. | Liqin Shen, Guokang Fu, Haixin Chai, Yong Qin |