| 2026 | AAAI | TTA-Bench: A Comprehensive Benchmark for Evaluating Text-to-Audio Models. | Hui Wang, Cheng Liu, Junyang Chen, Haoze Liu, Yuhang Jia, Shiwan Zhao, Jiaming Zhou, Haoqin Sun, Hui Bu, Yong Qin |
| 2026 | AAAI | DIFFA: Large Language Diffusion Models Can Listen and Understand. | Jiaming Zhou, Hongjie Chen, Shiwan Zhao, Jian Kang, Jie Li, Enzhi Wang, Yujie Guo, Haoqin Sun, Hui Wang, Aobo Kong, Yong Qin, Xuelong Li |
| 2026 | ACL | AudioPrivacy: Parallel Audio Dataset for Speaker Profiling with Diverse Audio Types and Rich Attributes. | Jiabei He, Yanzhe Zhang, Jiaming Zhou, Hui Wang, Haoqin Sun, Yong Qin |
| 2026 | ACL | EmotionTalk: An Interactive Chinese Multimodal Emotion Dataset With Rich Annotations. | Haoqin Sun, Jinghua Zhao, Xuechen Wang, Shiwan Zhao, Jiaming Zhou, Hui Wang, Xi Yang, Yequan Wang, Yonghua Lin |
| 2026 | ACL | RealTalk-CN: A Realistic Chinese Speech Task-Oriented Dialogue Benchmark with Cross-Modal Analysis. | Enzhi Wang, Jiaming Zhou, Yuhang Jia, Aobo Kong, Qicheng Li, Yong Qin |
| 2026 | ACL | SpeechLLM-as-Judges: Towards General and Interpretable Speech Quality Evaluation. | Hui Wang, Jinghua Zhao, Yifan Yang, Shujie Liu, Junyang Chen, Yanzhe Zhang, Shiwan Zhao, Jinyu Li, Jiaming Zhou, Haoqin Sun, Yan Lu, Yong Qin |
| 2026 | ACL | DIFFA-2: A Practical Diffusion Large Language Model for General Audio Understanding. | Jiaming Zhou, Xuxin Cheng, Shiwan Zhao, Yuhang Jia, Cao Liu, Ke Zeng, Xunliang Cai, Yong Qin |
| 2026 | ACL | ChildTalk: A Multi-Dialect Chinese Child Speech Corpus with Full-Length Child-Caregiver Conversations for Speech Recognition. | Jiaming Zhou, Yujie Guo, Shiwan Zhao, Yao Lu, Jianye Wang, Haoqin Sun, Hui Wang, Yong Qin |
| 2025 | ACL | ChildMandarin: A Comprehensive Mandarin Speech Dataset for Young Children Aged 3-5. | Jiaming Zhou, Shiyao Wang, Shiwan Zhao, Jiabei He, Haoqin Sun, Hui Wang, Cheng Liu, Aobo Kong, Yujie Guo, Xi Yang, Yequan Wang, Yonghua Lin, Yong Qin |
| 2025 | CSCWD | One-Iteration-per-Update (OIpU) Algorithm Applied to MMPaC (Minimum Motion Planning and Control) of Planar Four-Link Robotic Arm Aided with Zhang Equivalency. | Jiaming Zhou, Zhiwen Yuan, Yunong Zhang |
| 2025 | CVPR | Mitigating the Human-Robot Domain Discrepancy in Visual Pre-training for Robotic Manipulation. | Jiaming Zhou, Teli Ma, Kun-Yu Lin, Zifan Wang, Ronghe Qiu, Junwei Liang |
| 2025 | ICASSP | Emotion-Preserving Prosody Anonymization Network for Voice Privacy Protection. | Jiabei He, Shiwan Zhao, Jiaming Zhou, Haoqin Sun, Hui Wang, Yong Qin |
| 2025 | ICASSP | MusicEval: A Generative Music Dataset with Expert Ratings for Automatic Text-to-Music Evaluation. | Cheng Liu, Hui Wang, Jinghua Zhao, Shiwan Zhao, Hui Bu, Xin Xu, Jiaming Zhou, Haoqin Sun, Yong Qin |
| 2025 | ICASSP | Enhancing Emotion Recognition in Incomplete Data: A Novel Cross-Modal Alignment, Reconstruction, and Refinement Framework. | Haoqin Sun, Shiwan Zhao, Shaokai Li, Xiangyu Kong, Xuechen Wang, Jiaming Zhou, Aobo Kong, Yong Chen, Wenjia Zeng, Yong Qin |
| 2025 | ICASSP | Enhancing Multimodal Emotion Recognition through Multi-Granularity Cross-Modal Alignment. | Xuechen Wang, Shiwan Zhao, Haoqin Sun, Hui Wang, Jiaming Zhou, Yong Qin |
| 2025 | ICASSP | M2R-Whisper: Multi-stage and Multi-scale Retrieval Augmentation for Enhancing Whisper. | Jiaming Zhou, Shiwan Zhao, Jiabei He, Hui Wang, Wenjia Zeng, Yong Chen, Haoqin Sun, Aobo Kong, Yong Qin |
| 2025 | ICASSP | Improving Zero-Shot Chinese-English Code-Switching ASR with kNN-CTC and Gated Monolingual Datastores. | Jiaming Zhou, Shiwan Zhao, Hui Wang, Tian-Hao Zhang, Haoqin Sun, Xuechen Wang, Yong Qin |
| 2025 | Interspeech | RA-CLAP: Relation-Augmented Emotional Speaking Style Contrastive Language-Audio Pretraining For Speech Retrieval. | Haoqin Sun, Jingguang Tian, Jiaming Zhou, Hui Wang, Jiabei He, Shiwan Zhao, Xiangyu Kong, Desheng Hu, Xinkang Xu, Xinhui Hu, Yong Qin |
| 2025 | Interspeech | A Self-Training Approach for Whisper to Enhance Long Dysarthric Speech Recognition. | Shiyao Wang, Jiaming Zhou, Shiwan Zhao, Yong Qin |
| 2024 | CoRL | Contrastive Imitation Learning for Language-guided Multi-Task Robotic Manipulation. | Teli Ma, Jiaming Zhou, Zifan Wang, Ronghe Qiu, Junwei Liang |
| 2024 | CSCWD | Uniform-Distribution (UD) Based Time Intervals of GRC (Global Reserve Currency) Transition Year Predicted Narrowly as [2024, 2040] and Generally [2k00, 2k50]. | Yunong Zhang, Jiaming Zhou |
| 2024 | ICASSP | CIF-T: A Novel CIF-Based Transducer Architecture for Automatic Speech Recognition. | Tian-Hao Zhang, Dinghao Zhou, Guiping Zhong, Jiaming Zhou, Baoxiang Li |
| 2024 | ICASSP | KNN-CTC: Enhancing ASR via Retrieval of CTC Pseudo Labels. | Jiaming Zhou, Shiwan Zhao, Yaqi Liu, Wenjia Zeng, Yong Chen, Yong Qin |
| 2024 | ICML | CKGConv: General Graph Convolution with Continuous Kernels. | Liheng Ma, Soumyasundar Pal, Yitian Zhang, Jiaming Zhou, Yingxue Zhang, Mark Coates |
| 2024 | Interspeech | AS-70: A Mandarin stuttered speech dataset for automatic speech recognition and stuttering event detection. | Rong Gong, Hongfei Xue, Lezhi Wang, Xin Xu, Qisheng Li, Lei Xie, Hui Bu, Shaomei Wu, Jiaming Zhou, Yong Qin, Binbin Zhang, Jun Du, Jia Bin, Ming Li |
| 2024 | Interspeech | Iterative Prototype Refinement for Ambiguous Speech Emotion Recognition. | Haoqin Sun, Shiwan Zhao, Xiangyu Kong, Xuechen Wang, Hui Wang, Jiaming Zhou, Yong Qin |
| 2024 | Interspeech | Enhancing Dysarthric Speech Recognition for Unseen Speakers via Prototype-Based Adaptation. | Shiyao Wang, Shiwan Zhao, Jiaming Zhou, Aobo Kong, Yong Qin |
| 2024 | Interspeech | Uncertainty-Aware Mean Opinion Score Prediction. | Hui Wang, Shiwan Zhao, Jiaming Zhou, Xiguang Zheng, Haoqin Sun, Xuechen Wang, Yong Qin |
| 2023 | ICASSP | MADI: Inter-Domain Matching and Intra-Domain Discrimination for Cross-Domain Speech Recognition. | Jiaming Zhou, Shiwan Zhao, Ning Jiang, Guoqing Zhao, Yong Qin |
| 2023 | SMC | Improved YOLOv7 Based on Transformer for Object Detection in UAV-Captured Images. | Yuefan Luo, Qing Zhu, Zhen Zhou, Lin Chen, Jiaming Zhou, Tianjian Jiang, Yijiang Li, Danwei Wang, Yaonan Wang |
| 2022 | ECCV | Adversarial Partial Domain Adaptation by Cycle Inconsistency. | Kun-Yu Lin, Jiaming Zhou, Yukun Qiu, Wei-Shi Zheng |
| 2021 | CVPR | Graph-Based High-Order Relation Modeling for Long-Term Action Recognition. | Jiaming Zhou, Kun-Yu Lin, Haoxin Li, Wei-Shi Zheng |
| 2019 | ACML | LADet: A Light-weight and Adaptive Network for Multi-scale Object Detection. | Jiaming Zhou, Yuqiao Tian, Weicheng Li, Rui Wang, Zhongzhi Luan, Depei Qian |
| 2019 | HPCC | FLONet: Fewer Labeling Cost Active Learning for Deep Neural Network. | Xianya Fu, Rui Wang, Peixuan Zuo, Jiaming Zhou, Jia Zhai, Xiaodan Xie, Zhongzhi Luan, Depei Qian |