| 2025 | ICASSP | Can Large Audio-Language Models Truly Hear? Tackling Hallucinations with Multi-Task Assessment and Stepwise Audio Reasoning. | Chun-Yi Kuan, Hung-Yi Lee |
| 2025 | ICLR | Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks. | Chien-yu Huang, Wei-Chih Chen, Shu-Wen Yang, Andy T. Liu, Chen-An Li, Yu-Xiang Lin, Wei-Cheng Tseng, Anuj Diwan, Yi-Jen Shih, Jiatong Shi, William Chen, Chih-Kai Yang, Xuanjun Chen, Chi-Yuan Hsiao, Puyuan Peng, Shih-Heng Wang, Chun-Yi Kuan, Ke-Han Lu, Kai-Wei Chang, Fabian Alejandro Ritter Gutierrez, et al. |
| 2025 | Interspeech | Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples. | Chun-Yi Kuan, Hung-yi Lee |
| 2025 | Interspeech | Speech-IFEval: Evaluating Instruction-Following and Quantifying Catastrophic Forgetting in Speech-Aware Language Models. | Ke-Han Lu, Chun-Yi Kuan, Hung-yi Lee |
| 2025 | NAACL | Gender Bias in Instruction-Guided Speech Synthesis Models. | Chun-Yi Kuan, Hung-yi Lee |
| 2024 | EMNLP | Large Language Model as an Assignment Evaluator: Insights, Feedback, and Challenges in a 1000+ Student Course. | Cheng-Han Chiang, Wei-Chih Chen, Chun-Yi Kuan, Chienchou Yang, Hung-yi Lee |
| 2024 | ICASSP | Dynamic-Superb: Towards a Dynamic, Collaborative, and Comprehensive Instruction-Tuning Benchmark For Speech. | Chien-Yu Huang, Ke-Han Lu, Shih-Heng Wang, Chi-Yuan Hsiao, Chun-Yi Kuan, Haibin Wu, Siddhant Arora, Kai-Wei Chang, Jiatong Shi, Yifan Peng, Roshan S. Sharma, Shinji Watanabe, Bhiksha Ramakrishnan, Shady Shehata, Hung-Yi Lee |
| 2024 | ICASSP | Investigating Zero-Shot Generalizability on Mandarin-English Code-Switched ASR And Speech-to-Text Translation of Recent Foundation Models with Self-Supervision and Weak Supervision. | Chih-Kai Yang, Kuan-Po Huang, Ke-Han Lu, Chun-Yi Kuan, Chi-Yuan Hsiao, Hung-Yi Lee |
| 2024 | Interspeech | Understanding Sounds, Missing the Questions: The Challenge of Object Hallucination in Large Audio-Language Models. | Chun-Yi Kuan, Wei-Ping Huang, Hung-yi Lee |
| 2023 | ASRU | Towards General-Purpose Text-Instruction-Guided Voice Conversion. | Chun-Yi Kuan, Chen-An Li, Tsu-Yuan Hsu, Tse-Yang Lin, Ho-Lam Chung, Kai-Wei Chang, Shuo-Yiin Chang, Hung-Yi Lee |