| 2025 | ASRU | AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models. | Chih-Kai Yang, Neo Ho, Yi-Jyun Lee, Hung-Yi Lee |
| 2025 | EMNLP | Towards Holistic Evaluation of Large Audio-Language Models: A Comprehensive Survey. | Chih-Kai Yang, Neo S. Ho, Hung-yi Lee |
| 2025 | ICLR | Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks. | Chien-yu Huang, Wei-Chih Chen, Shu-Wen Yang, Andy T. Liu, Chen-An Li, Yu-Xiang Lin, Wei-Cheng Tseng, Anuj Diwan, Yi-Jen Shih, Jiatong Shi, William Chen, Chih-Kai Yang, Xuanjun Chen, Chi-Yuan Hsiao, Puyuan Peng, Shih-Heng Wang, Chun-Yi Kuan, Ke-Han Lu, Kai-Wei Chang, Fabian Alejandro Ritter Gutierrez, et al. |
| 2025 | Interspeech | Analyzing Mitigation Strategies for Catastrophic Forgetting in End-to-End Training of Spoken Language Models. | Chi-Yuan Hsiao, Ke-Han Lu, Kai-Wei Chang, Chih-Kai Yang, Wei-Chih Chen, Hung-yi Lee |
| 2025 | Interspeech | SAKURA: On the Multi-hop Reasoning of Large Audio-Language Models Based on Speech and Audio Information. | Chih-Kai Yang, Neo Ho, Yen-Ting Piao, Hung-yi Lee |
| 2024 | ICASSP | Zero Resource Code-Switched Speech Benchmark Using Speech Utterance Pairs for Multiple Spoken Languages. | Kuan-Po Huang, Chih-Kai Yang, Yu-Kuan Fu, Ewan Dunbar, Hung-Yi Lee |
| 2024 | ICASSP | Investigating Zero-Shot Generalizability on Mandarin-English Code-Switched ASR And Speech-to-Text Translation of Recent Foundation Models with Self-Supervision and Weak Supervision. | Chih-Kai Yang, Kuan-Po Huang, Ke-Han Lu, Chun-Yi Kuan, Chi-Yuan Hsiao, Hung-Yi Lee |
| 2019 | VTC | Pilot Sequence Design for Spectral Compactness and Channel Estimation in OFDM. | Wei-Chang Chen, Chih-Kai Yang, Po-Tsang Chi, Char-Dir Chung |