| 2026 | ACL | On the Fallacy of Global Token Perplexity in Spoken Language Model Evaluation. | Chan-Jan Hsu, Liang-Hsuan Tseng, Yi-Cheng Lin, Yen-Chun Kuo, Ju-Chieh Chou, Kai-Wei Chang, Hung-yi Lee, Carlos Busso |
| 2025 | ACL | Let's Fuse Step by Step: A Generative Fusion Decoding Algorithm with LLMs for Robust and Instruction-Aware ASR and OCR. | Chan-Jan Hsu, Yi-Chang Chen, Feng-Ting Liao, Pei-Chen Ho, Yu-Hsiang Wang, Po-Chun Hsu, Da-shan Shiu |
| 2025 | ASRU | A Self-Refining Framework for Enhancing ASR Using TTS-Synthesized Data. | Cheng-Kang Chou, Chan-Jan Hsu, Ho-Lam Chung, Liang-Hsuan Tseng, Hsi-Chun Cheng, Yu-Kuan Fu, Kuan-Po Huang, Hung-Yi Lee |
| 2025 | NAACL | Enhancing Function-Calling Capabilities in LLMs: Strategies for Prompt Formats, Data Integration, and Multilingual Translation. | Yi-Chang Chen, Po-Chun Hsu, Chan-Jan Hsu, Da-shan Shiu |
| 2023 | ASRU | Zero-Shot Domain-Sensitive Speech Recognition with Prompt-Conditioning Fine-Tuning. | Feng-Ting Liao, Yung-Chieh Chan, Yi-Chang Chen, Chan-Jan Hsu, Da-Shan Shiu |
| 2023 | ICASSP | T5lephone: Bridging Speech and Text Self-Supervised Models for Spoken Language Understanding Via Phoneme Level T5. | Chan-Jan Hsu, Ho-Lam Chung, Hung-Yi Lee, Yu Tsao |
| 2023 | ICASSP | Bridging Speech and Textual Pre-Trained Models With Unsupervised ASR. | Jiatong Shi, Chan-Jan Hsu, Ho-Lam Chung, Dongji Gao, Paola Garca, Shinji Watanabe, Ann Lee, Hung-Yi Lee |
| 2022 | ACL | XDBERT: Distilling Visual Information to BERT from Cross-Modal Systems to Improve Language Understanding. | Chan-Jan Hsu, Hung-yi Lee, Yu Tsao |
| 2022 | ICASSP | Analyzing The Robustness of Unsupervised Speech Recognition. | Guan-Ting Lin, Chan-Jan Hsu, Da-Rong Liu, Hung-Yi Lee, Yu Tsao |