| 2025 | ASRU | RE-LLM: Refining Empathetic Speech-LLM Responses by Integrating Emotion Nuance. | Jing-Han Chen, Bo-Hao Su, Ya-Tse Wu, Chi-Chun Lee |
| 2025 | ASRU | VERSA-v2: A Modular and Scalable Toolkit for Speech and Audio Evaluation with Expanded Metrics, Visualization, and LLM Integration. | Jiatong Shi, Bo-Hao Su, Shikhar Bharadwaj, Yiwen Zhao, Shih-Heng Wang, Jionghao Hang, Haoran Wang, Wei Wang, Wenhao Feng, Yuxun Tang, Nezih Topaloglu, Siddhant Arora, Jinchuan Tian, William Chen, Hye-jin Shim, Wangyou Zhang, Wen-Chin Huang, Shinji Watanabe |
| 2025 | ICASSP | SocialRecNet: A Multimodal LLM-Based Framework for Assessing Social Reciprocity in Autism Spectrum Disorder. | Xin-Yu Chen, Yu-Ming Chen, Chin-Po Chen, Bo-Hao Su, Susan Shur-Fen Gau, Chi-Chun Lee |
| 2025 | ICASSP | Toward Zero-Shot Speech Emotion Recognition Using LLMs in the Absence of Target Data. | Bo-Hao Su, Shreya G. Upadhyay, Chi-Chun Lee |
| 2025 | Interspeech | Defend for Self-Vocoding: A Novel Enhanced Decoder Network for Watermark Recovery. | Yu-Sheng Lin, Ching-Yu Yang, Hsing-Hang Chou, Ya-Tse Wu, Bo-Hao Su, Chi-Chun Lee |
| 2025 | Interspeech | Lessons Learnt: Revisit Key Training Strategies for Effective Speech Emotion Recognition in the Wild. | Jing-Tong Tzeng, Bo-Hao Su, Ya-Tse Wu, Hsing-Hang Chou, Chi-Chun Lee |
| 2024 | Interspeech | SWiBE: A Parameterized Stochastic Diffusion Process for Noise-Robust Bandwidth Expansion. | Yin-Tse Lin, Shreya G. Upadhyay, Bo-Hao Su, Chi-Chun Lee |
| 2024 | Interspeech | RW-VoiceShield: Raw Waveform-based Adversarial Attack on One-shot Voice Conversion. | Ching-Yu Yang, Shreya G. Upadhyay, Ya-Tse Wu, Bo-Hao Su, Chi-Chun Lee |
| 2023 | ACII | An Intelligent Infrastructure Toward Large Scale Naturalistic Affective Speech Corpora Collection. | Shreya G. Upadhyay, Woan-Shiuan Chien, Bo-Hao Su, Lucas Goncalves, Ya-Tse Wu, Ali N. Salman, Carlos Busso, Chi-Chun Lee |
| 2023 | ICASSP | Phonetic Anchor-Based Transfer Learning to Facilitate Unsupervised Cross-Lingual Speech Emotion Recognition. | Shreya G. Upadhyay, Luz Martinez-Lucas, Bo-Hao Su, Wei-Cheng Lin, Woan-Shiuan Chien, Ya-Tse Wu, William F. Katz, Carlos Busso, Chi-Chun Lee |
| 2023 | Interspeech | Noise-Robust Bandwidth Expansion for 8K Speech Recordings. | Yin-Tse Lin, Bo-Hao Su, Chi-Han Lin, Shih-Chan Kuo, Jyh-Shing Roger Jang, Chi-Chun Lee |
| 2022 | ACII | Monologue versus Conversation: Differences in Emotion Perception and Acoustic Expressivity. | Woan-Shiuan Chien, Shreya G. Upadhyay, Wei-Cheng Lin, Ya-Tse Wu, Bo-Hao Su, Carlos Busso, Chi-Chun Lee |
| 2022 | Interspeech | An Attention-Based Method for Guiding Attribute-Aligned Speech Representation Learning. | Yu-Lin Huang, Bo-Hao Su, Y.-W. Peter Hong, Chi-Chun Lee |
| 2022 | Interspeech | Vaccinating SER to Neutralize Adversarial Attacks with Self-Supervised Augmentation Strategy. | Bo-Hao Su, Chi-Chun Lee |
| 2021 | Interspeech | An Attribute-Aligned Strategy for Learning Speech Representation. | Yu-Lin Huang, Bo-Hao Su, Y.-W. Peter Hong, Chi-Chun Lee |
| 2020 | Interspeech | Improving Speech Emotion Recognition Using Graph Attentive Bi-Directional Gated Recurrent Unit Network. | Bo-Hao Su, Chun-Min Chang, Yun-Shao Lin, Chi-Chun Lee |
| 2020 | Interspeech | Attentive Convolutional Recurrent Neural Network Using Phoneme-Level Acoustic Representation for Rare Sound Event Detection. | Shreya G. Upadhyay, Bo-Hao Su, Chi-Chun Lee |
| 2020 | Interspeech | Predicting Collaborative Task Performance Using Graph Interlocutor Acoustic Network in Small Group Interaction. | Shun-Chang Zhong, Bo-Hao Su, Wei Huang, Yi-Ching Liu, Chi-Chun Lee |
| 2019 | Interspeech | Using Attention Networks and Adversarial Augmentation for Styrian Dialect Continuous Sleepiness and Baby Sound Recognition. | Sung-Lin Yeh, Gao-Yi Chao, Bo-Hao Su, Yu-Lin Huang, Meng-Han Lin, Yin-Chun Tsai, Yu-Wen Tai, Zheng-Chi Lu, Chieh-Yu Chen, Tsung-Ming Tai, Chiu-Wang Tseng, Cheng-Kuang Lee, Chi-Chun Lee |
| 2018 | Interspeech | Self-Assessed Affect Recognition Using Fusion of Attentional BLSTM and Static Acoustic Features. | Bo-Hao Su, Sung-Lin Yeh, Ming-Ya Ko, Huan-Yu Chen, Shun-Chang Zhong, Jeng-Lin Li, Chi-Chun Lee |
| 2017 | ACII | A bootstrapped multi-view weighted Kernel fusion framework for cross-corpus integration of multimodal emotion recognition. | Chun-Min Chang, Bo-Hao Su, Shih-Chen Lin, Jeng-Lin Li, Chi-Chun Lee |