| 2025 | ICASSP | Phoneme-Level Contrastive Learning for User-Defined Keyword Spotting with Flexible Enrollment. | Kewei Li, Hengshun Zhou, Kai Shen, Yusheng Dai, Jun Du |
| 2024 | ICASSP | Implicit Enhancement of Target Speaker in Speaker-Adaptive ASR through Efficient Joint Optimization. | Minghui Wu, Haitao Tang, Jiahuan Fan, Ruoyu Wang, Hang Chen, Yanyong Zhang, Jun Du, Hengshun Zhou, Lei Sun, Xin Fang, Tian Gao, Genshun Wan, Jia Pan, Jianqing Gao |
| 2023 | Interspeech | A Multiple-Teacher Pruning Based Self-Distillation (MT-PSD) Approach to Model Compression for Audio-Visual Wake Word Spotting. | Haotian Wang, Jun Du, Hengshun Zhou, Chin-Hui Lee, Yuling Ren, Jiangjiang Zhao |
| 2022 | ICASSP | The First Multimodal Information Based Speech Processing (Misp) Challenge: Data, Tasks, Baselines And Results. | Hang Chen, Hengshun Zhou, Jun Du, Chin-Hui Lee, Jingdong Chen, Shinji Watanabe, Sabato Marco Siniscalchi, Odette Scharenborg, Diyuan Liu, Bao-Cai Yin, Jia Pan, Jianqing Gao, Cong Liu |
| 2022 | ICASSP | A Study of Designing Compact Audio-Visual Wake Word Spotting System Based on Iterative Fine-Tuning in Neural Network Pruning. | Hengshun Zhou, Jun Du, Chao-Han Huck Yang, Shifu Xiong, Chin-Hui Lee |
| 2022 | Interspeech | Audio-Visual Wake Word Spotting in MISP2021 Challenge: Dataset Release and Deep Analysis. | Hengshun Zhou, Jun Du, Gongzhen Zou, Zhaoxu Nian, Chin-Hui Lee, Sabato Marco Siniscalchi, Shinji Watanabe, Odette Scharenborg, Jingdong Chen, Shifu Xiong, Jianqing Gao |
| 2021 | Interspeech | Audio-Visual Information Fusion Using Cross-Modal Teacher-Student Learning for Voice Activity Detection in Realistic Environments. | Hengshun Zhou, Jun Du, Hang Chen, Zijun Jing, Shifu Xiong, Chin-Hui Lee |
| 2020 | ICASSP | High-Resolution Attention Network with Acoustic Segment Model for Acoustic Scene Classification. | Xue Bai, Jun Du, Jia Pan, Hengshun Zhou, Yanhui Tu, Chin-Hui Lee |
| 2020 | Interspeech | Using Speech Enhancement Preprocessing for Speech Emotion Recognition in Realistic Noisy Conditions. | Hengshun Zhou, Jun Du, Yanhui Tu, Chin-Hui Lee |
| 2019 | ICMI | Exploring Emotion Features and Fusion Strategies for Audio-Video Emotion Recognition. | Hengshun Zhou, Debin Meng, Yuanyuan Zhang, Xiaojiang Peng, Jun Du, Kai Wang, Yu Qiao |