| 2024 | ICASSP | Implicit Enhancement of Target Speaker in Speaker-Adaptive ASR through Efficient Joint Optimization. | Minghui Wu, Haitao Tang, Jiahuan Fan, Ruoyu Wang, Hang Chen, Yanyong Zhang, Jun Du, Hengshun Zhou, Lei Sun, Xin Fang, Tian Gao, Genshun Wan, Jia Pan, Jianqing Gao |
| 2024 | Interspeech | Lightweight Transducer Based on Frame-Level Criterion. | Genshun Wan, Mengzhi Wang, Tingzhi Mao, Hang Chen, Zhongfu Ye |
| 2023 | ICASSP | Reducing the GAP Between Streaming and Non-Streaming Transducer-Based ASR by Adaptive Two-Stage Knowledge Distillation. | Haitao Tang, Yu Fu, Lei Sun, Jiabin Xue, Dan Liu, Yongchao Li, Zhiqiang Ma, Minghui Wu, Jia Pan, Genshun Wan, Ming'en Zhao |
| 2023 | ICASSP | Self-Supervised Audio-Visual Speech Representations Learning by Multimodal Self-Distillation. | Jing-Xuan Zhang, Genshun Wan, Zhen-Hua Ling, Jia Pan, Jianqing Gao, Cong Liu |
| 2022 | ICMI | Is Lip Region-of-Interest Sufficient for Lipreading? | Jing-Xuan Zhang, Genshun Wan, Jia Pan |
| 2020 | Interspeech | Speaker Adaptive Training for Speech Recognition Based on Attention-Over-Attention Mechanism. | Genshun Wan, Jia Pan, Qingran Wang, Jianqing Gao, Zhongfu Ye |
| 2020 | Interspeech | Speaker Code Based Speaker Adaptive Training Using Model Agnostic Meta-Learning. | Huaxin Wu, Genshun Wan, Jia Pan |