| 2022 | ICASSP | A Study of Designing Compact Audio-Visual Wake Word Spotting System Based on Iterative Fine-Tuning in Neural Network Pruning. | Hengshun Zhou, Jun Du, Chao-Han Huck Yang, Shifu Xiong, Chin-Hui Lee |
| 2022 | Interspeech | Audio-Visual Wake Word Spotting in MISP2021 Challenge: Dataset Release and Deep Analysis. | Hengshun Zhou, Jun Du, Gongzhen Zou, Zhaoxu Nian, Chin-Hui Lee, Sabato Marco Siniscalchi, Shinji Watanabe, Odette Scharenborg, Jingdong Chen, Shifu Xiong, Jianqing Gao |
| 2021 | Interspeech | Audio-Visual Information Fusion Using Cross-Modal Teacher-Student Learning for Voice Activity Detection in Realistic Environments. | Hengshun Zhou, Jun Du, Hang Chen, Zijun Jing, Shifu Xiong, Chin-Hui Lee |
| 2016 | Interspeech | Compact Feedforward Sequential Memory Networks for Large Vocabulary Continuous Speech Recognition. | Shiliang Zhang, Hui Jiang, Shifu Xiong, Si Wei, Li-Rong Dai |
| 2014 | ICASSP | Lattice based optimization of bottleneck feature extractor with linear transformation. | Diyuan Liu, Si Wei, Wu Guo, Yebo Bao, Shifu Xiong, Li-Rong Dai |