| 2025 | EMNLP | Datasets and Recipes for Video Temporal Grounding via Reinforcement Learning. | Ruizhe Chen, Tianze Luo, Zhiting Fan, Heqing Zou, Zhaopeng Feng, Guiyang Xie, Hansheng Zhang, Zhuochen Wang, Zuozhu Liu, Huaijian Zhang |
| 2024 | ICASSP | Cross-Modality and Within-Modality Regularization for Audio-Visual Deepfake Detection. | Heqing Zou, Meng Shen, Yuchen Hu, Chen Chen, Eng Siong Chng, Deepu Rajan |
| 2023 | AAAI | Leveraging Modality-Specific Representations for Audio-Visual Speech Recognition via Reinforcement Learning. | Chen Chen, Yuchen Hu, Qiang Zhang, Heqing Zou, Beier Zhu, Eng Siong Chng |
| 2023 | ACL | MIR-GAN: Refining Frame-Level Modality-Invariant Representations with Adversarial Network for Audio-Visual Speech Recognition. | Yuchen Hu, Chen Chen, Ruizhe Li, Heqing Zou, Eng Siong Chng |
| 2023 | ACL | UniS-MMC: Multimodal Classification via Unimodality-supervised Multimodal Contrastive Learning. | Heqing Zou, Meng Shen, Chen Chen, Yuchen Hu, Deepu Rajan, Eng Siong Chng |
| 2023 | ICASSP | Unsupervised Noise Adaptation Using Data Simulation. | Chen Chen, Yuchen Hu, Heqing Zou, Linhui Sun, Eng Siong Chng |
| 2023 | ICASSP | Unifying Speech Enhancement and Separation with Gradient Modulation for End-to-End Noise-Robust Speech Separation. | Yuchen Hu, Chen Chen, Heqing Zou, Xionghu Zhong, Eng Siong Chng |
| 2023 | IJCAI | Cross-Modal Global Interaction and Local Alignment for Audio-Visual Speech Recognition. | Yuchen Hu, Ruizhe Li, Chen Chen, Heqing Zou, Qiushi Zhu, Eng Siong Chng |
| 2022 | ICASSP | Self-Critical Sequence Training for Automatic Speech Recognition. | Chen Chen, Yuchen Hu, Nana Hou, Xiaofeng Qi, Heqing Zou, Eng Siong Chng |
| 2022 | ICASSP | Speech Emotion Recognition with Co-Attention Based Multi-Level Acoustic Information. | Heqing Zou, Yuke Si, Chen Chen, Deepu Rajan, Eng Siong Chng |
| 2022 | Interspeech | Interactive Auido-text Representation for Automated Audio Captioning with Contrastive Learning. | Chen Chen, Nana Hou, Yuchen Hu, Heqing Zou, Xiaofeng Qi, Eng Siong Chng |
| 2020 | ICIP | Edge-Gan: Edge Conditioned Multi-View Face Image Generation. | Heqing Zou, Kenan E. Ak, Ashraf A. Kassim |