| 2023 | ICASSP | Self-Supervised Audio-Visual Speech Representations Learning by Multimodal Self-Distillation. | Jing-Xuan Zhang, Genshun Wan, Zhen-Hua Ling, Jia Pan, Jianqing Gao, Cong Liu |
| 2022 | ICMI | Is Lip Region-of-Interest Sufficient for Lipreading? | Jing-Xuan Zhang, Genshun Wan, Jia Pan |
| 2021 | AAAI | TaLNet: Voice Reconstruction from Tongue and Lip Articulation with Transfer Learning from Text-to-Speech Synthesis. | Jing-Xuan Zhang, Korin Richmond, Zhen-Hua Ling, Lirong Dai |
| 2020 | Interspeech | Recognition-Synthesis Based Non-Parallel Voice Conversion with Adversarial Learning. | Jing-Xuan Zhang, Zhen-Hua Ling, Li-Rong Dai |
| 2019 | ICASSP | Dnn-based Spectral Enhancement for Neural Waveform Generators with Low-bit Quantization. | Yang Ai, Jing-Xuan Zhang, Liang Chen, Zhen-Hua Ling |
| 2019 | ICASSP | Improving Sequence-to-sequence Voice Conversion by Adding Text-supervision. | Jing-Xuan Zhang, Zhen-Hua Ling, Yuan Jiang, Li-Juan Liu, Chen Liang, Li-Rong Dai |
| 2018 | ICASSP | Forward Attention in Sequence- To-Sequence Acoustic Modeling for Speech Synthesis. | Jing-Xuan Zhang, Zhen-Hua Ling, Li-Rong Dai |