| 2026 | ACL | Beyond Sentence-level Labels: Integrating Conversational Context and Personal Experience for Natural Emotional Expression. | Haiyang Sun, Chenyang Le, Wei Wang, Leying Zhang, Chuang Li, Bing Han, Chenda Li, Mengxiao Bi, Yanmin Qian |
| 2025 | ASRU | REF-VC: Robust, Expressive and Fast Zero-Shot Voice Conversion with Diffusion Transformers. | Yuepeng Jiang, Ziqian Ning, Shuai Wang, Chengjia Wang, Mengxiao Bi, Pengcheng Zhu, Zhonghua Fu, Lei Xie |
| 2025 | ICASSP | MacST: Multi-Accent Speech Synthesis via Text Transliteration for Accent Conversion. | Sho Inoue, Shuai Wang, Wanxing Wang, Pengcheng Zhu, Mengxiao Bi, Haizhou Li |
| 2025 | ICASSP | E1 TTS: Simple and Fast Non-Autoregressive TTS. | Zhijun Liu, Shuai Wang, Pengcheng Zhu, Mengxiao Bi, Haizhou Li |
| 2025 | ICCV | Multimodal Latent Diffusion Model for Complex Sewing Pattern Generation. | Shengqi Liu, Yuhao Cheng, Zhuo Chen, Xingyu Ren, Wenhan Zhu, Lincheng Li, Mengxiao Bi, Xiaokang Yang, Yichao Yan |
| 2024 | ECCV | HIMO: A New Benchmark for Full-Body Human Interacting with Multiple Objects. | Xintao Lv, Liang Xu, Yichao Yan, Xin Jin, Congsheng Xu, Shuwen Wu, Yifan Liu, Lincheng Li, Mengxiao Bi, Wenjun Zeng, Xiaokang Yang |
| 2024 | ECCV | EDTalk: Efficient Disentanglement for Emotional Talking Head Synthesis. | Shuai Tan, Bin Ji, Mengxiao Bi, Ye Pan |
| 2024 | ICASSP | Dualvc 2: Dynamic Masked Convolution for Unified Streaming and Non-Streaming Voice Conversion. | Ziqian Ning, Yuepeng Jiang, Pengcheng Zhu, Shuai Wang, Jixun Yao, Lei Xie, Mengxiao Bi |
| 2024 | Interspeech | DualVC 3: Leveraging Language Model Generated Pseudo Context for End-to-end Low Latency Streaming Voice Conversion. | Ziqian Ning, Shuai Wang, Pengcheng Zhu, Zhichao Wang, Jixun Yao, Lei Xie, Mengxiao Bi |
| 2024 | SIGGRAPH | Preconditioned Nonlinear Conjugate Gradient Method for Real-time Interior-point Hyperelasticity. | Xing Shen, Runyuan Cai, Mengxiao Bi, Tangjie Lv |
| 2023 | ICASSP | Expressive-VC: Highly Expressive Voice Conversion with Attention Fusion of Bottleneck and Perturbation Features. | Ziqian Ning, Qicong Xie, Pengcheng Zhu, Zhichao Wang, Liumeng Xue, Jixun Yao, Lei Xie, Mengxiao Bi |
| 2023 | Interspeech | DualVC: Dual-mode Voice Conversion using Intra-model Knowledge Distillation and Hybrid Predictive Coding. | Ziqian Ning, Yuepeng Jiang, Pengcheng Zhu, Jixun Yao, Shuai Wang, Lei Xie, Mengxiao Bi |
| 2022 | ICASSP | One-Shot Voice Conversion For Style Transfer Based On Speaker Adaptation. | Zhichao Wang, Qicong Xie, Tao Li, Hongqiang Du, Lei Xie, Pengcheng Zhu, Mengxiao Bi |
| 2022 | ICASSP | VISinger: Variational Inference with Adversarial Learning for End-to-End Singing Voice Synthesis. | Yongmao Zhang, Jian Cong, Heyang Xue, Lei Xie, Pengcheng Zhu, Mengxiao Bi |
| 2022 | Interspeech | Opencpop: A High-Quality Open Source Chinese Popular Song Corpus for Singing Voice Synthesis. | Yu Wang, Xinsheng Wang, Pengcheng Zhu, Jie Wu, Hanzhao Li, Heyang Xue, Yongmao Zhang, Lei Xie, Mengxiao Bi |
| 2022 | Interspeech | Learn2Sing 2.0: Diffusion and Mutual Information-Based Target Speaker SVS by Learning from Singing Teacher. | Heyang Xue, Xinsheng Wang, Yongmao Zhang, Lei Xie, Pengcheng Zhu, Mengxiao Bi |
| 2018 | ICASSP | Deep Feed-Forward Sequential Memory Networks for Speech Synthesis. | Mengxiao Bi, Heng Lu, Shiliang Zhang, Ming Lei, Zhijie Yan |
| 2015 | Interspeech | Very deep convolutional neural networks for LVCSR. | Mengxiao Bi, Yanmin Qian, Kai Yu |