| 2026 | ACL | Closing the Modality Reasoning Gap for Speech Large Language Models. | Chaoren Wang, Heng Lu, Xueyao Zhang, Shujie Liu, Yan Lu, Jinyu Li, Zhizheng Wu |
| 2025 | ACL | FlashAudio: Rectified Flow for Fast and High-Fidelity Text-to-Audio Generation. | Huadai Liu, Jialei Wang, Rongjie Huang, Yang Liu, Heng Lu, Zhou Zhao, Wei Xue |
| 2025 | ASRU | SLM-S2ST: A multimodal language model for direct speech-to-speech translation. | Yuxuan Hu, Haibin Wu, Ruchao Fan, Xiaofei Wang, Heng Lu, Yao Qian, Jinyu Li |
| 2025 | ASRU | Towards Efficient Speech-Text Jointly Decoding within One Speech Language Model. | Haibin Wu, Yuxuan Hu, Ruchao Fan, Xiaofei Wang, Ken'ichi Kumatani, Bo Ren, Jianwei Yu, Heng Lu, Lijuan Wang, Yao Qian, Jinyu Li |
| 2025 | EMNLP | UniSpeaker: A Unified Approach for Multimodality-driven Speaker Generation. | Zhengyan Sheng, Zhihao Du, Heng Lu, Shiliang Zhang, Zhen-Hua Ling |
| 2025 | Interspeech | Long-Context Speech Synthesis with Context-Aware Memory. | Zhipeng Li, Xiaofen Xing, Jingyuan Xing, Hangrui Hu, Heng Lu, Xiangmin Xu |
| 2024 | ICASSP | Diacorrect: Error Correction Back-End for Speaker Diarization. | Jiangyu Han, Federico Landini, Johan Rohdin, Mireia Dez, Luks Burget, Yuhang Cao, Heng Lu, Jan Cernock |
| 2024 | ICASSP | GEmo-CLAP: Gender-Attribute-Enhanced Contrastive Language-Audio Pretraining for Accurate Speech Emotion Recognition. | Yu Pan, Yanni Hu, Yuguang Yang, Wen Fei, Jixun Yao, Heng Lu, Lei Ma, Jianjun Zhao |
| 2024 | ICASSP | Promptvc: Flexible Stylistic Voice Conversion in Latent Space Driven by Natural Language Prompts. | Jixun Yao, Yuguang Yang, Yi Lei, Ziqian Ning, Yanni Hu, Yu Pan, Jingjing Yin, Hongbin Zhou, Heng Lu, Lei Xie |
| 2023 | ASRU | Salt: Distinguishable Speaker Anonymization Through Latent Space Transformation. | Yuanjun Lv, Jixun Yao, Peikun Chen, Hongbin Zhou, Heng Lu, Lei Xie |
| 2023 | ASRU | PP-MET: A Real-World Personalized Prompt Based Meeting Transcription System. | Xiang Lyu, Yuhang Cao, Qing Wang, Jingjing Yin, Yuguang Yang, Pengpeng Zou, Yanni Hu, Heng Lu |
| 2023 | DATE | PRADA: Point Cloud Recognition Acceleration via Dynamic Approximation. | Zhuoran Song, Heng Lu, Gang Li, Li Jiang, Naifeng Jing, Xiaoyao Liang |
| 2023 | EMNLP | Symbolization, Prompt, and Classification: A Framework for Implicit Speaker Identification in Novels. | Yue Chen, Tian-Wei He, Hongbin Zhou, Jia-Chen Gu, Heng Lu, Zhen-Hua Ling |
| 2023 | ICASSP | Hybridformer: Improving Squeezeformer with Hybrid Attention and NSR Mechanism. | Yuguang Yang, Yu Pan, Jingjing Yin, Jiangyu Han, Lei Ma, Heng Lu |
| 2022 | ICASSP | The USTC-Ximalaya System for the ICASSP 2022 Multi-Channel Multi-Party Meeting Transcription (M2met) Challenge. | Maokui He, Xiang Lv, Weilin Zhou, Jingjing Yin, Xiaoqi Zhang, Yuxuan Wang, Shutong Niu, Yuhang Cao, Heng Lu, Jun Du, Chin-Hui Lee |
| 2022 | ICASSP | Improving Cross-Lingual Speech Synthesis with Triplet Training Scheme. | Jianhao Ye, Hongbin Zhou, Zhiba Su, Wendi He, Kaimeng Ren, Lin Li, Heng Lu |
| 2022 | ICCAD | Gzippo: Highly-Compact Processing-in-Memory Graph Accelerator Alleviating Sparsity and Redundancy. | Xing Li, Rachata Ausavarungnirun, Xiao Liu, Xueyuan Liu, Xuan Zhang, Heng Lu, Zhuoran Song, Naifeng Jing, Xiaoyao Liang |
| 2022 | ICCD | GCNTrain: A Unified and Efficient Accelerator for Graph Convolutional Neural Network Training. | Heng Lu, Zhuoran Song, Xing Li, Naifeng Jing, Xiaoyao Liang |
| 2020 | ICASSP | Pitchnet: Unsupervised Singing Voice Conversion with Pitch Adversarial Network. | Chengqi Deng, Chengzhu Yu, Heng Lu, Chao Weng, Dong Yu |
| 2020 | Interspeech | FeatherWave: An Efficient High-Fidelity Neural Vocoder with Multi-Band Linear Prediction. | Qiao Tian, Zewang Zhang, Heng Lu, Ling-Hui Chen, Shan Liu |
| 2020 | Interspeech | Peking Opera Synthesis via Duration Informed Attention Network. | Yusong Wu, Shengchen Li, Chengzhu Yu, Heng Lu, Chao Weng, Liqiang Zhang, Dong Yu |
| 2020 | Interspeech | DurIAN: Duration Informed Attention Network for Speech Synthesis. | Chengzhu Yu, Heng Lu, Na Hu, Meng Yu, Chao Weng, Kun Xu, Peng Liu, Deyi Tuo, Shiyin Kang, Guangzhi Lei, Dan Su, Dong Yu |
| 2020 | Interspeech | DurIAN-SC: Duration Informed Attention Network Based Singing Voice Conversion System. | Liqiang Zhang, Chengzhu Yu, Heng Lu, Chao Weng, Chunlei Zhang, Yusong Wu, Xiang Xie, Zijin Li, Dong Yu |
| 2019 | ICASSP | Enhancing Hybrid Self-attention Structure with Relative-position-aware Bias for Speech Synthesis. | Shan Yang, Heng Lu, Shiying Kang, Lei Xie, Dong Yu |
| 2018 | ICASSP | Deep Feed-Forward Sequential Memory Networks for Speech Synthesis. | Mengxiao Bi, Heng Lu, Shiliang Zhang, Ming Lei, Zhijie Yan |
| 2018 | ICASSP | Linear Networks Based Speaker Adaptation for Speech Synthesis. | Zhiying Huang, Heng Lu, Ming Lei, Zhijie Yan |
| 2016 | Interspeech | Model-Based Parametric Prosody Synthesis with Deep Neural Network. | Hao Liu, Heng Lu, Xu Shao, Yi Xu |
| 2015 | Interspeech | Pruning redundant synthesis units based on static and delta unit appearance frequency. | Heng Lu, Wei Zhang, Xu Shao, Quan Zhou, Wenhui Lei, Hongbin Zhou, Andrew P. Breen |
| 2014 | HPCC | MOBBS: A Multi-tiered Block Storage System for Virtual Machines Using Object-Based Storage. | Sixiang Ma, Haopeng Chen, Heng Lu, Bin Wei, Pujiang He |
| 2014 | ICPADS | Providing hybrid block storage for virtual machines using object-based storage. | Sixiang Ma, Haopeng Chen, Yuxi Shen, Heng Lu, Bin Wei, Pujiang He |
| 2013 | ICASSP | Factorized context modelling for Text-to-Speech synthesis. | Heng Lu, Simon King |
| 2012 | Interspeech | Using Bayesian Networks to find relevant context features for HMM-based speech synthesis. | Heng Lu, Simon King |
| 2011 | ICASSP | Building HMM based unit-selection speech synthesis system using synthetic speech naturalness evaluation score. | Heng Lu, Zhen-Hua Ling, Li-Rong Dai, Ren-Hua Wang |
| 2010 | Interspeech | Automatic error detection for unit selection speech synthesis using log likelihood ratio based SVM classifier. | Heng Lu, Zhen-Hua Ling, Si Wei, Li-Rong Dai, Ren-Hua Wang |
| 2009 | ICASSP | Full covariance state duration modeling for HMM-based speech synthesis. | Heng Lu, Yi-Jian Wu, Keiichi Tokuda, Li-Rong Dai, Ren-Hua Wang |
| 2008 | ICSE | Testing pervasive software in the presence of context inconsistency resolution services. | Heng Lu, W. K. Chan, T. H. Tse |
| 2008 | IGARSS | RBF Neural Network Supported Classification of Remote Sensing Images Based on TM/ETM+ in Nanjing. | Kai Cao, Bo Huang, Heng Lu, Biao Liu |
| 2007 | ICSE | A Context-Oriented Framework for Software Testing in Pervasive Environment. | Heng Lu |
| 2004 | COMPSAC | Testing Context-Sensitive Middleware-Based Software Applications. | T. H. Tse, Stephen S. Yau, W. K. Chan, Heng Lu, Tsong Yueh Chen |