| 2025 | ACL | Nemotron-CC: Transforming Common Crawl into a Refined Long-Horizon Pretraining Dataset. | Dan Su, Kezhi Kong, Ying Lin, Joseph Jennings, Brandon Norick, Markus Kliegl, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro |
| 2024 | ACL | MM-LLMs: Recent Advances in MultiModal Large Language Models. | Duzhen Zhang, Yahan Yu, Jiahua Dong, Chenxing Li, Dan Su, Chenhui Chu, Dong Yu |
| 2024 | ACL | Generative Pre-trained Speech Language Model with Efficient Hierarchical Transformer. | Yongxin Zhu, Dan Su, Liqiang He, Linli Xu, Dong Yu |
| 2024 | ICASSP | DurIAN-E 2: Duration Informed Attention Network with Adaptive Variational Autoencoder and Adversarial Learning for Expressive Text-to-Speech Synthesis. | Yu Gu, Qiushi Zhu, Guangzhi Lei, Chao Weng, Dan Su |
| 2024 | ICASSP | Opine: Leveraging a Optimization-Inspired Deep Unfolding Method for Multi-Channel Speech Enhancement. | Andong Li, Rilin Chen, Yu Gu, Chao Weng, Dan Su |
| 2024 | ICML | Prompt-guided Precise Audio Editing with Diffusion Models. | Manjie Xu, Chenxing Li, Duzhen Zhang, Dan Su, Wei Liang, Dong Yu |
| 2024 | MICCAI | ORCGT: Ollivier-Ricci Curvature-Based Graph Model for Lung STAS Prediction. | Min Cen, Zheng Wang, Zhenfeng Zhuang, Hong Zhang, Dan Su, Zhen Bao, Weiwei Wei, Baptiste Magnier, Lequan Yu, Liansheng Wang |
| 2023 | AAAI | UniSyn: An End-to-End Unified Model for Text-to-Speech and Singing Voice Synthesis. | Yi Lei, Shan Yang, Xinsheng Wang, Qicong Xie, Jixun Yao, Lei Xie, Dan Su |
| 2023 | ACL | NusaCrowd: Open Source Initiative for Indonesian NLP Resources. | Samuel Cahyawijaya, Holy Lovenia, Alham Fikri Aji, Genta Indra Winata, Bryan Wilie, Fajri Koto, Rahmad Mahendra, Christian Wibisono, Ade Romadhony, Karissa Vincentio, Jennifer Santoso, David Moeljadi, Cahya Wirawan, Frederikus Hudi, Muhammad Satrio Wicaksono, Ivan Halim Parmonangan, Ika Alfina, Ilham Firdausi Putra, Samsul Rahmadani, Yulianti Oenang, Ali Akbar Septiandri, James Jaya, Kaustubh D. Dhole, Arie Ardiyanti Suryani, Rifki Afina Putri, Dan Su, Keith Stevens, Made Nindyatama Nityasya, Muhammad Farid Adilazuarda, Ryan Hadiwijaya, Ryandito Diandaru, Tiezheng Yu, Vito Ghifari, Wenliang Dai, Yan Xu, Dyah Damapuspita, Haryo Akbarianto Wibowo, Cuk Tho, Ichwanul Muslim Karo Karo, Tirana Fatyanosa, Ziwei Ji, Graham Neubig, Timothy Baldwin, Sebastian Ruder, Pascale Fung, Herry Sujaini, Sakriani Sakti, Ayu Purwarianti |
| 2023 | AIES | Model Debiasing via Gradient-based Explanation on Representation. | Jindi Zhang, Luning Wang, Dan Su, Yongxiang Huang, Caleb Chen Cao, Lei Chen |
| 2023 | EACL | Plausible May Not Be Faithful: Probing Object Hallucination in Vision-Language Pre-training. | Wenliang Dai, Zihan Liu, Ziwei Ji, Dan Su, Pascale Fung |
| 2023 | EACL | Context Generation Improves Open Domain Question Answering. | Dan Su, Mostofa Patwary, Shrimai Prabhumoye, Peng Xu, Ryan Prenger, Mohammad Shoeybi, Pascale Fung, Anima Anandkumar, Bryan Catanzaro |
| 2023 | ICASSP | Trinet: Stabilizing Self-Supervised Learning From Complete or Slow Collapse. | Lixin Cao, Jun Wang, Ben Yang, Dan Su, Dong Yu |
| 2023 | IJCNLP | A Multitask, Multilingual, Multimodal Evaluation of ChatGPT on Reasoning, Hallucination, and Interactivity. | Yejin Bang, Samuel Cahyawijaya, Nayeon Lee, Wenliang Dai, Dan Su, Bryan Wilie, Holy Lovenia, Ziwei Ji, Tiezheng Yu, Willy Chung, Quyet V. Do, Yan Xu, Pascale Fung |
| 2023 | Interspeech | Multi-mode Neural Speech Coding Based on Deep Generative Networks. | Wei Xiao, Wenzhe Liu, Meng Wang, Shan Yang, Yupeng Shi, Yuyong Kang, Dan Su, Shidong Shang, Dong Yu |
| 2023 | Interspeech | Compressed MoE ASR Model Based on Knowledge Distillation and Quantization. | Yuping Yuan, Zhao You, Shulin Feng, Dan Su, Yanchun Liang, Xiaohu Shi, Dong Yu |
| 2023 | Interspeech | Text-Only Domain Adaptation for End-to-End Speech Recognition through Down-Sampling Acoustic Representation. | Jiaxu Zhu, Weinan Tong, Yaoxun Xu, Changhe Song, Zhiyong Wu, Zhao You, Dan Su, Dong Yu, Helen Meng |
| 2022 | ACL | Read before Generate! Faithful Long Form Question Answering with Machine Reading. | Dan Su, Xiaoguang Li, Jindi Zhang, Lifeng Shang, Xin Jiang, Qun Liu, Pascale Fung |
| 2022 | ICASSP | Enhancing Speaking Styles in Conversational Text-to-Speech Synthesis with Graph-Based Multi-Modal Context Modeling. | Jingbei Li, Yi Meng, Chenyi Li, Zhiyong Wu, Helen Meng, Chao Weng, Dan Su |
| 2022 | ICASSP | Referee: Towards Reference-Free Cross-Speaker Style Transfer with Low-Quality Data for Expressive Speech Synthesis. | Songxiang Liu, Shan Yang, Dan Su, Dong Yu |
| 2022 | ICASSP | DP-DWA: Dual-Path Dynamic Weight Attention Network With Streaming Dfsmn-San For Automatic Speech Recognition. | Dongpeng Ma, Yiwen Wang, Liqiang He, Mingjie Jin, Dan Su, Dong Yu |
| 2022 | ICASSP | Simple Attention Module Based Speaker Verification with Iterative Noisy Label Detection. | Xiaoyi Qin, Na Li, Chao Weng, Dan Su, Ming Li |
| 2022 | ICASSP | QA4QG: Using Question Answering to Constrain Multi-Hop Question Generation. | Dan Su, Peng Xu, Pascale Fung |
| 2022 | ICASSP | Consistent Training and Decoding for End-to-End Speech Recognition Using Lattice-Free MMI. | Jinchuan Tian, Jianwei Yu, Chao Weng, Shi-Xiong Zhang, Dan Su, Dong Yu, Yuexian Zou |
| 2022 | ICASSP | VCVTS: Multi-Speaker Video-to-Speech Synthesis Via Cross-Modal Knowledge Transfer from Voice Conversion. | Disong Wang, Shan Yang, Dan Su, Xunying Liu, Dong Yu, Helen Meng |
| 2022 | ICASSP | Speechmoe2: Mixture-of-Experts Model with Improved Routing. | Zhao You, Shulin Feng, Dan Su, Dong Yu |
| 2022 | ICASSP | The CUHK-Tencent Speaker Diarization System for the ICASSP 2022 Multi-Channel Multi-Party Meeting Transcription Challenge. | Naijun Zheng, Na Li, Xixin Wu, Lingwei Meng, Jiawen Kang, Haibin Wu, Chao Weng, Dan Su, Helen Meng |
| 2022 | ICASSP | Multi-Channel Speaker Diarization Using Spatial Features for Meetings. | Naijun Zheng, Na Li, Jianwei Yu, Chao Weng, Dan Su, Xunying Liu, Helen Meng |
| 2022 | ICLR | BDDM: Bilateral Denoising Diffusion Models for Fast and High-Quality Speech Synthesis. | Max W. Y. Lam, Jun Wang, Dan Su, Dong Yu |
| 2022 | IJCAI | FastDiff: A Fast Conditional Diffusion Model for High-Quality Speech Synthesis. | Rongjie Huang, Max W. Y. Lam, Jun Wang, Dan Su, Dong Yu, Yi Ren, Zhou Zhao |
| 2022 | Interspeech | Glow-WaveGAN 2: High-quality Zero-shot Text-to-speech Synthesis and Any-to-any Voice Conversion. | Yi Lei, Shan Yang, Jian Cong, Lei Xie, Dan Su |
| 2022 | Interspeech | Cross-Age Speaker Verification: Learning Age-Invariant Speaker Embeddings. | Xiaoyi Qin, Na Li, Chao Weng, Dan Su, Ming Li |
| 2022 | Interspeech | Learning Noise-independent Speech Representation for High-quality Voice Conversion for Noisy Target Speakers. | Liumeng Xue, Shan Yang, Na Hu, Dan Su, Lei Xie |
| 2022 | Interspeech | Enhancing Word-Level Semantic Representation via Dependency Structure for Expressive Text-to-Speech Synthesis. | Yixuan Zhou, Changhe Song, Jingbei Li, Zhiyong Wu, Yanyao Bian, Dan Su, Helen Meng |
| 2022 | Interspeech | Content-Dependent Fine-Grained Speaker Embedding for Zero-Shot Speaker Adaptation in Text-to-Speech Synthesis. | Yixuan Zhou, Changhe Song, Xiang Li, Luwen Zhang, Zhiyong Wu, Yanyao Bian, Dan Su, Helen Meng |
| 2021 | AAAI | Tune-In: Training Under Negative Environments with Interference for Attention Networks Simulating Cocktail Party Effect. | Jun Wang, Max W. Y. Lam, Dan Su, Dong Yu |
| 2021 | ACL | Improve Query Focused Abstractive Summarization by Incorporating Answer Relevance. | Dan Su, Tiezheng Yu, Pascale Fung |
| 2021 | ASRU | Latency-Controlled Neural Architecture Search for Streaming Speech Recognition. | Liqiang He, Shulin Feng, Dan Su, Dong Yu |
| 2021 | ASRU | DiffSVC: A Diffusion Probabilistic Model for Singing Voice Conversion. | Songxiang Liu, Yuewen Cao, Dan Su, Helen Meng |
| 2021 | ICASSP | Learned Transferable Architectures Can Surpass Hand-Designed Architectures for Large Scale Speech Recognition. | Liqiang He, Dan Su, Dong Yu |
| 2021 | ICASSP | Sandglasset: A Light Multi-Granularity Self-Attentive Network for Time-Domain Speech Separation. | Max W. Y. Lam, Jun Wang, Dan Su, Dong Yu |
| 2021 | ICASSP | Replay and Synthetic Speech Detection with Res2Net Architecture. | Xu Li, Na Li, Chao Weng, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2021 | ICASSP | Non-Autoregressive Transformer ASR with CTC-Enhanced Decoder Input. | Xingchen Song, Zhiyong Wu, Yiheng Huang, Chao Weng, Dan Su, Helen M. Meng |
| 2021 | ICASSP | Contrastive Separative Coding for Self-Supervised Representation Learning. | Jun Wang, Max W. Y. Lam, Dan Su, Dong Yu |
| 2021 | ICASSP | A Joint Training Framework of Multi-Look Separator and Speaker Embedding Extractor for Overlapped Speech. | Naijun Zheng, Na Li, Bo Wu, Meng Yu, Jianwei Yu, Chao Weng, Dan Su, Xunying Liu, Helen Meng |
| 2021 | ICMI | TeNC: Low Bit-Rate Speech Coding with VQ-VAE and GAN. | Yi Chen, Shan Yang, Na Hu, Lei Xie, Dan Su |
| 2021 | Interspeech | GigaSpeech: An Evolving, Multi-Domain ASR Corpus with 10, 000 Hours of Transcribed Audio. | Guoguo Chen, Shuzhou Chai, Guan-Bo Wang, Jiayu Du, Wei-Qiang Zhang, Chao Weng, Dan Su, Daniel Povey, Jan Trmal, Junbo Zhang, Mingjie Jin, Sanjeev Khudanpur, Shinji Watanabe, Shuaijiang Zhao, Wei Zou, Xiangang Li, Xuchen Yao, Yongqing Wang, Zhao You, Zhiyong Yan |
| 2021 | Interspeech | Controllable Context-Aware Conversational Speech Synthesis. | Jian Cong, Shan Yang, Na Hu, Guangzhi Li, Lei Xie, Dan Su |
| 2021 | Interspeech | Glow-WaveGAN: Learning Speech Representations from GAN-Based Variational Auto-Encoder for High Fidelity Flow-Based Speech Synthesis. | Jian Cong, Shan Yang, Lei Xie, Dan Su |
| 2021 | Interspeech | Raw Waveform Encoder with Multi-Scale Globally Attentive Locally Recurrent Networks for End-to-End Speech Recognition. | Max W. Y. Lam, Jun Wang, Chao Weng, Dan Su, Dong Yu |
| 2021 | Interspeech | TeCANet: Temporal-Contextual Attention Network for Environment-Aware Speech Dereverberation. | Helin Wang, Bo Wu, Lianwu Chen, Meng Yu, Jianwei Yu, Yong Xu, Shi-Xiong Zhang, Chao Weng, Dan Su, Dong Yu |
| 2021 | Interspeech | SpeechMoE: Scaling to Large Acoustic Models with Dynamic Routing Mixture of Experts. | Zhao You, Shulin Feng, Dan Su, Dong Yu |
| 2020 | EMNLP | Multi-hop Question Generation with Graph Convolutional Network. | Dan Su, Yan Xu, Wenliang Dai, Ziwei Ji, Tiezheng Yu, Pascale Fung |
| 2020 | EMNLP | CAiRE-COVID: A Question Answering and Query-focused Multi-Document Summarization System for COVID-19 Scholarly Information Management. | Dan Su, Yan Xu, Tiezheng Yu, Farhad Bin Siddique, Elham J. Barezi, Pascale Fung |
| 2020 | EMNLP | Dimsum @LaySumm 20. | Tiezheng Yu, Dan Su, Wenliang Dai, Pascale Fung |
| 2020 | ICASSP | Code-Switched Speech Synthesis Using Bilingual Phonetic Posteriorgram with Only Monolingual Corpora. | Yuewen Cao, Songxiang Liu, Xixin Wu, Shiyin Kang, Peng Liu, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | ICASSP | Enhancing End-to-End Multi-Channel Speech Separation Via Spatial Feature Learning. | Rongzhi Gu, Shi-Xiong Zhang, Lianwu Chen, Yong Xu, Meng Yu, Dan Su, Yuexian Zou, Dong Yu |
| 2020 | ICASSP | A Random Gossip BMUF Process for Neural Language Modeling. | Yiheng Huang, Jinchuan Tian, Lei Han, Guangsen Wang, Xingcheng Song, Dan Su, Dong Yu |
| 2020 | ICASSP | Integration of Multi-Look Beamformers for Multi-Channel Keyword Spotting. | Xuan Ji, Meng Yu, Jie Chen, Jimeng Zheng, Dan Su, Dong Yu |
| 2020 | ICASSP | Speaker-Aware Target Speaker Enhancement by Jointly Learning with Speaker Embedding Extraction. | Xuan Ji, Meng Yu, Chunlei Zhang, Dan Su, Tao Yu, Xiaoyu Liu, Dong Yu |
| 2020 | ICASSP | Mixup-breakdown: A Consistency Training Method for Improving Generalization of Speech Separation Models. | Max W. Y. Lam, Jun Wang, Dan Su, Dong Yu |
| 2020 | ICASSP | Multi-Level Deep Neural Network Adaptation for Speaker Verification Using MMD and Consistency Regularization. | Weiwei Lin, Man-Wai Mak, Na Li, Dan Su, Dong Yu |
| 2020 | ICASSP | End-To-End Accent Conversion Without Using Native Utterances. | Songxiang Liu, Disong Wang, Yuewen Cao, Lifa Sun, Xixin Wu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | ICASSP | Improving Spoken Question Answering Using Contextualized Word Representation. | Dan Su, Pascale Fung |
| 2020 | ICASSP | Dfsmn-San with Persistent Memory Model for Automatic Speech Recognition. | Zhao You, Dan Su, Jie Chen, Chao Weng, Dong Yu |
| 2020 | Interspeech | End-to-End Multi-Look Keyword Spotting. | Meng Yu, Xuan Ji, Bo Wu, Dan Su, Dong Yu |
| 2020 | Interspeech | Investigating Robustness of Adversarial Samples Detection for Automatic Speaker Verification. | Xu Li, Na Li, Jinghua Zhong, Xixin Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | Interspeech | Transferring Source Style in Non-Parallel Voice Conversion. | Songxiang Liu, Yuewen Cao, Shiyin Kang, Na Hu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | Interspeech | SpecSwap: A Simple Data Augmentation Method for End-to-End Speech Recognition. | Xingcheng Song, Zhiyong Wu, Yiheng Huang, Dan Su, Helen Meng |
| 2020 | Interspeech | Speech-XLNet: Unsupervised Acoustic Model Pretraining for Self-Attention Networks. | Xingchen Song, Guangsen Wang, Yiheng Huang, Zhiyong Wu, Dan Su, Helen Meng |
| 2020 | Interspeech | DurIAN: Duration Informed Attention Network for Speech Synthesis. | Chengzhu Yu, Heng Lu, Na Hu, Meng Yu, Chao Weng, Kun Xu, Peng Liu, Deyi Tuo, Shiyin Kang, Guangzhi Lei, Dan Su, Dong Yu |
| 2020 | Interspeech | Audio-Visual Multi-Channel Recognition of Overlapped Speech. | Jianwei Yu, Bo Wu, Rongzhi Gu, Shi-Xiong Zhang, Lianwu Chen, Yong Xu, Meng Yu, Dan Su, Dong Yu, Xunying Liu, Helen Meng |
| 2019 | ASRU | Syllable-Dependent Discriminative Learning for Small Footprint Text-Dependent Speaker Verification. | Junyi Peng, Yuexian Zou, Na Li, Deyi Tuo, Dan Su, Meng Yu, Chunlei Zhang, Dong Yu |
| 2019 | ASRU | Improving Speech Enhancement with Phonetic Embedding Features. | Bo Wu, Meng Yu, Lianwu Chen, Mingjie Jin, Dan Su, Dong Yu |
| 2019 | ICASSP | Multi-band PIT and Model Integration for Improved Multi-channel Speech Separation. | Lianwu Chen, Meng Yu, Dan Su, Dong Yu |
| 2019 | ICASSP | Boundary Discriminative Large Margin Cosine Loss for Text-independent Speaker Verification. | Rongjin Li, Na Li, Deyi Tuo, Meng Yu, Dan Su, Dong Yu |
| 2019 | ICASSP | Component Fusion: Learning Replaceable Language Model Component for End-to-end Speech Recognition System. | Changhao Shan, Chao Weng, Guangsen Wang, Dan Su, Min Luo, Dong Yu, Lei Xie |
| 2019 | ICASSP | Investigating End-to-end Speech Recognition for Mandarin-english Code-switching. | Changhao Shan, Chao Weng, Guangsen Wang, Dan Su, Min Luo, Dong Yu, Lei Xie |
| 2019 | ICASSP | Learning Discriminative Features in Sequence Training without Requiring Framewise Labelled Data. | Jun Wang, Dan Su, Jie Chen, Shulin Feng, Dongpeng Ma, Na Li, Dong Yu |
| 2019 | ICASSP | Quasi-fully Convolutional Neural Network with Variational Inference for Speech Synthesis. | Mu Wang, Xixin Wu, Zhiyong Wu, Shiyin Kang, Deyi Tuo, Guangzhi Li, Dan Su, Dong Yu, Helen Meng |
| 2019 | ICASSP | Joint Training of Complex Ratio Mask Based Beamformer and Acoustic Model for Noise Robust Asr. | Yong Xu, Chao Weng, Like Hui, Jianming Liu, Meng Yu, Dan Su, Dong Yu |
| 2019 | ICASSP | Teach an All-rounder with Experts in Different Domains. | Zhao You, Dan Su, Dong Yu |
| 2019 | Interspeech | Disambiguation of Chinese Polyphones in an End-to-End Framework with Semantic Features Extracted by Pre-Trained BERT. | Dongyang Dai, Zhiyong Wu, Shiyin Kang, Xixin Wu, Jia Jia, Dan Su, Dong Yu, Helen Meng |
| 2019 | Interspeech | Neural Spatial Filter: Target Speaker Speech Separation Assisted with Directional Information. | Rongzhi Gu, Lianwu Chen, Shi-Xiong Zhang, Jimeng Zheng, Yong Xu, Meng Yu, Dan Su, Yuexian Zou, Dong Yu |
| 2019 | Interspeech | Extract, Adapt and Recognize: An End-to-End Neural Network for Corrupted Monaural Speech Recognition. | Max W. Y. Lam, Jun Wang, Xunying Liu, Helen Meng, Dan Su, Dong Yu |
| 2019 | IROS | DISR: Deep Infrared Spectral Restoration Algorithm for Robot Sensing and Intelligent Visual Tracking Systems. | Hai Liu, Youfu Li, Dan Su, Zhaoli Zhang, Sannyuya Liu, Tingting Liu |
| 2019 | IROS | Region-wise Polynomial Regression for 3D Mobile Gaze Estimation. | Dan Su, Youfu Li, Hao Chen |
| 2018 | Interspeech | Permutation Invariant Training of Generative Adversarial Network for Monaural Speech Separation. | Lianwu Chen, Meng Yu, Yanmin Qian, Dan Su, Dong Yu |
| 2018 | Interspeech | Deep Discriminative Embeddings for Duration Robust Speaker Verification. | Na Li, Deyi Tuo, Dan Su, Zhifeng Li, Dong Yu |
| 2018 | Interspeech | Deep Extractor Network for Target Speaker Recovery from Single Channel Speech Mixtures. | Jun Wang, Jie Chen, Dan Su, Lianwu Chen, Meng Yu, Yanmin Qian, Dong Yu |
| 2018 | Interspeech | Improving Attention Based Sequence-to-Sequence Models for End-to-End English Conversational Speech Recognition. | Chao Weng, Jia Cui, Guangsen Wang, Jun Wang, Chengzhu Yu, Dan Su, Dong Yu |
| 2018 | Interspeech | Rapid Style Adaptation Using Residual Error Embedding for Expressive Speech Synthesis. | Xixin Wu, Yuewen Cao, Mu Wang, Songxiang Liu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2018 | Interspeech | Text-Dependent Speech Enhancement for Small-Footprint Robust Keyword Detection. | Meng Yu, Xuan Ji, Yi Gao, Lianwu Chen, Jie Chen, Jimeng Zheng, Dan Su, Dong Yu |
| 2018 | IROS | Attention-Aware Cross-Modal Cross-Level Fusion Network for RGB-D Salient Object Detection. | Hao Chen, Youfu Li, Dan Su |
| 2017 | IROS | M | Hao Chen, You-Fu Li, Dan Su |
| 2017 | ICRA | Development of precise mobile gaze tracking system based on online sparse Gaussian process regression and smooth-pursuit identification. | Dan Su, Youfu Li |
| 2017 | ICVS | RGB-D Saliency Detection by Multi-stream Late Fusion Network. | Hao Chen, Youfu Li, Dan Su |
| 2016 | TrustCom | Anomadroid: Profiling Android Applications' Behaviors for Identifying Unknown Malapps. | Dan Su, Wei Wang, Xing Wang, Jiqiang Liu |
| 2013 | HPCC | A New Algorithm for Repairing Non-manifold Surfaces. | Yaoping Fei, Songqiao Chen, Dan Su, Jianping Luo, Min Li |
| 2013 | ICASSP | Multimodal music emotion classification using AdaBoost with decision stumps. | Dan Su, Pascale Fung, Nicolas Auguin |
| 2012 | Interspeech | Probabilistic Speaker-Class based Acoustic Modeling for Large Vocabulary Continuous Speech Recognition. | Xiangang Li, Dan Su, Zaihu Pang, Xihong Wu |
| 2010 | ICASSP | GMM-HMM acoustic model training by a two level procedure with Gaussian components determined by automatic model selection. | Dan Su, Xihong Wu, Lei Xu |
| 2008 | Interspeech | Probabilistic latent speaker training for large vocabulary speech recognition. | Dan Su, Xihong Wu, Huisheng Chi |
| 2007 | Interspeech | Probabilistic latent speaker analysis for large vocabulary speech recognition. | Dan Su, Xihong Wu, Huisheng Chi |