| 2025 | ICASSP | SEF-PNet: Speaker Encoder-Free Personalized Speech Enhancement with Local and Global Contexts Aggregation. | Ziling Huang, Haixin Guan, Haoran Wei, Yanhua Long |
| 2025 | ICASSP | Leveraging Out-of-Domain Noise for Unsupervised Domain Adaptation in Speech Enhancement. | Yu Liao, Haixin Guan, Shuang Wei, Yanhua Long |
| 2025 | ICASSP | Personalized Speech Enhancement without User Enrollment for Real-World Audio Replay Scenarios. | Haoran Wei, Shilin Wang, Yanhua Long |
| 2024 | ICASSP | Cross-Modal Parallel Training for Improving end-to-end Accented Speech Recognition. | Renchang Dong, Yijie Li, Dongxing Xu, Yanhua Long |
| 2024 | ICASSP | Accent-Specific Vector Quantization for Joint Unsupervised and Supervised Training in Accent Robust Speech Recognition. | Li Li, Yijie Li, Dongxing Xu, Haoran Wei, Yanhua Long |
| 2024 | ICASSP | Score Calibration Based on Consistency Measure Factor for Speaker Verification. | Yu Zheng, Yajun Zhang, Chuanying Niu, Yibin Zhan, Yanhua Long, Dongxing Xu |
| 2024 | Interspeech | QMixCAT: Unsupervised Speech Enhancement Using Quality-guided Signal Mixing and Competitive Alternating Model Training. | Shilin Wang, Haixin Guan, Yanhua Long |
| 2023 | ICASSP | FEW-Shot Continual Learning with Weight Alignment and Positive Enhancement for Bioacoustic Event Detection. | Xiaoxiao Wu, Dongxing Xu, Haoran Wei, Yanhua Long |
| 2023 | Interspeech | Advanced RawNet2 with Attention-based Channel Masking for Synthetic Speech Detection. | Jing Li, Yanhua Long, Yijie Li, Dongxing Xu |
| 2023 | Interspeech | Phonetic-assisted Multi-Target Units Modeling for Improving Conformer-Transducer ASR system. | Li Li, Dongxing Xu, Haoran Wei, Yanhua Long |
| 2023 | Interspeech | Multi-pass Training and Cross-information Fusion for Low-resource End-to-end Accented Speech Recognition. | Xuefei Wang, Yanhua Long, Yijie Li, Haoran Wei |
| 2022 | ICASSP | DPCCN: Densely-Connected Pyramid Complex Convolutional Network for Robust Speech Separation and Extraction. | Jiangyu Han, Yanhua Long, Luks Burget, Jan Cernock |
| 2022 | Interspeech | PercepNet+: A Phase and SNR Aware PercepNet for Real-Time Speech Enhancement. | Xiaofeng Ge, Jiangyu Han, Yanhua Long, Haixin Guan |
| 2022 | Interspeech | Selective Pseudo-labeling and Class-wise Discriminative Fusion for Sound Event Detection. | Yunhao Liang, Yanhua Long, Yijie Li, Jiaen Liang |
| 2021 | ASRU | Attention-Based Scaling Adaptation for Target Speech Extraction. | Jiangyu Han, Wei Rao, Yanhua Long, Jiaen Liang |
| 2021 | ICASSP | Multi-Channel Target Speech Extraction with Channel Decorrelation and Target Speaker Adaptation. | Jiangyu Han, Xinyuan Zhou, Yanhua Long, Yijie Li |
| 2021 | Interspeech | Improving Channel Decorrelation for Multi-Channel Target Speech Extraction. | Jiangyu Han, Wei Rao, Yannan Wang, Yanhua Long |
| 2020 | Interspeech | Self-and-Mixed Attention Decoder with Deep Acoustic Structure for Transformer-Based LVCSR. | Xinyuan Zhou, Grandee Lee, Emre Yilmaz, Yanhua Long, Jiaen Liang, Haizhou Li |
| 2020 | Interspeech | Multi-Encoder-Decoder Transformer for Code-Switching Speech Recognition. | Xinyuan Zhou, Emre Yilmaz, Yanhua Long, Yijie Li, Haizhou Li |
| 2018 | Interspeech | Active Learning for LF-MMI Trained Neural Networks in ASR. | Yanhua Long, Hong Ye, Yijie Li, Jiaen Liang |
| 2013 | Interspeech | Automatic Transcription of Multi-genre Media Archives. | Pierre Lanchantin, Peter Bell, Mark J. F. Gales, Thomas Hain, Xunying Liu, Yanhua Long, Jennifer Quinnell, Steve Renals, Oscar Saz, Matthew Stephen Seigel, Pawel Swietojanski, Philip C. Woodland |
| 2013 | Interspeech | Improving lightly supervised training for broadcast transcription. | Yanhua Long, Mark J. F. Gales, Pierre Lanchantin, Xunying Liu, Matthew Stephen Seigel, Philip C. Woodland |
| 2011 | ICASSP | Speaker characterization using spectral subband energy ratio based on Harmonic plus Noise Model. | Yanhua Long, Zhi-Jie Yan, Frank K. Soong, Li-Rong Dai, Wu Guo |
| 2011 | Interspeech | Improvements in Speaker Characterization Using Spectral Subband Energy Based on Harmonic plus Noise Model. | Yanhua Long, Zhi-Jie Yan, Frank K. Soong, Li-Rong Dai, Wu Guo |
| 2010 | ICASSP | N-gram nearest neighbor algorithm for voice password system. | Wu Guo, Zhao Zhang, Yanhua Long, Li-Rong Dai |
| 2010 | Interspeech | Effects of the phonological relevance in speaker verification. | Yanhua Long, Li-Rong Dai, Bin Ma, Wu Guo |
| 2009 | ICASSP | iFLY system for the NIST 2008 speaker recognition evaluation. | Wu Guo, Yanhua Long, Yijie Li, Lei Pan, Eryu Wang, Li-Rong Dai |
| 2009 | ICASSP | Exploiting prosodic information for Speaker Recognition. | Yanhua Long, Bin Ma, Haizhou Li, Wu Guo, Chng Eng Siong, Li-Rong Dai |