| 2025 | On the Use of Self-Supervised Representation Learning for Speaker Diarization and Separation. | Sverin Baroudi, Herv Bredin, Joseph Razik, Ricard Marxer |
| 2025 | State-of-the-art Embeddings with Video-free Segmentation of the Source VoxCeleb Data. | Sara Barahona, Ladislav Mosner, Themos Stafylakis, Oldrich Plchot, Junyi Peng, Luks Burget, Jan Cernock |
| 2025 | CoLMbo: Speaker Language Model for Descriptive Profiling. | Massa Baali, Shuo Han, Syed Abdul Hannan, Purusottam Samal, Karanveer Singh, Soham Deshmukh, Rita Singh, Bhiksha Raj |
| 2025 | WhisperNER: Unified Open Named Entity and Speech Recognition. | Gil Ayache, Menachem Pirchi, Aviv Navon, Aviv Shamsian, Gill Hetz, Joseph Keshet |
| 2025 | TurboBias: Universal ASR Context-Biasing powered by GPU-accelerated Phrase-Boosting Tree. | Andrei Andrusenko, Vladimir Bataev, Lilit Grigoryan, Vitaly Lavrukhin, Boris Ginsburg |
| 2025 | ULTRAS - Unified Learning of Transformer Representations for Audio and Speech Signals. | P. E. Ameenudeen, Charumathi Narayanan, Sriram Ganapathy |
| 2025 | Bottleneck Transformer-Based Approach for Improved Automatic STOI Score Prediction. | Amartyaveer, Murali Kadambi, Chandra Mohan Sharma, Anupam Mandal, Prasanta Kumar Ghosh |
| 2025 | Whispering Context: Distilling Syntax and Semantics for Long Speech Transcripts. | Duygu Altinok |
| 2025 | Multilingual Dataset Integration Strategies for Robust Audio Deepfake Detection: A SAFE Challenge System. | Hashim Ali, Surya Subramani, Nithin Sai Adupa, Lekha Bollinani, Sali El-Loh, Hafiz Malik |
| 2023 | Bisinger: Bilingual Singing Voice Synthesis. | Huali Zhou, Yueqian Lin, Yao Shi, Peng Sun, Ming Li |
| 2023 | The Gift of Feedback: Improving ASR Model Quality by Learning from User Corrections Through Federated Learning. | Lillian Zhou, Yuxin Ding, Mingqing Chen, Harry Zhang, Rohit Prabhavalkar, Dhruv Guliani, Giovanni Motta, Rajiv Mathews |
| 2023 | VITS-Based Singing Voice Conversion System with DSPGAN Post-Processing for SVCC2023. | Yiquan Zhou, Meng Chen, Yi Lei, Jihua Zhu, Weifeng Zhao |
| 2023 | Magnitude-and-Phase-Aware Speech Enhancement With Parallel Sequence Modeling. | Yuewei Zhang, Huanbin Zou, Jie Zhu |
| 2023 | Vsanet: Real-Time Speech Enhancement Based on Voice Activity Detection and Causal Spatial Attention. | Yuewei Zhang, Huanbin Zou, Jie Zhu |
| 2023 | U2-KWS: Unified Two-Pass Open-Vocabulary Keyword Spotting with Keyword Bias. | Ao Zhang, Pan Zhou, Kaixun Huang, Yong Zou, Ming Liu, Lei Xie |
| 2023 | Neuralkalman: A Learnable Kalman Filter for Acoustic Echo Cancellation. | Yixuan Zhang, Meng Yu, Hao Zhang, Dong Yu, DeLiang Wang |
| 2023 | Deep Learning for Joint Acoustic Echo and Acoustic Howling Suppression in Hybrid Meetings. | Hao Zhang, Meng Yu, Dong Yu |
| 2023 | Exploring Time-Frequency Domain Target Speaker Extraction For Causal and Non-Causal Processing. | Wangyou Zhang, Lei Yang, Yanmin Qian |
| 2023 | An Exploration of Task-Decoupling on Two-Stage Neural Post Filter for Real-Time Personalized Acoustic Echo Cancellation. | Zihan Zhang, Jiayao Sun, Xianjun Xia, Ziqian Wang, Xiaopeng Yan, Yijian Xiao, Lei Xie |
| 2023 | Toward Universal Speech Enhancement For Diverse Input Conditions. | Wangyou Zhang, Kohei Saijo, Zhong-Qiu Wang, Shinji Watanabe, Yanmin Qian |
| 2023 | Consistency Based Unsupervised Self-Training for ASR Personalisation. | Jisi Zhang, Vandana Rajan, Haaris Mehmood, David Tuckey, Pablo Peso Parada, Md Asif Jalal, Karthikeyan Saravanan, Gil Ho Lee, Jungin Lee, Seokyeong Jung |
| 2023 | Promptspeaker: Speaker Generation Based on Text Descriptions. | Yongmao Zhang, Guanghou Liu, Yi Lei, Yunlin Chen, Hao Yin, Lei Xie, Zhifei Li |
| 2023 | Exploring Data Augmentation in Bias Mitigation Against Non-Native-Accented Speech. | Yuanyuan Zhang, Aaricia Herygers, Tanvina Patel, Zhengjun Yue, Odette Scharenborg |
| 2023 | Low-Rank Adaptation of Large Language Model Rescoring for Parameter-Efficient Speech Recognition. | Yu Yu, Chao-Han Huck Yang, Jari Kolehmainen, Prashanth Gurunath Shivakumar, Yile Gu, Sungho Ryu, Roger Ren, Qi Luo, Aditya Gourav, I-Fan Chen, Yi-Chieh Liu, Tuan Dinh, Ankur Gandhe, Denis Filimonov, Shalini Ghosh, Andreas Stolcke, Ariya Rastrow, Ivan Bulyko |
| 2023 | Neuralecho: Hybrid of Full-Band and Sub-Band Recurrent Neural Network For Acoustic Echo Cancellation and Speech Enhancement. | Meng Yu, Yong Xu, Chunlei Zhang, Shi-Xiong Zhang, Dong Yu |