| 2025 | Towards Inclusive and Fair ASR: Insights from the SAPC Challenge for Optimizing Disordered Speech Recognition. | Nada Gohider, Otman Basir |
| 2025 | Leveraging AM and FM Rhythm Spectrograms for Dementia Classification and Assessment. | Parismita Gogoi, Vishwanath Pratap Singh, Seema Khadirnaikar, Soma Siddhartha, Sishir Kalita, Jagabandhu Mishra, Md. Sahidullah, Priyankoo Sarmah, S. R. M. Prasanna |
| 2025 | Tone recognition in low-resource languages of North-East India: peeling the layers of SSL-based speech models. | Parismita Gogoi, Sishir Kalita, Wendy Lalhminghlui, Viyazonuo Terhiija, Moakala Tzudir, Priyankoo Sarmah, S. R. M. Prasanna |
| 2025 | Towards Personalised Audio Visual Speech Enhancement. | Mandar Gogate, Kia Dashtipour, Amir Hussain |
| 2025 | Few-Shot Speech Deepfake Detection Adaptation with Gaussian Processes. | Neta Glazer, David Chernin, Idan Achituve, Sharon Gannot, Ethan Fetaya |
| 2025 | Evaluating Speech Enhancement Performance Across Demographics and Language. | Jos Giraldo, Alex Peir Lilja, Carme Armentano-Oller, Rodolfo Zevallos, Cristina Espaa-Bonet |
| 2025 | On the Relevance of Clinical Assessment Tasks for the Automatic Detection of Parkinson's Disease Medication State from Speech. | David Gimeno-Gmez, Rubn Solera-Urea, Anna Pompili, Carlos D. Martnez-Hinarejos, Rita Cardoso, Isabel Guimares, Joaquim J. Ferreira, Alberto Abad |
| 2025 | Exploring auditory feedback mechanisms in speech recognition. | Louise Coppieters de Gibson, Philip N. Garner |
| 2025 | StutterCut: Uncertainty-Guided Normalised Cut for Dysfluency Segmentation. | Suhita Ghosh, Mlanie Jouaiti, Jan-Ole Perschewski, Sebastian Stober |
| 2025 | Is your model big enough? Training and interpreting large-scale monolingual speech foundation models. | Yaroslav Getman, Tams Grsz, Tommi Lehtonen, Mikko Kurimo |
| 2025 | A Perception-Based L2 Speech Intelligibility Indicator: Leveraging a Rater's Shadowing and Sequence-to-sequence Voice Conversion. | Haopeng Geng, Daisuke Saito, Nobuaki Minematsu |
| 2025 | Evaluating Speech Foundation Models for Automatic Speech Recognition in the Low-Resource Kanyen'kha Language. | Mengzhe Geng, Patrick Littell, Aidan Pine, Robbie Jimerson, Gilles Boulianne, Vishwa Gupta, Rolando Coto-Solano, Anna Kazantseva, Marc Tessier, Delaney Lothian, Akwiratkha' Martin, Eric Joanis, Samuel Larkin, Roland Kuhn |
| 2025 | EEG-based Voice Conversion : Hearing the Voice of Your Brain. | Yizhong Geng, Wenxin Fu, Qihang Lu, Bingsong Bai, Cong Wang, Yingming Gao, Ya Li |
| 2025 | Grammatical Error Detection on Spontaneous Children's Speech Using Iterative Pseudo Labeling. | Christopher Gebauer, Lars Rumberg, Lars Khn, Hanna Ehlert, Edith Beaulac, Jrn Ostermann |
| 2025 | You Are What You Say: Exploiting Linguistic Content for VoicePrivacy Attacks. | nal Ege Gaznepoglu, Anna Leschanowsky, Ahmad Aloradi, Prachi Singh, Daniel Tenbrinck, Emanul A. P. Habets, Nils Peters |
| 2025 | Speech stimulus design to study the neural coding of speech and the impact of cochlear synaptopathy. | Etienne Gaudrain, Sarah Verhulst, Deniz Baskent |
| 2025 | A Multimodal Chinese Dataset for Cross-lingual Sarcasm Detection. | Xiyuan Gao, Bruce Xiao Wang, Meiling Zhang, Shuming Huang, Zhu Li, Shekhar Nayak, Matt Coler |
| 2025 | The Multimodal Information Based Speech Processing (MISP) 2025 Challenge: Audio-Visual Diarization and Recognition. | Ming Gao, Shilong Wu, Hang Chen, Jun Du, Chin-Hui Lee, Shinji Watanabe, Jingdong Chen, Sabato Marco Siniscalchi, Odette Scharenborg |
| 2025 | Improving Child Speech Recognition and Reading Mistake Detection by Using Prompts. | Lingyun Gao, Cristian Tejedor Garca, Catia Cucchiarini, Helmer Strik |
| 2025 | Leveraging Large Language Models for Spontaneous Speech-Based Suicide Risk Detection. | Yifan Gao, Jiao Fu, Long Guo, Hong Liu |
| 2025 | ADCeleb: A Longitudinal Speech Dataset from Public Figures for Early Detection of Alzheimer's Disease. | Kunxiao Gao, Anna Favaro, Najim Dehak, Laureano Moro-Velzquez |
| 2025 | Differentiable Reward Optimization for LLM based TTS system. | Changfeng Gao, Zhihao Du, Shiliang Zhang |
| 2025 | TSDT-Net: Ultra-Low-Complexity Two-Stage Model Combining Dual-Path-Transformer and Transform-Average-Concatenate Network for Speech Enhancement. | Yi Gao, Hangting Chen, Siyu Zhang, Qingshan Yang, Jingcong Chen |
| 2025 | Synonymity-Based Semantic Coding for Efficient Speech Compression. | Shanhui Gan, Zijian Liang, Kai Niu, Ping Zhang |
| 2025 | IDIR: Identifying and Distilling Informative Relations for Speaker Verification. | Chong-Xin Gan, Zhe Li, Zezhong Jin, Zilong Huang, Man-Wai Mak, Kong Aik Lee |