Skip to content

Interspeech (combined EuroSpeech and ICSLP in 2000)

Interspeech

A

CORE rank

CORE rank (raw)

A

Acceptance rate

48.0% (2024)

Fields of research

Artificial Intelligence

Papers indexed

28,540

1987–2025

Papers per year

19871,180 peak2025

Interspeech papers

28,540 records sourced from DBLP. Search titles, filter by year, sort by recency.

YearTitleAuthors
2025Creaky Voice Facilitates More Efficient Phonological Processing of Mandarin Tone 3.Zixia Fan, Ronny Ibrahim, Joshua Penney, Felicity Cox
2025MMLoRA: Multitask Memory Parameter-Efficient Fine-Tuning for Multimodal SER.Yuanbo Fang, Xiaofen Xing, Xueru Li, Weibin Zhang, Xiangmin Xu
2025Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning.Shi-Xin Fang, Liang-Yeh Shen, Yi-Cheng Lin, Huang-Cheng Chou, Hung-yi Lee
2025Multi-view Fusion and Parameter Perturbation for Few-Shot Class-Incremental Audio Classification.Yulu Fang, Mingyue He, Qisheng Xu, Jianqiao Zhao, Cheng Yang, Kele Xu, Yong Dou
2025Band-Split Self-supervised Mamba for Infant-centered Audio Analysis.Xulin Fan, Jialu Li, Mark Hasegawa-Johnson, Nancy L. McElwain
2025Audio Deepfake Source Tracing using Multi-Attribute Open-Set Identification and Verification.Pierre Falez, Tony Marteau, Damien Lolive, Arnaud Delhay
2025Speech Kinematic Analysis from Acoustics: Scientific, Clinical and Practical Applications.Carol Y. Espy-Wilson
2025Synchronous analysis of abnormal acoustic and linguistic production in Parkinson's speech.Daniel Escobar-Grisales, Cristian David Ros-Urrego, Sabato Marco Siniscalchi, Adolfo M. Garca, Yamile Bocanegra, Leonardo Moreno, Elmar Nth, Juan Rafael Orozco-Arroyave
2025From Words to Waves: Analyzing Concept Formation in Speech and Text-Based Foundation Models.Asim Ersoy, Basel Ahmad Mousi, Shammur Absar Chowdhury, Firoj Alam, Fahim Dalvi, Nadir Durrani
2025ProMode: A Speech Prosody Model Conditioned on Acoustic and Textual Inputs.Eray Eren, Qingju Liu, Hyeongwoo Kim, Pablo Garrido, Abeer Alwan
2025SiamCTC: Learning Speech Representations through Monotonic Temporal Alignment.SooHwan Eom, Mark Hasegawa-Johnson, Chang D. Yoo
2025The NaijaVoices Dataset: Cultivating Large-Scale, High-Quality, Culturally-Rich Speech Data for African Languages.Chris Emezue, NaijaVoices Community, Busayo Awobade, Abraham Toluwase Owodunni, Handel Emezue, Gloria Monica Tobechukwu Emezue, Nefertiti Nneoma Emezue, Sewade Ogun, Bunmi Akinremi, David Ifeoluwa Adelani, Chris Pal
2025Triadic Multi-party Voice Activity Projection for Turn-taking in Spoken Dialogue Systems.Mikey Elmers, Koji Inoue, Divesh Lala, Tatsuya Kawahara
2025ADI-20: Arabic Dialect Identification dataset and models.Haroun Elleuch, Salima Mdhaffar, Yannick Estve, Fethi Bougares
2025PERCEPT-US: A Multimodal American English Child Speech Corpus Specialized for Articulatory Feedback.Amanda Eads, Heather Kabakoff, Nina Benway, Elaine Hitchcock, Jonathan L. Preston, Tara McAllister
2025Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?Bikash Dutta, Rishabh Ranjan, Shyam Sathvik, Mayank Vatsa, Richa Singh
2025ABHINAYA - A System for Speech Emotion Recognition In Naturalistic Conditions Challenge.Soumya Dutta, Smruthi Balaji, Varada R, Viveka Salinamakki, Sriram Ganapathy
2025SDBench: A Comprehensive Benchmark Suite for Speaker Diarization.Berkin Durmus, Blaise Munyampirwa, Eduardo Pacheco, Atila Orhon, Andrey Leonov
2025Functional Connectivity and Hilbert-Based Features for Covert Speech EEG Variability Analysis and Classification.Saravanakumar Duraisamy, Maurice Rekrut, Luis A. Leiva
2025Test-Time Training for Speech-based Depression Detection.Sri Harsha Dumpala, Chandramouli Shama Sastry, Rudolf Uher, Sageev Oore
2025EAA: Emotion-Aware Audio Large Language Models with Dual Cross-Attention and Context-Aware Instruction Tuning.Hongfei Du, Sidi Lu, Gang Zhou, Ye Gao
2025Tonal Contrasts in the Malipo Variety of the Mienic Language.Changhong Du, Fang Hu
2025Robust fine-tuning of speech recognition models via model merging: application to disordered speech.Alexandre Ducorroy, Rachid Riad
2025Hybrid Expert Knowledge and Self-Supervised Learning for Diagnostic Modeling of Adductor Spasmodic and Primary Myotonic Dysphonia.Zhou Du, Hang Chen, Huijun Ding, Jun Du, Zhen Chen
2025Speech transcription from South Tyrolean Dialect to Standard German with Whisper.Luca Ducceschi, Greta H. Franzini
951975 of 28,540← PreviousNext →

Comparable venues

Other A*/A conferences filed under the same field of research.