Skip to content

Interspeech (combined EuroSpeech and ICSLP in 2000)

Interspeech

A

CORE rank

CORE rank (raw)

A

Acceptance rate

48.0% (2024)

Fields of research

Artificial Intelligence

Papers indexed

28,540

1987–2025

Papers per year

19871,180 peak2025

Interspeech papers

28,540 records sourced from DBLP. Search titles, filter by year, sort by recency.

YearTitleAuthors
2025Multimodal Dynamics of Hand Gestures and Pauses in Multiparty Interactions.Delphine Charuau, Naomi Harte
2025A-SMiLE: Affective Sparse Mixture-of-Experts Adapter with Multi-Task Learning for Spoken Dialogue Models.Yi-Wen Chao, Yizhou Peng, Dianwen Ng, Yukun Ma, Chongjia Ni, Bin Ma, Eng Siong Chng
2025Universal Speech Enhancement with Regression and Generative Mamba.Rong Chao, Rauf Nasretdinov, Yu-Chiang Frank Wang, Ante Jukic, Szu-Wei Fu, Yu Tsao
2025Relative cue weighting in multilingual stop voicing production.Le Xuan Chan, Annika Heuser
2025Multimodal Fusion with Semi-Supervised Learning Minimizes Annotation Quantity for Modeling Videoconference Conversation Experience.Andrew Chang, Chenkai Hu, Ji Qi, Zhuojian Wei, Kexin Zhang, Viswadruth Akkaraju, David Poeppel, Dustin Freeman
2025DC-Spin: A Speaker-invariant Speech Tokenizer for Spoken Language Models.Heng-Jui Chang, Hongyu Gong, Changhan Wang, James R. Glass, Yu-An Chung
2025Beyond Attacks: Advancing Fake Speech Detection with Attack-Agnostic Methods.Shilpa Chandra, Akansha Tyagi, Shiven Patel, Padmanabhan Rajan
2025EmotionRankCLAP: Bridging Natural Language Speaking Styles and Ordinal Speech Emotion via Rank-N-Contrast.Shreeram Suresh Chandra, Lucas Goncalves, Junchen Lu, Carlos Busso, Berrak Sisman
2025Song Form-aware Full-Song Text-to-Lyrics Generation with Multi-Level Granularity Syllable Count Control.Yunkee Chae, Eunsik Shin, Suntae Hwang, Seungryeol Paik, Kyogu Lee
2025Towards Bitrate-Efficient and Noise-Robust Speech Coding with Variable Bitrate RVQ.Yunkee Chae, Kyogu Lee
2025"Dyadosyncrasy", Idiosyncrasy and Demographic Factors in Turn-Taking.Julio Cesar Cavalcanti, Gabriel Skantze
2025NanoCodec: Towards High-Quality Ultra Fast Speech LLM Inference.Edresson Casanova, Paarth Neekhara, Ryan Langman, Shehzeen Hussain, Subhankar Ghosh, Xuesong Yang, Ante Jukic, Jason Li, Boris Ginsburg
2025Exploring Linear Variant Transformers and k-NN Memory Inference for Long-Form ASR.Carlos Carvalho, Jinchuan Tian, William Chen, Yifan Peng, Alberto Abad, Shinji Watanabe
2025SardinianVoxes: A Speech Recognition Dataset for the Sardinian Languages.Salvatore Carta, Alessandro Giuliani, Marco Manolo Manca, Mirko Marras, Leonardo Piano
2025Better Semi-supervised Learning for Multi-domain ASR Through Incremental Retraining and Data Filtering.Andrs Carofilis, Pradeep Rangappa, Srikanth R. Madikeri, Shashi Kumar, Sergio Burdisso, Jeena J. Prakash, Esa Villatoro-Tello, Petr Motlcek, Bidisha Sharma, Kadri Hacioglu, Shankar Venkatesan, Saurabh Vyas, Andreas Stolcke
2025Scaling and Enhancing LLM-based AVSR: A Sparse Mixture of Projectors Approach.Umberto Cappellazzo, Minsu Kim, Stavros Petridis, Daniele Falavigna, Alessio Brutti
2025Pitch Target Realization in Putonghua Tone Production of Children from Dialect-Speaking Regions.Mengxue Cao, Tianxin Zheng, Jiewen Zheng
2025ASR-based segmentation for the analysis of larger child-speech datasets: Performance evaluation on vowels from Australian-English speaking children aged 4 to 11 years.Rui Cai, Titia Benders
2025Voice-ENHANCE: Speech Restoration using a Diffusion-based Voice Conversion Framework.Kyungguen Byun, Jason Filos, Erik Visser, Sunkuk Moon
2025EmoDB 2.0: A Database of Emotional Speech in a World that is not Black or White but Grey.Felix Burkhardt, Oliver Schrfer, Uwe D. Reichel, Hagen Wierstorf, Anna Derington, Florian Eyben, Bjrn W. Schuller
2025Evaluating Parameter Sharing for Spoofing-Aware Speaker Verification: A Case Study on the ASVspoof 5 Dataset.Aykut Bker, Oguzhan Kurnaz, Sule Bekiryazici, Selim Can Demirtas, Cemal Hanili
2025Equivalence and differences: Formant patterns of labialization and pharyngealization in Tashlhiyt.Philipp Buech, Anne Hermes, Rachid Ridouane
2025Pushing the Limits of End-to-End Diarization.Samuel J. Broughton, Lahiru Samarakoon
2025Agent-based modelling, sound change, and metaphony in Southern Italian varieties of Italo-Romance.Lilian von Bressensdorf, Pia Greca, Jonathan Harrington
2025Pitfalls and Limits in Automatic Dementia Assessment.Franziska Braun, Christopher Witzl, Andreas Erzigkeit, Hartmut Lehfeld, Thomas Hillemacher, Tobias Bocklet, Korbinian Riedhammer
1,0511,075 of 28,540← PreviousNext →

Comparable venues

Other A*/A conferences filed under the same field of research.