Skip to content

Interspeech (combined EuroSpeech and ICSLP in 2000)

Interspeech

A

CORE rank

CORE rank (raw)

A

Acceptance rate

48.0% (2024)

Fields of research

Artificial Intelligence

Papers indexed

28,540

1987–2025

Papers per year

19871,180 peak2025

Interspeech papers

28,540 records sourced from DBLP. Search titles, filter by year, sort by recency.

YearTitleAuthors
2025Multivariate Probabilistic Assessment of Speech Quality.Fredrik Cumlin, Xinyu Liang, Victor Ungureanu, Chandan K. A. Reddy, Christian Schldt, Saikat Chatterjee
2025Analysis of the ABC Classification Backends for NIST SRE24.Sandro Cumani, Anna Silnova, Sara Barahona, Ladislav Mosner, Oldrich Plchot, Johan Rohdin
2025A Copula-Based Generative Score-Level Fusion Model for Speaker Verification.Sandro Cumani
2025Exploring SSL Discrete Speech Features for Zipformer-based Contextual ASR.Mingyu Cui, Yifan Yang, Jiajun Deng, Jiawen Kang, Shujie Hu, Tianzi Wang, Zhaoqing Li, Shiliang Zhang, Xie Chen, Xunying Liu
2025A Siamese Network-Based Framework for Voice Mimicry Proficiency Assessment Using X-Vector Embeddings.Bhasi K. C., Rajeev Rajan
2025Spatio-Spectral Diarization of Meetings by Combining TDOA-based Segmentation and Speaker Embedding-based Clustering.Tobias Cord-Landwehr, Tobias Gburrek, Marc Deegen, Reinhold Haeb-Umbach
2025Unmasking real-world audio deepfakes: A data-centric approach.David Combei, Adriana Stan, Dan Oneata, Nicolas M. Mller, Horia Cucu
2025Discovering Directions of Uncertainty in Speech Inpainting.Kfir Cohen, Lior Wolf, Bracha Laufer-Goldshtein
2025Listen through the Sound: Generative Speech Restoration Leveraging Acoustic Context Representation.Soo-Whan Chung, Min-Seok Choi
2025Tonal Variation and Word Meaning in Taiwanese.Yu-Ying Chuang, Sheng-Fu Wang
2025A semi-automatic pipeline for transcribing and segmenting child speech.Polychronia Christodoulidou, James Tanner, Jane Stuart-Smith, Michael McAuliffe, Mridhula Murali, Amy Smith, Lauren Taylor, Joanne Cleland, Anja Kuschmann
2025Can We Trust Machine Learning? The Reliability of Features from Open-Source Speech Analysis Tools for Speech Modeling.Tahiya Chowdhury, Vernica Romero
2025ZSDEVC: Zero-Shot Diffusion-based Emotional Voice Conversion with Disentangled Mechanism.Hsing-Hang Chou, Yun-Shao Lin, Ching-Chin Sung, Yu Tsao, Chi-Chun Lee
2025EmoSphere-SER: Enhancing Speech Emotion Recognition Through Spherical Representation with Auxiliary Classification.Deok-Hyeon Cho, Hyung-Seok Oh, Seung-Bin Kim, Seong-Whan Lee
2025DiEmo-TTS: Disentangled Emotion Representations via Self-Supervised Distillation for Cross-Speaker Emotion Transfer in Text-to-Speech.Deok-Hyeon Cho, Hyung-Seok Oh, Seung-Bin Kim, Seong-Whan Lee
2025Unleashing the Inner Monster: Demonstrating High-Fidelity Human to Non-Human Voice Conversion.Namhyun Cho, Sunmin Kim, Minsu Kang, Seolhee Lee, Choonghyeon Lee, Yangsun Lee
2025On-device Streaming Discrete Speech Units.Kwanghee Choi, Masao Someki, Emma Strubell, Shinji Watanabe
2025Comparative Evaluation of Acoustic Feature Extraction Tools for Clinical Speech Analysis.Anna Seo Gyeong Choi, Alexander Richardson, Ryan Partlan, Sunny X. Tang, Sunghye Cho
2025Accelerating Diffusion-based Text-to-Speech Model Trainingwith Dual Modality Alignment.Jeongsoo Choi, Zhikang Niu, Ji-Hoon Kim, Chunhui Wang, Joon Son Chung, Xie Chen
2025Enhancing Retrieval-Augmented Audio Captioning with Generation-Assisted Multimodal Querying and Progressive Learning.Changin Choi, Sungjun Lim, Wonjong Rhee
2025Neural Spectral Band Generation for Audio Coding.Woongjib Choi, Byeong Hyeon Kim, Hyungseob Lim, Inseon Jang, Hong-Goo Kang
2025Bidirectional Spoken-Written Text Conversion with Large Language Models.Muyeol Choi, HyunJung Choi, Yohan Lim, Jeong-Uk Bang, Minkyu Lee, Seon Hui Kim, Seung Yun, Donghyun Kim, Minsoo Kim, Sanghun Kim
2025Temp4Cap: Temporally-aligned Automated Audio Captioning.Ho-Young Choi, Jae-Heung Cho, Pil Moo Byun, Won-Gook Choi, Joon-Hyuk Chang
2025VibE-SVC: Vibrato Extraction with High-frequency F0 Contour for Singing Voice Conversion.Joon-Seung Choi, Dong-Min Byun, Hyung-Seok Oh, Seong-Whan Lee
2025Modality-Agnostic Multimodal Emotion Recognition using a Contrastive Masked Autoencoder.Georgios Chochlakis, Turab Iqbal, Woo Hyun Kang, Zhaocheng Huang
1,0011,025 of 28,540← PreviousNext →

Comparable venues

Other A*/A conferences filed under the same field of research.