| 2025 | Multivariate Probabilistic Assessment of Speech Quality. | Fredrik Cumlin, Xinyu Liang, Victor Ungureanu, Chandan K. A. Reddy, Christian Schldt, Saikat Chatterjee |
| 2025 | Analysis of the ABC Classification Backends for NIST SRE24. | Sandro Cumani, Anna Silnova, Sara Barahona, Ladislav Mosner, Oldrich Plchot, Johan Rohdin |
| 2025 | A Copula-Based Generative Score-Level Fusion Model for Speaker Verification. | Sandro Cumani |
| 2025 | Exploring SSL Discrete Speech Features for Zipformer-based Contextual ASR. | Mingyu Cui, Yifan Yang, Jiajun Deng, Jiawen Kang, Shujie Hu, Tianzi Wang, Zhaoqing Li, Shiliang Zhang, Xie Chen, Xunying Liu |
| 2025 | A Siamese Network-Based Framework for Voice Mimicry Proficiency Assessment Using X-Vector Embeddings. | Bhasi K. C., Rajeev Rajan |
| 2025 | Spatio-Spectral Diarization of Meetings by Combining TDOA-based Segmentation and Speaker Embedding-based Clustering. | Tobias Cord-Landwehr, Tobias Gburrek, Marc Deegen, Reinhold Haeb-Umbach |
| 2025 | Unmasking real-world audio deepfakes: A data-centric approach. | David Combei, Adriana Stan, Dan Oneata, Nicolas M. Mller, Horia Cucu |
| 2025 | Discovering Directions of Uncertainty in Speech Inpainting. | Kfir Cohen, Lior Wolf, Bracha Laufer-Goldshtein |
| 2025 | Listen through the Sound: Generative Speech Restoration Leveraging Acoustic Context Representation. | Soo-Whan Chung, Min-Seok Choi |
| 2025 | Tonal Variation and Word Meaning in Taiwanese. | Yu-Ying Chuang, Sheng-Fu Wang |
| 2025 | A semi-automatic pipeline for transcribing and segmenting child speech. | Polychronia Christodoulidou, James Tanner, Jane Stuart-Smith, Michael McAuliffe, Mridhula Murali, Amy Smith, Lauren Taylor, Joanne Cleland, Anja Kuschmann |
| 2025 | Can We Trust Machine Learning? The Reliability of Features from Open-Source Speech Analysis Tools for Speech Modeling. | Tahiya Chowdhury, Vernica Romero |
| 2025 | ZSDEVC: Zero-Shot Diffusion-based Emotional Voice Conversion with Disentangled Mechanism. | Hsing-Hang Chou, Yun-Shao Lin, Ching-Chin Sung, Yu Tsao, Chi-Chun Lee |
| 2025 | EmoSphere-SER: Enhancing Speech Emotion Recognition Through Spherical Representation with Auxiliary Classification. | Deok-Hyeon Cho, Hyung-Seok Oh, Seung-Bin Kim, Seong-Whan Lee |
| 2025 | DiEmo-TTS: Disentangled Emotion Representations via Self-Supervised Distillation for Cross-Speaker Emotion Transfer in Text-to-Speech. | Deok-Hyeon Cho, Hyung-Seok Oh, Seung-Bin Kim, Seong-Whan Lee |
| 2025 | Unleashing the Inner Monster: Demonstrating High-Fidelity Human to Non-Human Voice Conversion. | Namhyun Cho, Sunmin Kim, Minsu Kang, Seolhee Lee, Choonghyeon Lee, Yangsun Lee |
| 2025 | On-device Streaming Discrete Speech Units. | Kwanghee Choi, Masao Someki, Emma Strubell, Shinji Watanabe |
| 2025 | Comparative Evaluation of Acoustic Feature Extraction Tools for Clinical Speech Analysis. | Anna Seo Gyeong Choi, Alexander Richardson, Ryan Partlan, Sunny X. Tang, Sunghye Cho |
| 2025 | Accelerating Diffusion-based Text-to-Speech Model Trainingwith Dual Modality Alignment. | Jeongsoo Choi, Zhikang Niu, Ji-Hoon Kim, Chunhui Wang, Joon Son Chung, Xie Chen |
| 2025 | Enhancing Retrieval-Augmented Audio Captioning with Generation-Assisted Multimodal Querying and Progressive Learning. | Changin Choi, Sungjun Lim, Wonjong Rhee |
| 2025 | Neural Spectral Band Generation for Audio Coding. | Woongjib Choi, Byeong Hyeon Kim, Hyungseob Lim, Inseon Jang, Hong-Goo Kang |
| 2025 | Bidirectional Spoken-Written Text Conversion with Large Language Models. | Muyeol Choi, HyunJung Choi, Yohan Lim, Jeong-Uk Bang, Minkyu Lee, Seon Hui Kim, Seung Yun, Donghyun Kim, Minsoo Kim, Sanghun Kim |
| 2025 | Temp4Cap: Temporally-aligned Automated Audio Captioning. | Ho-Young Choi, Jae-Heung Cho, Pil Moo Byun, Won-Gook Choi, Joon-Hyuk Chang |
| 2025 | VibE-SVC: Vibrato Extraction with High-frequency F0 Contour for Singing Voice Conversion. | Joon-Seung Choi, Dong-Min Byun, Hyung-Seok Oh, Seong-Whan Lee |
| 2025 | Modality-Agnostic Multimodal Emotion Recognition using a Contrastive Masked Autoencoder. | Georgios Chochlakis, Turab Iqbal, Woo Hyun Kang, Zhaocheng Huang |