| 2025 | Precisely Controllable Neural Speech Synthesis. | Paul Konstantin Krug, Christoph Wagner, Peter Birkholz, Timo Stich |
| 2025 | Keypoint Aware Masked Image Modelling. | Madhava Krishna, A. V. Subramanyam |
| 2025 | Graph Signal Reconstruction via Koopman Autoencoder. | Sivaram Krishnan, Jihong Park, Jinho Choi |
| 2025 | 3D Gaussian Splatting with Normal Information for Mesh Extraction and Improved Rendering. | Meenakshi Krishnan, Liam Fowl, Ramani Duraiswami |
| 2025 | Closing the Loop on Speech to Music Translation: Automatically Generating Synthetic Percussive Sequences on the Mridangam from Konnakol. | Gopika Krishnan, Julia Drabek, Akshay Anantapadmanabhan, Kaustuv Kanti Ganguli, Carlos Guedes |
| 2025 | Investigating Temporal Convolutional Networks for Automated Stroke Transcription in the Mridangam. | Gopika Krishnan, Akshay Anantapadmanabhan, Kaustuv Kanti Ganguli, Carlos Guedes |
| 2025 | Explainable Reinforcement Learning for Trajectory Design in UAV-assisted Wireless Networks. | Ali Krayani, Khalid Khan, Lucio Marcenaro, Carlo S. Regazzoni |
| 2025 | Past, Present, and Future of Spatial Audio and Room Acoustics. | Shoichi Koyama, Enzo De Sena, Prasanga N. Samarasinghe, Mark R. P. Thomas, Fabio Antonacci |
| 2025 | Resource-Efficient and Noise-Robust Modality Fusion for Audio-Visual Speech Recognition. | Alexandros Koumparoulis, Gerasimos Potamianos |
| 2025 | voc2vec: A Foundation Model for Non-Verbal Vocalization. | Alkis Koudounas, Moreno La Quatra, Sabato Marco Siniscalchi, Elena Baralis |
| 2025 | Cross-lingual Evaluation Of Hypernasality Using Wav2Vec2 Features. | Krupaben Kothadia, Vikram C. M., Ajish K. Abraham, Pushpavathi M, S. R. Mahadeva Prasanna, Nancy Scherer, Kathy Chapman, Julie Liss, Visar Berisha |
| 2025 | Node Selection for Physical Layer Security Using Graph-Based Vertex-Frequency Representation. | Venugopalachary Kotha, Vijay Kumar Chakka, Shaik Basheeruddin Shah, Nazar T. Ali |
| 2025 | Modifying Flow Matching for Generative Speech Enhancement. | Roman Korostik, Rauf Nasretdinov, Ante Jukic |
| 2025 | A Notation Dataset for Indian Raga Music. | Soham Korade, Suswara Pochampally |
| 2025 | Robust Kernel Sparse Subspace Clustering. | Ivica Kopriva |
| 2025 | Overcoming Uncertain Incompleteness for Robust Multimodal Sequential Diagnosis Prediction via Curriculum Data Erasing Guided Knowledge Distillation. | Heejoon Koo |
| 2025 | Efficient Dataset Distillation through Low-Rank Space Sampling. | Hangyang Kong, Wenbo Zhou, Xuxiang He, Xiaotong Tu, Xinghao Ding |
| 2025 | GATOmics: A Novel Multi-Omics Graph Attention Network Model for Cancer Driver Gene Detection. | Ge Kong, Jiao Wang, Juan Wang |
| 2025 | S-KEY: Self-supervised Learning of Major and Minor Keys from Audio. | Yuexuan Kong, Gabriel Meseguer-Brocal, Vincent Lostanlen, Mathieu Lagrange, Romain Hennequin |
| 2025 | A Cross-Modal Multi-Attitude Framework for the Generation of Space Target ISAR Images. | Derong Kong, Huaizhang Liao, Jingyuan Xia |
| 2025 | A Weakly Supervised Semantic Segmentation Model with Enhanced CLIP Feature Extraction. | Fanxuan Kong, Jun Lu |
| 2025 | LCE: A Framework for Explainability of Ultrasound Image Based on Concept Discovery. | Weiji Kong, Xun Gong, Juan Wang |
| 2025 | Rethinking Mean Opinion Scores in Speech Quality Assessment: Score Aggregation through Quantized Distribution Fitting. | Yuto Kondo, Hirokazu Kameoka, Kou Tanaka, Takuhiro Kaneko |
| 2025 | Typical vs. Atypical Disfluency Classification: Introducing the IIITH-TISA Corpus and Temporal Context-Based Feature Representations. | Priyanka Kommagouni, Vamshiraghusimha Narasinga, Purva Barche, Sai Akarsh C, Anil Vuppala |
| 2025 | Aligned Contrastive Learning for Text-to-Music Retrieval. | Tatsuya Komatsu, Hokuto Munakata, Takuya Hasumi, Yusuke Fujita |