| 2025 | Parkinson's Disease Detection Using Wavelet Packet Absolute Amplitude Deviation (WPAAD) from voice signals. | Pandit Vivek Kumar Pandey, Sitanshu Sekhar Sahu, Biswajit Karan, Juan Rafael Orozco-Arroyave |
| 2025 | Class-Incremental Learning for Sound Event Localization and Detection. | Ruchi Pandey, Manjunath Mulimani, Archontis Politis, Annamaria Mesaros |
| 2025 | Ultra low-compute complex spectral masking for multichannel speech enhancement. | Ashutosh Pandey, Juan Azcarreta |
| 2025 | SINET: Sparsity-driven Interpretable Neural Network for Underwater Image Enhancement. | Gargi Panda, Soumitra Kundu, Saumik Bhattacharya, Aurobinda Routray |
| 2025 | FAWL: Weakly-Supervised Video Corpus Moment Retrieval with Frame-Wise Auxiliary Alignment and Weighted Contrastive Learning. | Yi Pan, Yujia Zhang, Xiaoguang Zhao |
| 2025 | A Robust Online Miscalibration Detection and Correction Method for LiDAR-Camera. | Feng Pan, Wei Wang, Jianing Zhang |
| 2025 | RefCap: Zero-shot Video Corpus Moment Retrieval Based on Refined Dense Video Captioning. | Yi Pan, Yujia Zhang, Michael Kampffmeyer, Xiaoguang Zhao |
| 2025 | Enhancing Multi-Channel Speech with Limited Microphones via Spherical Harmonic Transform. | Jiahui Pan, Hui Zhang, Xueliang Zhang |
| 2025 | Stream-TTS: A Low-Latency Text-to-Speech using Kolmogorov-Arnold Networks for Streaming Speech Applications. | Giridhar Pamisetty, Riya Ann Easow, Kaustubh Gupta, K. Sri Rama Murty |
| 2025 | A Unified Joint Contrastive Triplet Loss with Temporal and Frequency Signal Fusion for Diagnosing Heart Murmurs. | Ayushi Pal, Arka Roy, Udit Satija |
| 2025 | Label Dependency Aware Loss for Reliable Multi-Label Medical Image Classification. | Aditya Shankar Pal, Arkapal Panda, Utpal Garain |
| 2025 | Graph-based Signal Sampling with Adaptive Subspace Reconstruction for Spatially-irregular Sensor Data. | Darukeesan Pakiyarajah, Eduardo Pavez, Antonio Ortega |
| 2025 | ATGnet: Adaptive Temporal Graph Network for EEG-enabled Sound Source Tracking in Cocktail Party Scenarios. | Saurav Pahuja, Gabriel Ivucic, Siqi Cai, Dashanka De Silva, Tanja Schultz, Haizhou Li |
| 2025 | A GNSS-IR Aided Multispectral Satellite Data Fusion for Meter-Level Wide-Area Volumetric Soil Moisture Estimation. | Nicols Padrn, Sergiy A. Vorobyov |
| 2025 | Hyper-Refinement for Low-Rank Adaptation. | Savas zkan, Taha Ceritli, Jeongwon Min, Eunchung Noh, Jung Min Cho, Dookun Park, Mete Ozay |
| 2025 | A Study of Improving The Privacy-Utility Trade-off of Task-specific Models with Learnable Privacy. | Savas zkan, Taha Ceritli, Jeongwon Min, Eunchung Noh, Jung Min Cho, Dookun Park, Mete Ozay |
| 2025 | MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models. | Zhihao Ouyang, Ju-Chiang Wang, Daiyu Zhang, Bin Chen, Shangjie Li, Quan Lin |
| 2025 | Lead Instrument Detection from Multitrack Music. | Longshen Ou, Yu Takahashi, Ye Wang |
| 2025 | Adaptive Compression of Supervised and Self-Supervised Models for Green Speech Recognition. | Mouaad Oujabour, Leila Ben Letaifa, Jean-Franois Dollinger, Jean-Luc Rouas |
| 2025 | Enhancing Multivariate Time Series Forecasting with Multi-scale Moving Transformation. | Wenjie Ou, Hongmin Du, Wenqiang Zhao, Dongyue Guo, Yi Lin |
| 2025 | Enhancing Large Language Model Inference Efficiency via Lookahead Cache Filtering. | Jie Ou, Yueming Chen, Shuaihong Jiang, Wenhong Tian |
| 2025 | Codar: Complex-valued Neural Network for Crossing-Floor Intrusion Detection via WiFi. | Weiting Ou, Yipeng Liu, Zhijie Sun, Bing Li, Le Zhang, Ce Zhu |
| 2025 | Investigating F0 Estimation in Speech Synthesis from Real-time MRI Articulatory Data. | Yuto Otani, Shun Sawada, Hidefumi Ohmura, Kouichi Katsurada |
| 2025 | Code Drift: Towards Idempotent Neural Audio Codecs. | Patrick O'Reilly, Prem Seetharaman, Jiaqu Su, Zeyu Jin, Bryan Pardo |
| 2025 | LIMMITS'25: Multilingual Streaming TTS With Neural Codecs for Indian Languages. | Philipp Olbrich, Hema A. Murthy, Pranaw Kumar, Shinji Watanabe, Sheng Zhao, Mark Hasegawa-Johnson |