| 2025 | The Conformer Encoder May Reverse the Time Dimension. | Robin Schmitt, Albert Zeyer, Mohammad Zeineldeen, Ralf Schlter, Hermann Ney |
| 2025 | Concentrating Harder for Faster Audio Transformer. | Lorenz P. Schmidt, Nils Peters |
| 2025 | Effective Pre-Training of Audio Transformers for Sound Event Detection. | Florian Schmid, Tobias Morocutti, Francesco Foscarin, Jan Schlter, Paul Primus, Gerhard Widmer |
| 2025 | FDR Control for Complex-Valued Data with Application in Single Snapshot Multi-Source Detection and DOA Estimation. | Fabian Scheidt, Jasin Machkour, Michael Muma |
| 2025 | Optimal One-hot Logistic Regression for Tree-based Distribution Classification. | Baptiste Schall, Rodolphe Anty, Lionel Fillatre |
| 2025 | Generating Apoptosis-Inducing Anticancer Peptides Targeting BCL-xL Using Latent Diffusion Models on Small Datasets. | Tiara Natasha Binte Sayuti, Conghao Wang, Jagath C. Rajapakse |
| 2025 | APLASE: Compression using Adaptive Piecewise Linear Approximation and Sparse Encoding. | Ravi Raj Saxena, Prabhakar T. V, Joy Kuri, Chandra R. Murthy |
| 2025 | Towards Adversarial Robustness And Backdoor Mitigation in SSL. | Aryan Satpathy, Nilaksh Nilaksh, Dhruva Abhijit Rajwade, Somesh Kumar |
| 2025 | Sound Source Distance Estimation Utilizing Physics-informed Prior for Sound Event Localization and Detection. | Nao Sato, Masahiro Yasuda, Shoichiro Saito, Noboru Harada |
| 2025 | Comparing Self-Supervised Learning Models Pre-Trained on Human Speech and Animal Vocalizations for Bioacoustics Processing. | Eklavya Sarkar, Mathew Magimai-Doss |
| 2025 | FLAMO: An Open-Source Library for Frequency-Domain Differentiable Audio Processing. | Gloria Dal Santo, Gian Marco De Bortoli, Karolina Prawda, Sebastian J. Schlecht, Vesa Vlimki |
| 2025 | Cued Speech Generation Leveraging a Pre-trained Audiovisual Text-to-Speech Model. | Sanjana Sankar, Martin Lenglet, Grard Bailly, Denis Beautemps, Thomas Hueber |
| 2025 | Agnostic Automatic Melodic Accompaniment for Alapana in Carnatic Music. | Raghavasimhan Sankaranarayanan, Gil Weinberg |
| 2025 | Gamaka Synthesis for Kalpitha Swaras in Carnatic Music. | Raghavasimhan Sankaranarayanan, Larry Heck, Gil Weinberg |
| 2025 | Towards HRTF Personalization using Denoising Diffusion Models. | Juan Camilo Albarracn Snchez, Luca Comanducci, Mirco Pezzoli, Fabio Antonacci |
| 2025 | Efficient Finetuning for Dimensional Speech Emotion Recognition in the Age of Transformers. | Aneesha Sampath, James Tavernor, Emily Mower Provost |
| 2025 | Variance-Covariance Regularization for Improved End-to-End Diarization. | Lahiru Samarakoon, Samuel J. Broughton, Ivan Fung |
| 2025 | Freeze and Learn: Continual Learning with Selective Freezing for Speech Deepfake Detection. | Davide Salvi, Viola Negroni, Luca Bondi, Paolo Bestagini, Stefano Tubaro |
| 2025 | Raw Audio Deep Learning Filter Banks for Acoustic Scene Classification. | Daniele Salvati |
| 2025 | Harnessing the Potential of Omnidirectional UAVs in RIS-Enabled Wireless Networks. | Abdoul Karim A. H. Saliah, Hajar El Hammouti, Daniel Bonilla Licea |
| 2025 | AUIED3K: A New Andaman Underwater Image Enhancement Dataset for Deep Learning-Driven Image Enhancement with Minimum Loss Dehazing. | Praveen Saini, Navjot Singh, Anshu S. Anand |
| 2025 | HARP: A Large-Scale Higher-Order Ambisonic Room Impulse Response Dataset. | Shivam Saini, Jrgen Peissig |
| 2025 | Task-Aware Unified Source Separation. | Kohei Saijo, Janek Ebbers, Franois G. Germain, Gordon Wichern, Jonathan Le Roux |
| 2025 | Leveraging Audio-Only Data for Text-Queried Target Sound Extraction. | Kohei Saijo, Janek Ebbers, Franois G. Germain, Sameer Khurana, Gordon Wichern, Jonathan Le Roux |
| 2025 | Maximizing Connectivity of RIS-Assisted UAV-D2D Networks using Semidefinite Programming. | Mohammed Saif, Mohammad Javad-Kalbasi, Shahrokh Valaee |