| 2025 | Distance Based Single-Channel Target Speech Extraction. | Runwu Shi, Benjamin Yen, Kazuhiro Nakadai |
| 2025 | MSA-ITEI: A Novel Method for Multimodal Analysis of Social Media Stickers. | Yuanchen Shi, Fang Kong |
| 2025 | GAN-Based Speech Enhancement for Low SNR Using Latent Feature Conditioning. | Shrishti Saha Shetu, Emanul A. P. Habets, Andreas Brendel |
| 2025 | Enhancing Age-Related Robustness in Children Speaker Verification. | Vishwas M. Shetty, Jiusi Zheng, Steven M. Lulich, Abeer Alwan |
| 2025 | Monte Carlo Score Matching for Image Generation. | Nishanth Shetty, Chandra Sekhar Seelamantula |
| 2025 | Get Large Language Models Ready to Speak: A Late-fusion Approach for Speech Generation. | Maohao Shen, Shun Zhang, Jilong Wu, Zhiping Xiu, Ehab A. AlBadawy, Yiting Lu, Mike Seltzer, Qing He |
| 2025 | Reduced Effectiveness of Kolmogorov-Arnold Networks on Functions with Noise. | Haoran Shen, Chen Zeng, Jiahui Wang, Qiao Wang |
| 2025 | An Underwater Image Quality Dataset with Renewed Pairwise Voting. | Mengjiao Shen, Miao Yang, Hansen Zhang, Jinyang Zhong, Yuquan Qiu, Jinwei Gu |
| 2025 | Exploring Simple Siamese Network for High-Resolution Video Quality Assessment. | Guotao Shen, Ziheng Yan, Xin Jin, Longhai Wu, Jie Chen, Ilhyun Cho, Cheul-Hee Hahm |
| 2025 | MSRFormer: Hybrid Scale Self-Attention and Local Fast Convolution Transformer for Facial Expression Recognition. | Zi-Qiang Shen, Yu-Yi Tang, Jun-Feng Yan, Yang Li, Guo-Ying Zhao |
| 2025 | Rethinking Early-Fusion Strategies for Improved Multimodal Image Segmentation. | Zhengwen Shen, Yulian Li, Han Zhang, Yuchen Weng, Jun Wang |
| 2025 | Diffusion Counterfactual-Based Anomaly Detection in Class-Imbalanced Data. | Xinyun Shen, Min Li, Zhengmao Ye, Zhenyang Yu, Lei Duan |
| 2025 | Spatial-Temporal Reconstruction Error for AIGC-based Forgery Image Detection. | Chengji Shen, Zhenjiang Liu, Kaixuan Chen, Jie Lei, Mingli Song, Zunlei Feng |
| 2025 | Dual-Path Model for Pulmonary Artery Segmentation. | Lu Shen, Yingwen Chen, Changjian Wang, Zhengbo Zhang, Shuyi Zhou |
| 2025 | Hop-level Direct Preference Optimization for Knowledge Graph Reasoning with Trees. | Tiesunlong Shen, Jin Wang, Xuejie Zhang, Erik Cambria |
| 2025 | Semi-Supervised Speaker Diarization Using Graph Transformers and LLMs on Naturalistic Apollo 11 Data. | Meena M. Chandra Shekar, John H. L. Hansen |
| 2025 | Graph Neural Networks for Parkinson's Disease Detection. | Shakeel A. Sheikh, Yacouba Kaloga, Md. Sahidullah, Ina Kodrasi |
| 2025 | Modular Gaussian Splatting: Instance Decomposable Learning and Adaptive Rendering of 3D Scenes via Mixture of Experts. | Jiansong Sha, Haoyu Zhang, Qiangjuan Huang, Guang Kou |
| 2025 | Classifier-Guided Captioning Across Modalities. | Ariel Shaulov, Tal Shaharabany, Eitan Shaar, Gal Chechik, Lior Wolf |
| 2025 | On Decentralized Learning with Stochastic Subspace Descent. | Shivangi Dubey Sharma, Pranay Sharma, Ketan Rajawat |
| 2025 | How Machines Perceive Rooms - Regions of Relevance in Room Impulse Responses. | Prachi Sharma, Christian Kehling |
| 2025 | Deepfake Detection of Singing Voices With Whisper Encodings. | Falguni Sharma, Priyanka Gupta |
| 2025 | A CT-based Prediction System for Determining Respiratory Support Level in COVID-19 Patients. | Ahmed Sharafeldeen, Hossam Magdy Balaha, Ibrahim Shawky Farahat, Mohammed Ghazal, James Connelly, Eric Van Bogaert, Ayman El-Baz |
| 2025 | LLFA: Fusing Global Illumination and Local Priors for Low-Light Face Image Enhancement with Adaptor. | Ziqian Shao, Tao Wang, Kaihao Zhang, Danhuai Zhao, Tong Lu |
| 2025 | DreamHA: Towards High-Quality Human Animation with Image-to-Video Diffusion Models. | Longran Shao, Bonan Li, Congying Han, Wenzhao Liu, Tiande Guo, Tianchi Xing, Xinmin Qiu, Zicheng Zhang |