| 2025 | Efficient Long-Form Speech Recognition for General Speech In-Context Learning. | Hao Yen, Shaoshi Ling, Guoli Ye |
| 2025 | Mining Scene Structural Guidance for Thermal Images in Self-Supervised Monocular Depth Estimation. | Xinchen Ye, Xia Mao, Rui Xu, Haojie Li |
| 2025 | Leveraging Registers in Vision Transformers for Robust Adaptation. | Srikar Yellapragada, Kowshik Thopalli, Vivek Sivaraman Narayanaswamy, Wesam A. Sakla, Yang Liu, Yamen Mubarka, Dimitris Samaras, Jayaraman J. Thiagarajan |
| 2025 | DDSP Guitar Amp: Interpretable Guitar Amplifier Modeling. | Yen-Tung Yeh, Yu-Hua Chen, Yuan-Chiao Cheng, Jui-Te Wu, Jun-Jie Fu, Yi-Fan Yeh, Yi-Hsuan Yang |
| 2025 | A Dual-Stream Network with Non-Stationary Characteristics-Enhanced for SST Image Prediction. | Min Ye, Jiahao Du, Ning Song, Xinyue Liang, Bohan Li, Jie Nie |
| 2025 | HFE-RWKV: High-Frequency Enhanced RWKV Model for Efficient Left Ventricle Segmentation in Pediatric Echocardiograms. | Zi Ye, Tianxiang Chen, Ziyang Wang, Hanwei Zhang, Lijun Zhang |
| 2025 | Generalization Guarantee of Decentralized Learning with Heterogeneous Data. | Haoxiang Ye, Tao Sun, Qing Ling |
| 2025 | Multi-View Radar Detection Transformer with Differentiable Positional Encoding. | Ryoma Yataka, Pu Perry Wang, Petros Boufounos, Ryuhei Takahashi |
| 2025 | Spatial Annotation-free Training for Sound Event Localization and Detection. | Masahiro Yasuda, Shoichiro Saito, Nao Sato, Noboru Harada |
| 2025 | Distributed IRSs Mitigate Spatial Wideband & Beam Split Effects. | L. Yashvanth, Chandra R. Murthy, Bhaskar D. Rao |
| 2025 | MUPO-Net: A Multilevel Dual-domain Progressive Enhancement Network with Embedded Attention for CT Metal Artifact Reduction. | Xiaoli Yao, Jia Tan, Zijian Deng, Deng Xiong, Qijun Zhao, Min Wu |
| 2025 | Exploring Large Language Models for Knowledge Graph Completion. | Liang Yao, Jiazhen Peng, Chengsheng Mao, Yuan Luo |
| 2025 | MambaRF: A Bi-directional Mamba Structure for Radio Frequency Signal Classification of Unmanned Aerial Vehicle. | Mufeng Yao, Chao Liu, Lexu Xie, Mingmin Chi |
| 2025 | A Noisy Label Filter based on GMM Binary Classification for Speaker Verification. | Jianglong Yao, Shenghui Lu, Pengyu Ren, Kaidi Wang, Qinyang Hong, Lin Li |
| 2025 | CascadePAIE: Reallocating Relevance for Event Roles and Event Text in Event Argument Extraction. | Chunyu Yao, Yi Guo |
| 2025 | Stealthy Backdoor Attack against Video Recognition Models. | Jiale Yan, Bo Zhao, Chunyu Yang |
| 2025 | LiSenNet: Lightweight Sub-band and Dual-Path Modeling for Real-Time Speech Enhancement. | Haoyin Yan, Jie Zhang, Cunhang Fan, Yeping Zhou, Peiqi Liu |
| 2025 | Enhancing Chest X-ray Classification through Knowledge Injection in Cross-Modality Learning. | Yang Yan, Bingqing Yue, Qiaxuan Li, Man Huang, Jingyu Chen, Zhenzhong Lan |
| 2025 | ConPCO: Preserving Phoneme Characteristics For Automatic Pronunciation Assessment Leveraging Contrastive Ordinal Regularization. | Bi-Cheng Yan, Yi-Cheng Wang, Jiun-Ting Li, Meng-Shin Lin, Hsin-Wei Wang, Wei-Cheng Chao, Berlin Chen |
| 2025 | LNLFace: Enhanced Blind Face Restoration With Local and Non-local Lookups. | Weidan Yan, Wenze Shao, Dengyin Zhang |
| 2025 | Improving Multilingual ASR in the Wild Using Simple N-best Re-ranking. | Brian Yan, Vineel Pratap, Shinji Watanabe, Michael Auli |
| 2025 | MTPareto: A MultiModal Targeted Pareto Framework for Fake News Detection. | Kaiying Yan, Moyang Liu, Yukun Liu, Ruibo Fu, Zhengqi Wen, Jianhua Tao, Xuefei Liu, Guanjun Li |
| 2025 | UML: A Unified Multimodal Learning Framework for Cataract Postoperative Visual Acuity Prediction with Uncertain Missing Modalities. | Tongyu Yang, Qian Zhou, Hua Zou, Haifeng Jiang, Yong Wang |
| 2025 | CGEDN: Approximation of Graph Edit Distance with Path Generation via Learning Node Matching. | Liu Yang, Qiankun Zheng, Zidong Wang |
| 2025 | Bridging the Modality Gap for Speech-image Retrieval with Text Supervision. | Yuting Yang, Lifeng Zhou, Yuke Li, Guodong Ma |