| 2025 | What Affects the Performance of Fake Audio Detection? Analyzing Factors in a Continual Learning Setting. | Yixuan Xiao, Ngoc Thang Vu |
| 2025 | Single Snapshot Direction of Arrival Estimation Using the EP-SURE-SBL Algorithm. | Fangqing Xiao, Dirk Slock |
| 2025 | Convergence Analysis of alpha-SVRG under Strong Convexity. | Sean Xiao, Sangwoo Park, Stefan Vlaski |
| 2025 | TD-RD: A Top-Down Benchmark with Real-Time Framework for Road Damage Detection. | Xi Xiao, Zhengji Li, Wentao Wang, Jiacheng Xie, Houjie Lin, Swalpa Kumar Roy, Tianyang Wang, Min Xu |
| 2025 | Exploiting Application-to-Architecture Dependencies for Designing Scalable OS. | Yao Xiao, Nikos Kanakaris, Anzhe Cheng, Chenzhong Yin, Nesreen K. Ahmed, Shahin Nazarian, Andrei Irimia, Paul Bogdan |
| 2025 | TAME: Temporal Audio-based Mamba for Enhanced Drone Trajectory Estimation and Classification. | Zhenyuan Xiao, Huanran Hu, Guili Xu, Junwei He |
| 2025 | Contextual ASR with Retrieval Augmented Large Language Model. | Cihan Xiao, Zejiang Hou, Daniel Garcia-Romero, Kyu J. Han |
| 2025 | AVS3P10 Standard for Real-time Speech Coding. | Wei Xiao, Weibei Dou, Wenlong Wang, Gaoxiong Yi, Jingxin Li, Shidong Shang |
| 2025 | UCIL: An Unsupervised Class Incremental Learning Approach for Sound Event Detection. | Yang Xiao, Rohan Kumar Das |
| 2025 | RecNet: Optimization for Dense Object Detection in Retail Scenarios Based on View Rectification. | Junhao Xiao, Yi Chen, Xiao Feng, Ruoyu Wang, Zhiyu Wu |
| 2025 | LkSFocalNets: Video Action Recognition With Large Kernel Selective Focal Networks. | Jian Xiao, Ping Shi, Qipei Li |
| 2025 | DEBT: Enhancing Entity Alignment in Knowledge Graphs through Description Enrichment and Bootstrap Training. | Ting Xiang, Jiapeng Zhang, Changjian Chen, Zhuo Tang |
| 2025 | LKA-ReID: Vehicle Re-Identification with Large Kernel Attention. | Xuezhi Xiang, Zhushan Ma, Lei Zhang, Denis Ombati, Himaloy Himu, Xiantong Zhen |
| 2025 | A Two-Stage AIGC Image Quality Assessment with T2I Correspondence and Visual Perception. | Jili Xia, Lihuo He, Bo Hu, Bo Han, Xinbo Gao |
| 2025 | Melody Structure Transfer Network: Generating Music with Separable Self-Attention. | Junlin Wu, Ning Zhang, Cheng Zhong, Boan Chen, Huanxi Liu, Junchi Yan |
| 2025 | MIMO Channel as a Neural Function: Implicit Neural Representations for Extreme CSI Compression. | Haotian Wu, Maojun Zhang, Yulin Shao, Krystian Mikolajczyk, Deniz Gndz |
| 2025 | Relation-aware Semantic Alignment Network for Text-to-Image Person Retrieval. | Yong Wu, Rongxi Zhou, Hongchao Li, Ze Zhou, Feifei Wei, Min Li, Guodui He |
| 2025 | EvaSR: Rethinking Efficient Visual Attention Design for Image Super-Resolution. | Zhijian Wu, Chenhan Zhang, Dingjiang Huang |
| 2025 | Low-Complexity Algorithms for Multichannel Spectral Super-Resolution. | Xunmeng Wu, Zai Yang, Zongben Xu |
| 2025 | Spatiotemporal-Aware Visual Captioning using Vision-Language Pre-Training Model. | Shuai Wu, Weidong Yang, Shuyan Wu |
| 2025 | Accurate 3D Facial Paralysis Analysis Using Multi-View Infrared Structured Light System. | Di Wu, Yuping Ye, Jixin Liang, Shiyang Long, Zhan Song |
| 2025 | RIS-Enabled Self-Interference Elimination in Monostatic Full-Duplex DFRC Systems. | Linlong Wu, Zichao Xiao, Bhavani Shankar M. R., Bjrn E. Ottersten |
| 2025 | LP-Gaussians: Learnable Parametric Gaussian Splatting for Efficient Dynamic Reconstruction of Single-View Scenes. | Shaoqi Wu, Weixing Xie, Youhong Peng, Jinwen Li, Jiawei Yao, Junfeng Yao |
| 2025 | Integrating Potential Pronunciations for Enhanced Mispronunciation Detection and Diagnosis Ability in LLMs. | Minglin Wu, Jing Xu, Xueyuan Chen, Helen Meng |
| 2025 | Cross-attention Inspired Selective State Space Models for Target Sound Extraction. | Donghang Wu, Yiwen Wang, Xihong Wu, Tianshu Qu |