| 2025 | PicoAudio: Enabling Precise Temporal Controllability in Text-to-Audio Generation. | Zeyu Xie, Xuenan Xu, Zhizheng Wu, Mengyue Wu |
| 2025 | IOVS4NeRF: Incremental Optimal View Selection for Large-Scale NeRFs. | Jingpeng Xie, Shiyu Tan, Yuanlei Wang, Tianle Du, Yifei Xue, Yizhen Lao |
| 2025 | Advancing SAR Image Robustness: Integrating Diffusion Models for Adversarial Purification and Speckle Noise Suppression. | Ganglin Xie, Haobo Lu, Xinze Zhang, Kun He |
| 2025 | Leveraging Chain of Thought towards Empathetic Spoken Dialogue without Corresponding Question-Answering Data. | Jingran Xie, Shun Lei, Yue Yu, Yang Xiang, Hui Wang, Xixin Wu, Zhiyong Wu |
| 2025 | High-Fidelity Editable Portrait Synthesis with 3D GAN Inversion. | Jindong Xie, Jiachen Liu, Yupei Lin, Jinbao Wang, Xianxu Hou, Linlin Shen |
| 2025 | Inter- and Intra-Sentence Cuer-Invariant Representation Learning for Generalizable Cued Speech Recognition. | Tianxin Xie, Li Liu |
| 2025 | ICAA-Mamba: Vision Mamba for Image Color Aesthetics Assessment. | Qinghao Xie, Wenchao Jiang, Zhihua Wang, Qiuping Jiang |
| 2025 | LMTalker: Sparse Landmark-guided Gaussian Splatting for High-fidelity Talking Head Synthesis. | Zhifeng Xie, Zhiwen Jiang, Xuemin Lei, Mengtian Li |
| 2025 | Learning from Ambiguous Data with Hard Labels. | Zeke Xie, Zheng He, Nan Lu, Lichen Bai, Bao Li, Shuo Yang, Mingming Sun, Ping Li |
| 2025 | Spatially-variant Blur Degradation Model Based on Depth Estimation. | Rui Xie, Shuzhan Guo, Li Zou, Jiaxiong Liu, Qian Wang, Jun Zhou |
| 2025 | Stable Control Visual AutoRegressive Model: Precise and Efficient Image Generation via Scale Alignment. | Feng Xie, Dahua Gao, Ruichao Liu, Minxi Yang, Yibo Zhang, Wenlong Wang |
| 2025 | Clutter Resilient Occlusion Avoidance for Tightly-Coupled Motion-Assisted Detection. | Zhixuan Xie, Jianjun Chen, Guoliang Li, Shuai Wang, Kejiang Ye, Yonina C. Eldar, Chengzhong Xu |
| 2025 | Micro-expression Spotting based on Multi-modal Hierarchical Semantic-guided Deep Fusion Model. | Zhihua Xie, Haolin Chang |
| 2025 | Developing a Multilingual Dataset and Evaluation Metrics for Code-Switching: A Focus on Hong Kong's Polylingual Dynamics. | Peng Xie, Kani Chen |
| 2025 | Efficient Co-clustering via Anchor-refined Label Spreading. | Fangyuan Xie, Feiping Nie, Weizhong Yu, Xuelong Li |
| 2025 | Char-SAM: Turning Segment Anything Model into Scene Text Segmentation Annotator with Character-level Visual Prompts. | Enze Xie, Jiahao Lyu, Daiqing Wu, Huawen Shen, Yu Zhou |
| 2025 | LaTeXNet: A Specialized Model for Converting Visual Tables and Equations to LaTeX Code. | Renqiu Xia, Hongbin Zhou, Ziming Feng, Huanxi Liu, Boan Chen, Bo Zhang, Junchi Yan |
| 2025 | Rethinking Decoding in Multi-intent Spoken Language Understanding. | Ying Xia, Zhen Xiong, Kefan Shen, Zhihong Zhu, Shaorong Xie, Wei Liu |
| 2025 | LV-ReID: Large Language-Vision Alignment Model for Text-based Person Re-identification. | Yinghui Xia, Chao Wang, Jinsong Yang |
| 2025 | Improving Multimodal Human Pose Estimation by Adversarial Modality Enhancement | Jiangnan Xia, Qilong Wu, Yanyin Guo, Yi Li, Jianghan Cheng, Junwei Li, Zhiyuan Zhang |
| 2025 | Debiased Training For Semi-supervised Sound Event Detection. | Shengchang Xiao, Xueshuai Zhang, Pengyuan Zhang, Yonghong Yan |
| 2025 | Prototype Matching with Domain Alignment for Open-world Specific Emitter Identification. | Wang Xiao, Yalan Ye, Tongjie Pan, Chenyang Li |
| 2025 | FedDiT: Federated Learning by Distillation Token Enhanced Vision Transformer. | Jue Xiao, Zepu Yi, Hewang Nie, Zhi Lu, Xueming Tang, Songfeng Lu, Zhiguo Huang, Runqing Zhang |
| 2025 | EEG Decoding and Visual Reconstruction via 3D Geometric with Nonstationarity Modelling. | Xin Xiao, Kaiwen Wei, Jiang Zhong, Xuekai Wei, Jielu Yan |
| 2025 | Multi-View Image Enhancement Inconsistency Decoupling Guided 3D Gaussian Splatting. | Lu Xiao, Jiahao Wu, Zhanke Wang, Guanhua Wu, Runling Liu, Zhiyan Wang, Ronggang Wang |