| 2025 | Are Spatial-Temporal Graph Convolution Networks for Human Action Recognition Over-Parameterized? | Jianyang Xie, Yitian Zhao, Yanda Meng, He Zhao, Anh Nguyen, Yalin Zheng |
| 2025 | PhysAnimator: Physics-Guided Generative Cartoon Animation. | Tianyi Xie, Yiwei Zhao, Ying Jiang, Chenfanfu Jiang |
| 2025 | Towards Million-Scale Adversarial Robustness Evaluation With Stronger Individual Attacks. | Yong Xie, Weijie Zheng, Hanxun Huang, Guangnan Ye, Xingjun Ma |
| 2025 | Dynamic Content Prediction with Motion-aware Priors for Blind Face Video Restoration. | Lianxin Xie, Bingbing Zheng, Si Wu, Hau-San Wong |
| 2025 | AdaDARE-gamma: Balancing Stability and Plasticity in Multi-modal LLMs through Efficient Adaptation. | Jingyi Xie, Jintao Yang, Zhunchen Luo, Yunbo Cao, Qiang Gao, Mengyuan Zhang, Wenpeng Hu |
| 2025 | Progressive Autoregressive Video Diffusion Models. | Desai Xie, Zhan Xu, Yicong Hong, Hao Tan, Difan Liu, Feng Liu, Arie E. Kaufman, Yang Zhou |
| 2025 | Test-Time Visual In-Context Tuning. | Jiahao Xie, Alessio Tonioni, Nathalie Rauschmayr, Federico Tombari, Bernt Schiele |
| 2025 | Training Data Provenance Verification: Did Your Model Use Synthetic Data from My Generative Model for Training? | Yuechen Xie, Jie Song, Huiqiong Wang, Mingli Song |
| 2025 | TurboFill: Adapting Few-step Text-to-image Model for Fast Image Inpainting. | Liangbin Xie, Daniil Pakhomov, Zhonghao Wang, Zongze Wu, Ziyan Chen, Yuqian Zhou, Haitian Zheng, Zhifei Zhang, Zhe Lin, Jiantao Zhou, Chao Dong |
| 2025 | Efficiently Mitigating Video Content Misalignment on Large Vision Model with Time-Series Data Alignment. | Hanchen Xie, Rose Ma, Jiageng Zhu, Zheda Mai, Wael Abd-Almageed, Zubin Abraham |
| 2025 | MaSS13K: A Matting-level Semantic Segmentation Benchmark. | Chenxi Xie, Minghan Li, Hui Zeng, Jun Luo, Lei Zhang |
| 2025 | Vid2Sim: Realistic and Interactive Simulation from Video for Urban Navigation. | Ziyang Xie, Zhizheng Liu, Zhenghao Peng, Wayne Wu, Bolei Zhou |
| 2025 | Advancing Manga Analysis: Comprehensive Segmentation Annotations for the Manga109 Dataset. | Minshan Xie, Jian Lin, Hanyuan Liu, Chengze Li, Tien-Tsin Wong |
| 2025 | dFLMoE: Decentralized Federated Learning via Mixture of Experts for Medical Data Analysis. | Luyuan Xie, Tianyu Luan, Wenyuan Cai, Guochen Yan, Zhaoyu Chen, Nan Xi, Yuejian Fang, Qingni Shen, Zhonghai Wu, Junsong Yuan |
| 2025 | SmartCLIP: Modular Vision-language Alignment with Identification Guarantees. | Shaoan Xie, Lingjing, Yujia Zheng, Yu Yao, Zeyu Tang, Eric P. Xing, Guangyi Chen, Kun Zhang |
| 2025 | FilmComposer: LLM-Driven Music Production for Silent Film Clips. | Zhifeng Xie, Qile He, Youjia Zhu, Qiwei He, Mengtian Li |
| 2025 | Let's Chorus: Partner-aware Hybrid Song-Driven 3D Head Animation. | Xiumei Xie, Zikai Huang, Wenhao Xu, Peng Xiao, Xuemiao Xu, Huaidong Zhang |
| 2025 | DyMO: Training-Free Diffusion Model Alignment with Dynamic Multi-Objective Scheduling. | Xin Xie, Dong Gong |
| 2025 | Model Poisoning Attacks to Federated Learning via Multi-Round Consistency. | Yueqi Xie, Minghong Fang, Neil Zhenqiang Gong |
| 2025 | EchoMatch: Partial-to-Partial Shape Matching via Correspondence Reflection. | Yizheng Xie, Viktoria Ehm, Paul Roetzer, Nafie El Amrani, Maolin Gao, Florian Bernard, Daniel Cremers |
| 2025 | EnvGS: Modeling View-Dependent Appearance with Environment Gaussian. | Tao Xie, Xi Chen, Zhen Xu, Yiman Xie, Yudong Jin, Yujun Shen, Sida Peng, Hujun Bao, Xiaowei Zhou |
| 2025 | Chain of Attack: On the Robustness of Vision-Language Models Against Transfer-Based Adversarial Attacks. | Peng Xie, Yequan Bie, Jianda Mao, Yangqiu Song, Yang Wang, Hao Chen, Kani Chen |
| 2025 | Mamba-Adaptor: State Space Model Adaptor for Visual Recognition. | Fei Xie, Jiahao Nie, Yujin Tang, Wenkang Zhang, Hongshen Zhao |
| 2025 | Generative Gaussian Splatting for Unbounded 3D City Generation. | Haozhe Xie, Zhaoxi Chen, Fangzhou Hong, Ziwei Liu |
| 2025 | Diffusion-based Event Generation for High-Quality Image Deblurring. | Xinan Xie, Qing Zhang, Wei-Shi Zheng |