| 2025 | DepthSplat: Connecting Gaussian Splatting and Depth. | Haofei Xu, Songyou Peng, Fangjinhua Wang, Hermann Blum, Daniel Barath, Andreas Geiger, Marc Pollefeys |
| 2025 | VideoGigaGAN: Towards Detail-rich Video Super-Resolution. | Yiran Xu, Taesung Park, Richard Zhang, Yang Zhou, Eli Shechtman, Feng Liu, Jia-Bin Huang, Difan Liu |
| 2025 | DEFT-VTON: Efficient Virtual Try-On with Consistent Generalised H-Transform. | Xingzi Xu, Qi Li, Shuwen Qiu, Julien Han, Karim Bouyarmane |
| 2025 | PICD: Versatile Perceptual Image Compression with Diffusion Rendering. | Tongda Xu, Jiahao Li, Bin Li, Yan Wang, Ya-Qin Zhang, Yan Lu |
| 2025 | A Hubness Perspective on Representation Learning for Graph-Based Multi-View Clustering. | Zheming Xu, He Liu, Congyan Lang, Tao Wang, Yidong Li, Michael C. Kampffmeyer |
| 2025 | AMR-Transformer: Enabling Efficient Long-range Interaction for Complex Neural Fluid Simulation. | Zeyi Xu, Jinfan Liu, Kuangxu Chen, Ye Chen, Zhangli Hu, Bingbing Ni |
| 2025 | Towards Zero-Shot Anomaly Detection and Reasoning with Multimodal Large Language Models. | Jiacong Xu, Shao-Yuan Lo, Bardia Safaei, Vishal M. Patel, Isht Dwivedi |
| 2025 | Language-Guided Audio-Visual Learning for Long-Term Sports Assessment. | Huangbiao Xu, Xiao Ke, Huanqi Wu, Rui Xu, Yuezhou Li, Wenzhong Guo |
| 2025 | InsightEdit: Towards Better Instruction Following for Image Editing. | Yingjing Xu, Jie Kong, Jiazhi Wang, Xiao Pan, Bo Lin, Qiang Liu |
| 2025 | Adaptive Dropout: Unleashing Dropout across Layers for Generalizable Image Super-Resolution. | Hang Xu, Jie Huang, Wei Yu, Jiangtong Tan, Zhen Zou, Feng Zhao |
| 2025 | TopoCellGen: Generating Histopathology Cell Topology with a Diffusion Model. | Meilong Xu, Saumya Gupta, Xiaoling Hu, Chen Li, Shahira Abousamra, Dimitris Samaras, Prateek Prasanna, Chao Chen |
| 2025 | Similarity-Guided Layer-Adaptive Vision Transformer for UAV Tracking. | Chaocan Xue, Bineng Zhong, Qihua Liang, Yaozong Zheng, Ning Li, Yuanliang Xue, Shuxiang Song |
| 2025 | Few-shot Personalized Scanpath Prediction. | Ruoyu Xue, Jingyi Xu, Sounak Mondal, Hieu Le, Gregory J. Zelinsky, Minh Hoai, Dimitris Samaras |
| 2025 | ComfyBench: Benchmarking LLM-based Agents in ComfyUI for Autonomously Designing Collaborative AI Systems. | Xiangyuan Xue, Zeyu Lu, Di Huang, Zidong Wang, Wanli Ouyang, Lei Bai |
| 2025 | Guiding Human-Object Interactions with Rich Geometry and Relations. | Mengqing Xue, Yifei Liu, Ling Guo, Shaoli Huang, Changxing Ding |
| 2025 | CorrBEV: Multi-View 3D Object Detection by Correlation Learning with Multi-modal Prototypes. | Ziteng Xue, Mingzhe Guo, Heng Fan, Shihui Zhang, Zhipeng Zhang |
| 2025 | MATCHA: Towards Matching Anything. | Fei Xue, Sven Elflein, Laura Leal-Taix, Qunjie Zhou |
| 2025 | Progress-Aware Video Frame Captioning. | Zihui Xue, Joungbin An, Xitong Yang, Kristen Grauman |
| 2025 | PhyT2V: LLM-Guided Iterative Self-Refinement for Physics-Grounded Text-to-Video Generation. | Qiyao Xue, Xiangyu Yin, Boyuan Yang, Wei Gao |
| 2025 | Learning Dynamic Collaborative Network for Semi-supervised 3D Vessel Segmentation. | Jiao Xu, Xin Chen, Lihe Zhang |
| 2025 | TrajGNAS: Heterogeneous Multiagent Trajectory Prediction Based on a Graph Neural Architecture Search. | Yunheng Xu, Jie Chen, Shuoheng Wang, Xinwen Wang |
| 2025 | M3GYM: A Large-Scale Multimodal Multi-view Multi-person Pose Dataset for Fitness Activity Understanding in Real-world Settings. | Qingzheng Xu, Ru Cao, Xin Shen, Heming Du, Sen Wang, Xin Yu |
| 2025 | Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting. | Jingyi Xu, Xieyuanli Chen, Junyi Ma, Jiawei Huang, Jintao Xu, Yue Wang, Ling Pei |
| 2025 | Adversarial Domain Prompt Tuning and Generation for Single Domain Generalization. | Zhipeng Xu, De Cheng, Xinyang Jiang, Nannan Wang, Dongsheng Li, Xinbo Gao |
| 2025 | Skor-xG: SKeleton-ORiented Expected Goal Estimation in Soccer. | Yizhou Xu, Lars Bretzner, Tiesheng Wang, Atsuto Maki |