| 2025 | Phoenix: A Motion-based Self-Reflection Framework for Fine-grained Robotic Action Correction. | Wenke Xia, Ruoxuan Feng, Dong Wang, Di Hu |
| 2025 | FG^2: Fine-Grained Cross-View Localization by Fine-Grained Feature Matching. | Zimin Xia, Alexandre Alahi |
| 2025 | Reconstructing Humans with a Biomechanically Accurate Skeleton. | Yan Xia, Xiaowei Zhou, Etienne Vouga, Qixing Huang, Georgios Pavlakos |
| 2025 | Rectified Diffusion Guidance for Conditional Generation. | Mengfei Xia, Nan Xue, Yujun Shen, Ran Yi, Tieliang Gong, Yong-Jin Liu |
| 2025 | Action Valuation in Sports: A Survey. | Artur Xarles, Sergio Escalera, Thomas B. Moeslund, Albert Claps |
| 2025 | Live Demonstration: Real-time event-data processing with Graph Convolutional Neural Networks and SoC FPGA. | Piotr Wzorek, Krzysztof Blachut, Kamil Jeziorek, Tomasz Kryjak |
| 2025 | Morpheus: Text-Driven 3D Gaussian Splat Shape and Color Stylization. | Jamie Wynn, Zawar Qureshi, Jakub Powierza, Jamie Watson, Mohamed Sayed |
| 2025 | Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception. | Yuanchen Wu, Lu Zhang, Hang Yao, Junlong Du, Ke Yan, Shouhong Ding, Yunsheng Wu, Xiaoqiang Li |
| 2025 | MoManipVLA: Transferring Vision-language-action Models for General Mobile Manipulation. | Zhenyu Wu, Yuheng Zhou, Xiuwei Xu, Ziwei Wang, Haibin Yan |
| 2025 | GarmentPile: Point-Level Visual Affordance Guided Retrieval and Adaptation for Cluttered Garments Manipulation. | Ruihai Wu, Ziyu Zhu, Yuran Wang, Yue Chen, Jiarui Wang, Hao Dong |
| 2025 | Generating Multimodal Driving Scenes via Next-Scene Prediction. | Yanhao Wu, Haoyang Zhang, Tianwei Lin, Lichao Huang, Shujie Luo, Rui Wu, Congpei Qiu, Wei Ke, Tong Zhang |
| 2025 | SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device. | Yushu Wu, Zhixing Zhang, Yanyu Li, Yanwu Xu, Anil Kag, Yang Sui, Huseyin Coskun, Ke Ma, Aleksei Lebedev, Ju Hu, Dimitris N. Metaxas, Yanzhi Wang, Sergey Tulyakov, Jian Ren |
| 2025 | AffordDP: Generalizable Diffusion Policy with Transferable Affordance. | Shijie Wu, Yihang Zhu, Yunao Huang, Kaizhen Zhu, Jiayuan Gu, Jingyi Yu, Ye Shi, Jingya Wang |
| 2025 | WeatherGen: A Unified Diverse Weather Generator for LiDAR Point Clouds via Spider Mamba Diffusion. | Yang Wu, Yun Zhu, Kaihua Zhang, Jianjun Qian, Jin Xie, Jian Yang |
| 2025 | APHQ-ViT: Post-Training Quantization with Average Perturbation Hessian Based Reconstruction for Vision Transformers. | Zhuguanyu Wu, Jiayi Zhang, Jiaxin Chen, Jinyang Guo, Di Huang, Yunhong Wang |
| 2025 | InteractionMap: Improving Online Vectorized HDMap Construction with Interaction. | Kuang Wu, Chuan Yang, Zhanbin Li |
| 2025 | MG-MotionLLM: A Unified Framework for Motion Comprehension and Generation across Multiple Granularities. | Bizhu Wu, Jinheng Xie, Keming Shen, Zhe Kong, Jianfeng Ren, Ruibin Bai, Rong Qu, Linlin Shen |
| 2025 | PI-HMR: Towards Robust In-bed Temporal Human Shape Reconstruction with Contact Pressure Sensing. | Ziyu Wu, Yufan Xiong, Mengting Niu, Fangting Xie, Quan Wan, Qijun Ying, Boyan Liu, Xiaohui Cai |
| 2025 | GenFusion: Closing the Loop between Reconstruction and Generation via Videos. | Sibo Wu, Congrong Xu, Binbin Huang, Andreas Geiger, Anpei Chen |
| 2025 | FIMA-Q: Post-Training Quantization for Vision Transformers by Fisher Information Matrix Approximation. | Zhuguanyu Wu, Shihe Wang, Jiayi Zhang, Jiaxin Chen, Yunhong Wang |
| 2025 | DFM: Differentiable Feature Matching for Anomaly Detection. | Sheng Wu, Yimi Wang, Xudong Liu, Yuguang Yang, Runqi Wang, Guodong Guo, David S. Doermann, Baochang Zhang |
| 2025 | SAMBLE: Shape-Specific Point Cloud Sampling for an Optimal Trade-Off Between Local Detail and Global Uniformity. | Chengzhi Wu, Yuxin Wan, Hao Fu, Julius Pfrommer, Zeyun Zhong, Junwei Zheng, Jiaming Zhang, Jrgen Beyerer |
| 2025 | DiffSensei: Bridging Multi-Modal LLMs and Diffusion Models for Customized Manga Generation. | Jianzong Wu, Chao Tang, Jingbo Wang, Yanhong Zeng, Xiangtai Li, Yunhai Tong |
| 2025 | Synthetic Data is an Elegant GIFT for Continual Vision-Language Models. | Bin Wu, Wuxuan Shi, Jinqiao Wang, Mang Ye |
| 2025 | AVF-MAE++: Scaling Affective Video Facial Masked Autoencoders via Efficient Audio-Visual Self-Supervised Learning. | Xuecheng Wu, Heli Sun, Yifan Wang, Jiayu Nie, Jie Zhang, Yabing Wang, Junxiao Xue, Liang He |