| 2025 | DisCo: Discovering Common Affordance from Large Models for Actionable Part Perception. | Youpeng Wen, Yi Zhu, Zhihao Zhan, Pengzhen Ren, Jianhua Han, Hang Xu, Shen Zhao, Xiaodan Liang |
| 2025 | Unsupervised Domain Adaptive Visual Question Answering in the Era of Multi-Modal Large Language Models. | Weixi Weng, Rui Zhang, Xiaojun Meng, Jieming Zhu, Qun Liu, Chun Yuan |
| 2025 | NeuManifold: Neural Watertight Manifold Reconstruction with Efficient and High-Quality Rendering Support. | Xinyue Wei, Fanbo Xiang, Sai Bi, Anpei Chen, Kalyan Sunkavalli, Zexiang Xu, Hao Su |
| 2025 | Online-LoRA: Task-Free Online Continual Learning via Low Rank Adaptation. | Xiwen Wei, Guihong Li, Radu Marculescu |
| 2025 | Relaxing Binary Constraints in Contrastive Vision-Language Medical Representation Learning. | Xiaoyang Wei, Camille Kurtz, Florence Cloppet |
| 2025 | Utilizing Uncertainty in 2D Pose Detectors for Probabilistic 3D Human Mesh Recovery. | Tom Wehrbein, Marco Rudolph, Bodo Rosenhahn, Bastian Wandt |
| 2025 | NeuroViG - Integrating Event Cameras for Resource-Efficient Video Grounding. | Dulanga Weerakoon, Vigneshwaran Subbaraju, Joo Hwee Lim, Archan Misra |
| 2025 | ALSTER: A Local Spatio-Temporal Expert for Online 3D Semantic Reconstruction. | Silvan Weder, Francis Engelmann, Johannes L. Schnberger, Akihito Seki, Marc Pollefeys, Martin R. Oswald |
| 2025 | Sigma: Siamese Mamba Network for Multi-Modal Semantic Segmentation. | Zifu Wan, Pingping Zhang, Yuhao Wang, Silong Yong, Simon Stepputtis, Katia P. Sycara, Yaqi Xie |
| 2025 | GEXIA: Granularity Expansion and Iterative Approximation for Scalable Multi-Grained Video-Language Learning. | Yicheng Wang, Zhikang Zhang, Jue Wang, David Fan, Zhenlin Xu, Linda Liu, Xiang Hao, Vimal Bhat, Xinyu Li |
| 2025 | RT-DETRv3: Real-Time End-to-End Object Detection with Hierarchical Dense Positive Supervision. | Shuo Wang, Chunlong Xia, Feng Lv, Yifeng Shi |
| 2025 | Uni-SLAM: Uncertainty-Aware Neural Implicit SLAM for Real-Time Dense Indoor Scene Reconstruction. | Shaoxiang Wang, Yaxu Xie, Chun-Peng Chang, Christen Millerdurai, Alain Pagani, Didier Stricker |
| 2025 | 360PanT: Training-Free Text-Driven 360-Degree Panorama-to-Panorama Translation. | Hai Wang, Jing-Hao Xue |
| 2025 | Continual Learning of Personalized Generative Face Models with Experience Replay. | Annie N. Wang, Luchao Qi, Roni Sengupta |
| 2025 | Towards Zero-shot 3D Anomaly Localization. | Yizhou Wang, Kuan-Chuan Peng, Yun Fu |
| 2025 | Latency Robust Cooperative Perception Using Asynchronous Feature Fusion. | Junjie Wang, Tomas Nordstrm |
| 2025 | Shift Equivariant Pose Network. | Pengxiao Wang, Tzu-Heng Lin, Chunyu Wang, Yizhou Wang |
| 2025 | MLLM-Tool: A Multimodal Large Language Model for Tool Agent Learning. | Chenyu Wang, Weixin Luo, Sixun Dong, Xiaohua Xuan, Zhengxin Li, Lin Ma, Shenghua Gao |
| 2025 | VM-Gait: Multi-Modal 3D Representation Based on Virtual Marker for Gait Recognition. | Zhao-Yang Wang, Jiang Liu, Jieneng Chen, Rama Chellappa |
| 2025 | Learning Visual Grounding from Generative Vision and Language Model. | Shijie Wang, Dahun Kim, Ali Taalimi, Chen Sun, Weicheng Kuo |
| 2025 | UniTMGE: Uniform Text-Motion Generation and Editing Model via Diffusion. | Ruoyu Wang, Yangfan He, Tengjiao Sun, Xiang Li, Tianyu Shi |
| 2025 | STAY Diffusion: Styled Layout Diffusion Model for Diverse Layout-to-Image Generation. | Ruyu Wang, Xuefeng Hou, Sabrina Schmedding, Marco F. Huber |
| 2025 | Diffusion Prism: Enhancing Diversity and Morphology Consistency in Mask-to-Image Diffusion. | Hao Wang, Xiwen Chen, Ashish Bastola, Jiayou Qin, Abolfazl Razi |
| 2025 | DeepCA: Deep Learning-Based 3D Coronary Artery Tree Reconstruction from Two 2D Non-Simultaneous X-Ray Angiography Projections. | Yiying Wang, Abhirup Banerjee, Robin P. Choudhury, Vicente Grau |
| 2025 | UW-GS: Distractor-Aware 3D Gaussian Splatting for Enhanced Underwater Scene Reconstruction. | Haoran Wang, Nantheera Anantrasirichai, Fan Zhang, David Bull |