| 2024 | Chains of Diffusion Models. | Yanheng Wei, Lianghua Huang, Zhi-Fan Wu, Wei Wang, Yu Liu, Mingda Jia, Shuailei Ma |
| 2024 | Towards Latent Masked Image Modeling for Self-supervised Visual Representation Learning. | Yibing Wei, Abhinav Gupta, Pedro Morgado |
| 2024 | I-MedSAM: Implicit Medical Image Segmentation with Segment Anything. | Xiaobao Wei, Jiajun Cao, Yizhu Jin, Ming Lu, Guangyu Wang, Shanghang Zhang |
| 2024 | UniIR: Training and Benchmarking Universal Multimodal Information Retrievers. | Cong Wei, Yang Chen, Haonan Chen, Hexiang Hu, Ge Zhang, Jie Fu, Alan Ritter, Wenhu Chen |
| 2024 | Linking in Style: Understanding Learned Features in Deep Learning Models. | Maren H. Wehrheim, Pamela Osuna-Vargas, Matthias Kaschube |
| 2024 | Power Variable Projection for Initialization-Free Large-Scale Bundle Adjustment. | Simon Weber, Je Hyeong Hong, Daniel Cremers |
| 2024 | Early Anticipation of Driving Maneuvers. | Abdul Wasi, Shankar Gangisetty, Shyam Nandan Rai, C. V. Jawahar |
| 2024 | Robust Zero-Shot Crowd Counting and Localization With Adaptive Resolution SAM. | Jia Wan, Qiangqiang Wu, Wei Lin, Antoni B. Chan |
| 2024 | Improving Virtual Try-On with Garment-Focused Diffusion Models. | Siqi Wan, Yehao Li, Jingwen Chen, Yingwei Pan, Ting Yao, Yang Cao, Tao Mei |
| 2024 | VideoAgent: Long-Form Video Understanding with Large Language Model as Agent. | Xiaohan Wang, Yuhui Zhang, Orr Zohar, Serena Yeung-Levy |
| 2024 | TF-FAS: Twofold-Element Fine-Grained Semantic Guidance for Generalizable Face Anti-spoofing. | Xudong Wang, Ke-Yue Zhang, Taiping Yao, Qianyu Zhou, Shouhong Ding, Pingyang Dai, Rongrong Ji |
| 2024 | Progressive Classifier and Feature Extractor Adaptation for Unsupervised Domain Adaptation on Point Clouds. | Zicheng Wang, Zhen Zhao, Yiming Wu, Luping Zhou, Dong Xu |
| 2024 | Hierarchical Separable Video Transformer for Snapshot Compressive Imaging. | Ping Wang, Yulun Zhang, Lishun Wang, Xin Yuan |
| 2024 | T2IShield: Defending Against Backdoors on Text-to-Image Diffusion Models. | Zhongqi Wang, Jie Zhang, Shiguang Shan, Xilin Chen |
| 2024 | SINDER: Repairing the Singular Defects of DINOv2. | Haoqi Wang, Tong Zhang, Mathieu Salzmann |
| 2024 | Depth-Aware Blind Image Decomposition for Real-World Adverse Weather Recovery. | Chao Wang, Zhedong Zheng, Ruijie Quan, Yi Yang |
| 2024 | PFGS: High Fidelity Point Cloud Rendering via Feature Splatting. | Jiaxu Wang, Ziyi Zhang, Junhao He, Renjing Xu |
| 2024 | End-to-End Rate-Distortion Optimized 3D Gaussian Representation. | Henan Wang, Hanxin Zhu, Tianyu He, Runsen Feng, Jiajun Deng, Jiang Bian, Zhibo Chen |
| 2024 | DriveDreamer: Towards Real-World-Drive World Models for Autonomous Driving. | Xiaofeng Wang, Zheng Zhu, Guan Huang, Xinze Chen, Jiagang Zhu, Jiwen Lu |
| 2024 | Vamos: Versatile Action Models for Video Understanding. | Shijie Wang, Qi Zhao, Minh Quan Do, Nakul Agarwal, Kwonjoon Lee, Chen Sun |
| 2024 | SFPNet: Sparse Focal Point Network for Semantic Segmentation on General LiDAR Point Clouds. | Yanbo Wang, Wentao Zhao, Chuan Cao, Tianchen Deng, Jingchuan Wang, Weidong Chen |
| 2024 | Functional Transform-Based Low-Rank Tensor Factorization for Multi-dimensional Data Recovery. | Jian-Li Wang, Xile Zhao |
| 2024 | View-Consistent 3D Editing with Gaussian Splatting. | Yuxuan Wang, Xuanyu Yi, Zike Wu, Na Zhao, Long Chen, Hanwang Zhang |
| 2024 | Elysium: Exploring Object-Level Perception in Videos via MLLM. | Han Wang, Yongjie Ye, Yanjie Wang, Yuxiang Nie, Can Huang |
| 2024 | YOLOv9: Learning What You Want to Learn Using Programmable Gradient Information. | Chien-Yao Wang, I-Hau Yeh, Hong-Yuan Mark Liao |