IEEE Conference on Computer Vision and Pattern Recognition
CVPR
A*
CORE rank
CORE rank (raw)
A*
Acceptance rate
23.6% (2024)
Fields of research
Computer Vision and Multimedia Computation
Papers indexed
31,646
1988–2025
Papers per year
19883,543 peak2025
Most published authors
CVPR papers
31,646 records sourced from DBLP. Search titles, filter by year, sort by recency.
| Year | Title | Authors |
|---|---|---|
| 2025 | MoVE-KD: Knowledge Distillation for VLMs with Mixture of Visual Encoders. | Jiajun Cao, Yuan Zhang, Tao Huang, Ming Lu, Qizhe Zhang, Ruichuan An, Ningning Ma, Shanghang Zhang |
| 2025 | Image is All You Need to Empower Large-scale Diffusion Models for In-Domain Generation. | Pu Cao, Feng Zhou, Lu Yang, Tianrui Huang, Qing Song |
| 2025 | PanDA: Towards Panoramic Depth Anything with Unlabeled Panoramas and Mobius Spatial Augmentation. | Zidong Cao, Jinjing Zhu, Weiming Zhang, Hao Ai, Haotian Bai, Hengshuang Zhao, Lin Wang |
| 2025 | MVGenMaster: Scaling Multi-View Generation from Any Image via 3D Priors Enhanced Diffusion Model. | Chenjie Cao, Chaohui Yu, Shang Liu, Fan Wang, Xiangyang Xue, Yanwei Fu |
| 2025 | SceneTAP: Scene-Coherent Typographic Adversarial Planner against Vision-Language Models in Real-World Environments. | Yue Cao, Yun Xing, Jie Zhang, Di Lin, Tianwei Zhang, Ivor W. Tsang, Yang Liu, Qing Guo |
| 2025 | SocialGesture: Delving into Multi-person Gesture Understanding. | Xu Cao, Pranav Virupaksha, Wenqi Jia, Bolin Lai, Fiona Ryan, Sangmin Lee, James M. Rehg |
| 2025 | iG-6DoF: Model-free 6DoF Pose Estimation for Unseen Object via Iterative 3D Gaussian Splatting. | Tuo Cao, Fei Luo, Jiongming Qin, Yu Jiang, Yusen Wang, Chunxia Xiao |
| 2025 | FLAME: Frozen Large Language Models Enable Data-Efficient Language-Image Pre-training. | Anjia Cao, Xing Wei, Zhiheng Ma |
| 2025 | Towards Synthetic Concept Activation Vectors via Generative Models. | Riccardo Campi, Santiago Borrego, Antonio De Santis, Matteo Bianchi, Andrea Tocchetti, Marco Brambilla |
| 2025 | FRAME: Floor-aligned Representation for Avatar Motion from Egocentric Video. | Andrea Boscolo Camiletto, Jian Wang, Eduardo Alvarado, Rishabh Dabral, Thabo Beeler, Marc Habermann, Christian Theobalt |
| 2025 | Beyond Local Sharpness: Communication-Efficient Global Sharpness-aware Minimization for Federated Learning. | Debora Caldarola, Pietro Cagnasso, Barbara Caputo, Marco Ciccone |
| 2025 | Do Computer Vision Foundation Models Learn the Low-level Characteristics of the Human Visual System? | Yancheng Cai, Fei Yin, Dounia Hammou, Rafal Mantiuk |
| 2025 | HERA: Hybrid Explicit Representation for Ultra-Realistic Head Avatars. | Hongrui Cai, Yuting Xiao, Xuan Wang, Jiafei Li, Yudong Guo, Yanbo Fan, Shenghua Gao, Juyong Zhang |
| 2025 | PhyS-EdiT: Physics-aware Semantic Image Editing with Text Description. | Ziqi Cai, Shuchen Weng, Yifei Xia, Boxin Shi |
| 2025 | ROCKET-1: Mastering Open-World Interaction with Visual-Temporal Context Prompting. | Shaofei Cai, Zihao Wang, Kewei Lian, Zhancun Mu, Xiaojian Ma, Anji Liu, Yitao Liang |
| 2025 | Keep the Balance: A Parameter-Efficient Symmetrical Framework for RGB+X Semantic Segmentation. | Jiaxin Cai, Jingze Su, Qi Li, Wenjie Yang, Shu Wang, Tiesong Zhao, Shengfeng He, Wenxi Liu |
| 2025 | SPMTrack: Spatio-Temporal Parameter-Efficient Fine-Tuning with Mixture of Experts for Scalable Visual Tracking. | Wenrui Cai, Qingjie Liu, Yunhong Wang |
| 2025 | Diffusion Self-Distillation for Zero-Shot Customized Image Generation. | Shengqu Cai, Eric Ryan Chan, Yunzhi Zhang, Leonidas J. Guibas, Jiajun Wu, Gordon Wetzstein |
| 2025 | DiTCtrl: Exploring Attention Control in Multi-Modal Diffusion Transformer for Tuning-Free Multi-Prompt Longer Video Generation. | Minghong Cai, Xiaodong Cun, Xiaoyu Li, Wenze Liu, Zhaoyang Zhang, Yong Zhang, Ying Shan, Xiangyu Yue |
| 2025 | Can Generative Video Models Help Pose Estimation? | Ruojin Cai, Jason Y. Zhang, Philipp Henzler, Zhengqi Li, Noah Snavely, Ricardo Martin-Brualla |
| 2025 | LoKi: Low-dimensional KAN for Efficient Fine-tuning Image Models. | Xuan Cai, Renjie Pan, Hua Yang |
| 2025 | Recurrence-Enhanced Vision-and-Language Transformers for Robust Multimodal Document Retrieval. | Davide Caffagni, Sara Sarto, Marcella Cornia, Lorenzo Baraldi, Rita Cucchiara |
| 2025 | MUSt3R: Multi-view Network for Stereo 3D Reconstruction. | Yohann Cabon, Lucas Stoffl, Leonid Antsfeld, Gabriela Csurka, Boris Chidlovskii, Jrme Revaud, Vincent Leroy |
| 2025 | Enhancing Facial Expression Recognition with LSTM through Dual-Direction Attention Mixed Feature Networks and CLIP. | Josep Cabacas-Maso, Elena Ortega-Beltrn, Ismael Benito-Altamirano, Carles Ventura |
| 2025 | MicroVQA: A Multimodal Reasoning Benchmark for Microscopy-Based Scientific Research. | James Burgess, Jeffrey J. Nirschl, Laura Bravo-Snchez, Alejandro Lozano, Sanket Rajan Gupte, Jesus G. Galaz-Montoya, Yuhui Zhang, Yuchang Su, Disha Bhowmik, Zachary Coman, Sarina M. Hasan, Alexandra Johannesson, William D. Leineweber, Malvika G. Nair, Ridhi Yarlagadda, Connor Zuraski, Wah Chiu, Sarah Cohen, Jan N. Hansen, Manuel D. Leonetti, Chad Liu, Emma Lundberg, Serena Yeung-Levy |
3,076–3,100 of 31,646← PreviousNext →
Comparable venues
Other A*/A conferences filed under the same field of research.