IEEE Conference on Computer Vision and Pattern Recognition
CVPR
A*
CORE rank
CORE rank (raw)
A*
Acceptance rate
23.6% (2024)
Fields of research
Computer Vision and Multimedia Computation
Papers indexed
31,646
1988–2025
Papers per year
19883,543 peak2025
Most published authors
CVPR papers
31,646 records sourced from DBLP. Search titles, filter by year, sort by recency.
| Year | Title | Authors |
|---|---|---|
| 2025 | Geometry-guided Online 3D Video Synthesis with Multi-View Temporal Consistency. | Hyunho Ha, Lei Xiao, Christian Richardt, Thu Nguyen-Phuoc, Changil Kim, Min H. Kim, Douglas Lanman, Numair Khan |
| 2025 | MambaVision: A Hybrid Mamba-Transformer Vision Backbone. | Ali Hatamizadeh, Jan Kautz |
| 2025 | GEM: A Generalizable Ego-Vision Multimodal World Model for Fine-Grained Ego-Motion, Object Dynamics, and Scene Composition Control. | Mariam Hassan, Sebastian Stapf, Ahmad Rahimi, Pedro M. B. Rezende, Yasaman Haghighi, David Brggemann, Isinsu Katircioglu, Lin Zhang, Xiaoran Chen, Suman Saha, Marco Cannici, Elie Aljalbout, Botao Ye, Xi Wang, Aram Davtyan, Mathieu Salzmann, Davide Scaramuzza, Marc Pollefeys, Paolo Favaro, Alexandre Alahi |
| 2025 | Improved Monocular Depth Prediction Using Distance Transform Over Pre-semantic Contours with Self-supervised Neural Networks. | Marwane Hariat, Antoine Manzanera, David Filliat |
| 2025 | FedCS: Coreset Selection for Federated Learning. | Chenhe Hao, Weiying Xie, Daixun Li, Haonan Qin, Hangyu Ye, Leyuan Fang, Yunsong Li |
| 2025 | Neural Motion Simulator Pushing the Limit of World Models in Reinforcement Learning. | Chenjie Hao, Weyl Lu, Yifan Xu, Yubei Chen |
| 2025 | Task-Aware Clustering for Prompting Vision-Language Models. | Fusheng Hao, Fengxiang He, Fuxiang Wu, Tichao Wang, Chengqun Song, Jun Cheng |
| 2025 | Exploring Visual Vulnerabilities via Multi-Loss Adversarial Search for Jailbreaking Vision-Language Models. | Shuyang Hao, Bryan Hooi, Jun Liu, Kai-Wei Chang, Zi Huang, Yujun Cai |
| 2025 | GroundingFace: Fine-grained Face Understanding via Pixel Grounding Multimodal Large Language Model. | Yue Han, Jiangning Zhang, Junwei Zhu, Runze Hou, Xiaozhong Ji, Chuming Lin, Xiaobin Hu, Zhucun Xue, Yong Liu |
| 2025 | UIBDiffusion: Universal Imperceptible Backdoor Attack for Diffusion Models. | Yuning Han, Bingyin Zhao, Rui Chu, Feng Luo, Biplab Sikdar, Yingjie Lao |
| 2025 | FineCausal: A Causal-Based Framework for Interpretable Fine-Grained Action Quality Assessment. | Ruisheng Han, Kanglei Zhou, Amir Atapour-Abarghouei, Xiaohui Liang, Hubert P. H. Shum |
| 2025 | AToM: Aligning Text-to-Motion Model at Event-Level with GPT-4Vision Reward. | Haonan Han, Xiangzuo Wu, Huan Liao, Zunnan Xu, Zhongyuan Hu, Ronghui Li, Yachao Zhang, Xiu Li |
| 2025 | MoST: Efficient Monarch Sparse Tuning for 3D Representation Learning. | Xu Han, Yuan Tang, Jinfeng Xu, Xianzhi Li |
| 2025 | GliaNet: Adaptive Neural Network Structure Learning with Glia-Driven. | Mengqiao Han, Liyuan Pan, Xiabi Liu |
| 2025 | ReVisionLLM: Recursive Vision-Language Model for Temporal Grounding in Hour-Long Videos. | Tanveer Hannan, Md Mohaiminul Islam, Jindong Gu, Thomas Seidl, Gedas Bertasius |
| 2025 | Foundation Models for Remote Sensing: An Analysis of MLLMs for Object Localization. | Darryl Hannan, John Cooper, Dylan White, Timothy Doster, Henry Kvinge, Yijing Watkins |
| 2025 | Video-Bench: Human-Aligned Video Generation Benchmark. | Hui Han, Siyuan Li, Jiaqi Chen, Yiwen Yuan, Yuling Wu, Yufan Deng, Chak Tou Leong, Hanwen Du, Junchen Fu, Youhua Li, Jie Zhang, Chi Zhang, Li-jia Li, Yongxin Ni |
| 2025 | Towards Lossless Implicit Neural Representation via Bit Plane Decomposition. | Woo Kyoung Han, Byeonghun Lee, Hyunmin Cho, Sunghoon Im, Kyong Hwan Jin |
| 2025 | Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis. | Jian Han, Jinlai Liu, Yi Jiang, Bin Yan, Yuqi Zhang, Zehuan Yuan, Bingyue Peng, Xiaobing Liu |
| 2025 | Spatial Transport Optimization by Repositioning Attention Map for Training-Free Text-to-Image Synthesis. | Woojung Han, Yeonkyung Lee, Chanyoung Kim, Kwanghyun Park, Seong Jae Hwang |
| 2025 | Enhancing Creative Generation on Stable Diffusion-based Models. | Jiyeon Han, Dahee Kwon, Gayoung Lee, Junho Kim, Jaesik Choi |
| 2025 | VideoEspresso: A Large-Scale Chain-of-Thought Dataset for Fine-Grained Video Reasoning via Core Frame Selection. | Songhao Han, Wei Huang, Hairong Shi, Le Zhuo, Xiu Su, Shifeng Zhang, Xu Zhou, Xiaojuan Qi, Yue Liao, Si Liu |
| 2025 | Towards More General Video-based Deepfake Detection through Facial Component Guided Adaptation for Foundation Model. | Yue-Hua Han, Tai-Ming Huang, Kai-Lung Hua, Jun-Cheng Chen |
| 2025 | DynFocus: Dynamic Cooperative Network Empowers LLMs with Video Understanding. | Yudong Han, Qingpei Guo, Liyuan Pan, Liu Liu, Yu Guan, Ming Yang |
| 2025 | Learning from Streaming Video with Orthogonal Gradients. | Tengda Han, Dilara Gokay, Joseph Heyward, Chuhan Zhang, Daniel Zoran, Viorica Patraucean, Joo Carreira, Dima Damen, Andrew Zisserman |
2,501–2,525 of 31,646← PreviousNext →
Comparable venues
Other A*/A conferences filed under the same field of research.