IEEE Conference on Computer Vision and Pattern Recognition
CVPR
A*
CORE rank
CORE rank (raw)
A*
Acceptance rate
23.6% (2024)
Fields of research
Computer Vision and Multimedia Computation
Papers indexed
31,646
1988–2025
Papers per year
19883,543 peak2025
Most published authors
CVPR papers
31,646 records sourced from DBLP. Search titles, filter by year, sort by recency.
| Year | Title | Authors |
|---|---|---|
| 2025 | RoadSocial: A Diverse VideoQA Dataset and Benchmark for Road Event Understanding from Social Video Narratives. | Chirag Parikh, Deepti Rawat, Rakshitha R. T, Tathagata Ghosh, Ravi Kiran Sarvadevabhatla |
| 2025 | MonoPlace3D: Learning 3D-Aware Object Placement for 3D Monocular Detection. | Rishubh Parihar, Srinjay Sarkar, Sarthak Vora, Jogendra Nath Kundu, R. Venkatesh Babu |
| 2025 | Compass Control: Multi Object Orientation Control for Text-to-Image Generation. | Rishubh Parihar, Vaibhav Agrawal, Sachidanand VS, Venkatesh Babu Radhakrishnan |
| 2025 | OmniManip: Towards General Robotic Manipulation via Object-Centric Interaction Primitives as Spatial Constraints. | Mingjie Pan, Jiyao Zhang, Tianshu Wu, Yinghao Zhao, Wenlong Gao, Hao Dong |
| 2025 | TokenHSI: Unified Synthesis of Physical Human-Scene Interactions through Task Tokenization. | Liang Pan, Zeshi Yang, Zhiyang Dou, Wenjia Wang, Buzhen Huang, Bo Dai, Taku Komura, Jingbo Wang |
| 2025 | Data-Free Group-Wise Fully Quantized Winograd Convolution via Learnable Scales. | Shuokai Pan, Gerti Tuzi, Sudarshan Sreeram, Dibakar Gope |
| 2025 | Generative Multimodal Pretraining with Discrete Diffusion Timestep Tokens. | Kaihang Pan, Wang Lin, Zhongqi Yue, Tenglong Ao, Liyu Jia, Wei Zhao, Juncheng Li, Siliang Tang, Hanwang Zhang |
| 2025 | Enhance Then Search: An Augmentation-Search Strategy with Foundation Models for Cross-Domain Few-Shot Object Detection. | Jiancheng Pan, Yanxing Liu, Xiao He, Long Peng, Jiahao Li, Yuze Sun, Xiaomeng Huang |
| 2025 | NLPrompt: Noise-Label Prompt Learning for Vision-Language Models. | Bikang Pan, Qun Li, Xiaoying Tang, Wei Huang, Zhen Fang, Feng Liu, Jingya Wang, Jingyi Yu, Ye Shi |
| 2025 | Transfer Your Perspective: Controllable 3D Generation from Any Viewpoint in a Driving Scene. | Tai-Yu Pan, Sooyoung Jeon, Mengdi Fan, Jinsu Yoo, Zhenyang Feng, Mark E. Campbell, Kilian Q. Weinberger, Bharath Hariharan, Wei-Lun Chao |
| 2025 | UMFN: Unified Multi-Domain Face Normalization for Joint Cross-domain Prototype Learning and Heterogeneous Face Recognition. | Meng Pang, Wenjun Zhang, Nanrun Zhou, Shengbo Chen, Hong Rao |
| 2025 | RandAR: Decoder-only Autoregressive Visual Generation in Random Orders. | Ziqi Pang, Tianyuan Zhang, Fujun Luan, Yunze Man, Hao Tan, Kai Zhang, William T. Freeman, Yu-Xiong Wang |
| 2025 | Identity-Clothing Similarity Modeling for Unsupervised Clothing Change Person Re-Identification. | Zhiqi Pang, Junjie Wang, Lingling Zhao, Chunyu Wang |
| 2025 | ManiVideo: Generating Hand-Object Manipulation Video with Dexterous and Generalizable Grasping. | Youxin Pang, Ruizhi Shao, Jiajun Zhang, Hanzhang Tu, Yun Liu, Boyao Zhou, Hongwen Zhang, Yebin Liu |
| 2025 | Context-Enhanced Memory-Refined Transformer for Online Action Detection. | Zhanzhong Pang, Fadime Sener, Angela Yao |
| 2025 | Disco4D: Disentangled 4D Human Generation and Animation from a Single Image. | Hui En Pang, Shuai Liu, Zhongang Cai, Lei Yang, Tianwei Zhang, Ziwei Liu |
| 2025 | Outlier-Robust Multi-Model Fitting on Quantum Annealers. | Saurabh Pandey, Luca Magri, Federica Arrigoni, Vladislav Golyanik |
| 2025 | Motion Modes: What Could Happen Next? | Karran Pandey, Yannick Hold-Geoffroy, Matheus Gadelha, Niloy J. Mitra, Karan Singh, Paul Guerrero |
| 2025 | ViUniT: Visual Unit Tests for More Robust Visual Programming. | Artemis Panagopoulou, Honglu Zhou, Silvio Savarese, Caiming Xiong, Chris Callison-Burch, Mark Yatskar, Juan Carlos Niebles |
| 2025 | Semantic and Sequential Alignment for Referring Video Object Segmentation. | Feiyu Pan, Hao Fang, Fangkai Li, Yanyu Xu, Yawei Li, Luca Benini, Xiankai Lu |
| 2025 | BASKET: A Large-Scale Video Dataset for Fine-Grained Skill Estimation. | Yulu Pan, Ce Zhang, Gedas Bertasius |
| 2025 | SyncVP: Joint Diffusion for Synchronous Multi-Modal Video Prediction. | Enrico Pallotta, Sina Mokhtarzadeh Azar, Shuai Li, Olga Zatsarynna, Juergen Gall |
| 2025 | GLane3D: Detecting Lanes with Graph of 3D Keypoints. | Halil Ibrahim ztrk, Muhammet Esat Kalfaoglu, Ozsel Kilinc |
| 2025 | MM-OR: A Large Multimodal Operating Room Dataset for Semantic Understanding of High-Intensity Surgical Environments. | Ege zsoy, Chantal Pellegrini, Tobias Czempiel, Felix Tristram, Kun Yuan, David Bani-Harouni, Ulrich Eck, Benjamin Busam, Matthias Keicher, Nassir Navab |
| 2025 | Location-Free Scene Graph Generation. | Ege zsoy, Felix Holm, Chantal Pellegrini, Tobias Czempiel, Mahdi Saleh, Nassir Navab, Benjamin Busam |
1,451–1,475 of 31,646← PreviousNext →
Comparable venues
Other A*/A conferences filed under the same field of research.