Skip to content

IEEE Conference on Computer Vision and Pattern Recognition

CVPR

A*

CORE rank

CORE rank (raw)

A*

Acceptance rate

23.6% (2024)

Fields of research

Computer Vision and Multimedia Computation

Papers indexed

31,646

1988–2025

Papers per year

19883,543 peak2025

CVPR papers

31,646 records sourced from DBLP. Search titles, filter by year, sort by recency.

YearTitleAuthors
2025RoadSocial: A Diverse VideoQA Dataset and Benchmark for Road Event Understanding from Social Video Narratives.Chirag Parikh, Deepti Rawat, Rakshitha R. T, Tathagata Ghosh, Ravi Kiran Sarvadevabhatla
2025MonoPlace3D: Learning 3D-Aware Object Placement for 3D Monocular Detection.Rishubh Parihar, Srinjay Sarkar, Sarthak Vora, Jogendra Nath Kundu, R. Venkatesh Babu
2025Compass Control: Multi Object Orientation Control for Text-to-Image Generation.Rishubh Parihar, Vaibhav Agrawal, Sachidanand VS, Venkatesh Babu Radhakrishnan
2025OmniManip: Towards General Robotic Manipulation via Object-Centric Interaction Primitives as Spatial Constraints.Mingjie Pan, Jiyao Zhang, Tianshu Wu, Yinghao Zhao, Wenlong Gao, Hao Dong
2025TokenHSI: Unified Synthesis of Physical Human-Scene Interactions through Task Tokenization.Liang Pan, Zeshi Yang, Zhiyang Dou, Wenjia Wang, Buzhen Huang, Bo Dai, Taku Komura, Jingbo Wang
2025Data-Free Group-Wise Fully Quantized Winograd Convolution via Learnable Scales.Shuokai Pan, Gerti Tuzi, Sudarshan Sreeram, Dibakar Gope
2025Generative Multimodal Pretraining with Discrete Diffusion Timestep Tokens.Kaihang Pan, Wang Lin, Zhongqi Yue, Tenglong Ao, Liyu Jia, Wei Zhao, Juncheng Li, Siliang Tang, Hanwang Zhang
2025Enhance Then Search: An Augmentation-Search Strategy with Foundation Models for Cross-Domain Few-Shot Object Detection.Jiancheng Pan, Yanxing Liu, Xiao He, Long Peng, Jiahao Li, Yuze Sun, Xiaomeng Huang
2025NLPrompt: Noise-Label Prompt Learning for Vision-Language Models.Bikang Pan, Qun Li, Xiaoying Tang, Wei Huang, Zhen Fang, Feng Liu, Jingya Wang, Jingyi Yu, Ye Shi
2025Transfer Your Perspective: Controllable 3D Generation from Any Viewpoint in a Driving Scene.Tai-Yu Pan, Sooyoung Jeon, Mengdi Fan, Jinsu Yoo, Zhenyang Feng, Mark E. Campbell, Kilian Q. Weinberger, Bharath Hariharan, Wei-Lun Chao
2025UMFN: Unified Multi-Domain Face Normalization for Joint Cross-domain Prototype Learning and Heterogeneous Face Recognition.Meng Pang, Wenjun Zhang, Nanrun Zhou, Shengbo Chen, Hong Rao
2025RandAR: Decoder-only Autoregressive Visual Generation in Random Orders.Ziqi Pang, Tianyuan Zhang, Fujun Luan, Yunze Man, Hao Tan, Kai Zhang, William T. Freeman, Yu-Xiong Wang
2025Identity-Clothing Similarity Modeling for Unsupervised Clothing Change Person Re-Identification.Zhiqi Pang, Junjie Wang, Lingling Zhao, Chunyu Wang
2025ManiVideo: Generating Hand-Object Manipulation Video with Dexterous and Generalizable Grasping.Youxin Pang, Ruizhi Shao, Jiajun Zhang, Hanzhang Tu, Yun Liu, Boyao Zhou, Hongwen Zhang, Yebin Liu
2025Context-Enhanced Memory-Refined Transformer for Online Action Detection.Zhanzhong Pang, Fadime Sener, Angela Yao
2025Disco4D: Disentangled 4D Human Generation and Animation from a Single Image.Hui En Pang, Shuai Liu, Zhongang Cai, Lei Yang, Tianwei Zhang, Ziwei Liu
2025Outlier-Robust Multi-Model Fitting on Quantum Annealers.Saurabh Pandey, Luca Magri, Federica Arrigoni, Vladislav Golyanik
2025Motion Modes: What Could Happen Next?Karran Pandey, Yannick Hold-Geoffroy, Matheus Gadelha, Niloy J. Mitra, Karan Singh, Paul Guerrero
2025ViUniT: Visual Unit Tests for More Robust Visual Programming.Artemis Panagopoulou, Honglu Zhou, Silvio Savarese, Caiming Xiong, Chris Callison-Burch, Mark Yatskar, Juan Carlos Niebles
2025Semantic and Sequential Alignment for Referring Video Object Segmentation.Feiyu Pan, Hao Fang, Fangkai Li, Yanyu Xu, Yawei Li, Luca Benini, Xiankai Lu
2025BASKET: A Large-Scale Video Dataset for Fine-Grained Skill Estimation.Yulu Pan, Ce Zhang, Gedas Bertasius
2025SyncVP: Joint Diffusion for Synchronous Multi-Modal Video Prediction.Enrico Pallotta, Sina Mokhtarzadeh Azar, Shuai Li, Olga Zatsarynna, Juergen Gall
2025GLane3D: Detecting Lanes with Graph of 3D Keypoints.Halil Ibrahim ztrk, Muhammet Esat Kalfaoglu, Ozsel Kilinc
2025MM-OR: A Large Multimodal Operating Room Dataset for Semantic Understanding of High-Intensity Surgical Environments.Ege zsoy, Chantal Pellegrini, Tobias Czempiel, Felix Tristram, Kun Yuan, David Bani-Harouni, Ulrich Eck, Benjamin Busam, Matthias Keicher, Nassir Navab
2025Location-Free Scene Graph Generation.Ege zsoy, Felix Holm, Chantal Pellegrini, Tobias Czempiel, Mahdi Saleh, Nassir Navab, Benjamin Busam
1,4511,475 of 31,646← PreviousNext →

Comparable venues

Other A*/A conferences filed under the same field of research.