Skip to content

IEEE Conference on Computer Vision and Pattern Recognition

CVPR

A*

CORE rank

CORE rank (raw)

A*

Acceptance rate

23.6% (2024)

Fields of research

Computer Vision and Multimedia Computation

Papers indexed

31,646

1988–2025

Papers per year

19883,543 peak2025

CVPR papers

31,646 records sourced from DBLP. Search titles, filter by year, sort by recency.

YearTitleAuthors
2025Learning to Highlight Audio by Watching Movies.Chao Huang, Ruohan Gao, J. M. F. Tsang, Jan Kurcius, Cagdas Bilen, Chenliang Xu, Anurag Kumar, Sanjeel Parekh
2025MIDI: Multi-Instance Diffusion for Single Image to 3D Scene Generation.Zehuan Huang, Yuan-Chen Guo, Xingqiao An, Yunhan Yang, Yangguang Li, Zi-Xin Zou, Ding Liang, Xihui Liu, Yan-Pei Cao, Lu Sheng
2025Decision SpikeFormer: Spike-Driven Transformer for Decision Making.Wei Huang, Qinying Gu, Nanyang Ye
2025HiRes-LLaVA: Restoring Fragmentation Input in High-Resolution Large Vision-Language Models.Runhui Huang, Xinpeng Ding, Chunwei Wang, Jianhua Han, Yulong Liu, Hengshuang Zhao, Hang Xu, Lu Hou, Wei Zhang, Xiaodan Liang
2025IncEventGS: Pose-Free Gaussian Splatting from a Single Event Camera.Jian Huang, Chengrui Dong, Xuanhua Chen, Peidong Liu
20253D Gaussian Inpainting with Depth-Guided Cross-View Consistency.Sheng-Yu Huang, Zi-Ting Chou, Yu-Chiang Frank Wang
2025Trajectory Mamba: Efficient Attention-Mamba Forecasting Model Based on Selective SSM.Yizhou Huang, Yihua Cheng, Kezhi Wang
2025HOIGPT: Learning Long-Sequence Hand-Object Interaction with Language Models.Mingzhen Huang, Fu-Jen Chu, Bugra Tekin, Kevin J. Liang, Haoyu Ma, Weiyao Wang, Xingyu Chen, Pierre Gleize, Hongfei Xue, Siwei Lyu, Kris Kitani, Matt Feiszli, Hao Tang
2025A General Adaptive Dual-level Weighting Mechanism for Remote Sensing Pansharpening.Jie Huang, Haorui Chen, Jiaxuan Ren, Siran Peng, Liangjian Deng
2025SpiritSight Agent: Advanced GUI Agent with One Look.Zhiyuan Huang, Ziming Cheng, Junting Pan, Zhaohui Hou, Mingjie Zhan
2025PatchDPO: Patch-level DPO for Finetuning-free Personalized Image Generation.Qihan Huang, Long Chan, Jinlong Liu, Wanggui He, Hao Jiang, Mingli Song, Jie Song
2025IM-Zero: Instance-level Motion Controllable Video Generation in a Zero-shot Manner.Yuyang Huang, Yabo Chen, Li Ding, Xiaopeng Zhang, Wenrui Dai, Junni Zou, Hongkai Xiong, Qi Tian
2025Zero-shot 3D Question Answering via Voxel-based Dynamic Token Compression.Hsiang-Wei Huang, Fu-Chen Chen, Wenhao Chai, Che-Chun Su, Lu Xia, Sanghun Jung, Cheng-Yen Yang, Jenq-Neng Hwang, Min Sun, Cheng-Hao Kuo
2025RoboGround: Robotic Manipulation with Grounded Vision-Language Priors.Haifeng Huang, Xinyi Chen, Yilun Chen, Hao Li, Xiaoshen Han, Zehan Wang, Tai Wang, Jiangmiao Pang, Zhou Zhao
2025SPAR3D: Stable Point-Aware Reconstruction of 3D Objects from Single Images.Zixuan Huang, Mark Boss, Aaryaman Vasishta, James M. Rehg, Varun Jampani
2025FirePlace: Geometric Refinements of LLM Common Sense Reasoning for 3D Object Placement.Ian Huang, Yanan Bao, Karen Truong, Howard Zhou, Cordelia Schmid, Leonidas J. Guibas, Alireza Fathi
2025GIVEPose: Gradual Intra-class Variation Elimination for RGB-based Category-Level Object Pose Estimation.Ziqin Huang, Gu Wang, Chenyangguang Zhang, Ruida Zhang, Xiu Li, Xiangyang Ji
2025Navigating the Unseen: Zero-shot Scene Graph Generation via Capsule-Based Equivariant Features.Wenhuan Huang, Yi Ji, Guiqian Zhu, Li Ying, Chunping Liu
2025Reconstructing Close Human Interaction with Appearance and Proxemics Reasoning.Buzhen Huang, Chen Li, Chongyang Xu, Dongyue Lu, Jinnan Chen, Yangang Wang, Gim Hee Lee
2025Sound Bridge: Associating Egocentric and Exocentric Videos via Audio Cues.Sihong Huang, Jiaxin Wu, Xiaoyong Wei, Yi Cai, Dongmei Jiang, Yaowei Wang
2025FINECAPTION: Compositional Image Captioning Focusing on Wherever You Want at Any Granularity.Hang Hua, Qing Liu, Lingzhi Zhang, Jing Shi, Soo Ye Kim, Zhifei Zhang, Yilin Wang, Jianming Zhang, Zhe Lin, Jiebo Luo
2025CL-MoE: Enhancing Multimodal Large Language Model with Dual Momentum Mixture-of-Experts for Continual Visual Question Answering.Tianyu Huai, Jie Zhou, Xingjiao Wu, Qin Chen, Qingchun Bai, Ze Zhou, Liang He
2025PosterO: Structuring Layout Trees to Enable Language Models in Generalized Content-Aware Layout Generation.HsiaoYuan Hsu, Yuxin Peng
2025Syn3DTxt: Embedding 3D Cues for Scene Text Generation.Li-Syun Hsiung, Jun-Kai Tu, Kuan-Wu Chu, Yu-Hsuan Chiu, Yan-Tsung Peng, Sheng-Luen Chung, Gee-Sern Hsu
2025DeDe: Detecting Backdoor Samples for SSL Encoders via Decoders.Sizai Hou, Songze Li, Duanyi Yao
2,4262,450 of 31,646← PreviousNext →

Comparable venues

Other A*/A conferences filed under the same field of research.