IEEE Conference on Computer Vision and Pattern Recognition
CVPR
A*
CORE rank
CORE rank (raw)
A*
Acceptance rate
23.6% (2024)
Fields of research
Computer Vision and Multimedia Computation
Papers indexed
31,646
1988–2025
Papers per year
19883,543 peak2025
Most published authors
CVPR papers
31,646 records sourced from DBLP. Search titles, filter by year, sort by recency.
| Year | Title | Authors |
|---|---|---|
| 2025 | Learning to Highlight Audio by Watching Movies. | Chao Huang, Ruohan Gao, J. M. F. Tsang, Jan Kurcius, Cagdas Bilen, Chenliang Xu, Anurag Kumar, Sanjeel Parekh |
| 2025 | MIDI: Multi-Instance Diffusion for Single Image to 3D Scene Generation. | Zehuan Huang, Yuan-Chen Guo, Xingqiao An, Yunhan Yang, Yangguang Li, Zi-Xin Zou, Ding Liang, Xihui Liu, Yan-Pei Cao, Lu Sheng |
| 2025 | Decision SpikeFormer: Spike-Driven Transformer for Decision Making. | Wei Huang, Qinying Gu, Nanyang Ye |
| 2025 | HiRes-LLaVA: Restoring Fragmentation Input in High-Resolution Large Vision-Language Models. | Runhui Huang, Xinpeng Ding, Chunwei Wang, Jianhua Han, Yulong Liu, Hengshuang Zhao, Hang Xu, Lu Hou, Wei Zhang, Xiaodan Liang |
| 2025 | IncEventGS: Pose-Free Gaussian Splatting from a Single Event Camera. | Jian Huang, Chengrui Dong, Xuanhua Chen, Peidong Liu |
| 2025 | 3D Gaussian Inpainting with Depth-Guided Cross-View Consistency. | Sheng-Yu Huang, Zi-Ting Chou, Yu-Chiang Frank Wang |
| 2025 | Trajectory Mamba: Efficient Attention-Mamba Forecasting Model Based on Selective SSM. | Yizhou Huang, Yihua Cheng, Kezhi Wang |
| 2025 | HOIGPT: Learning Long-Sequence Hand-Object Interaction with Language Models. | Mingzhen Huang, Fu-Jen Chu, Bugra Tekin, Kevin J. Liang, Haoyu Ma, Weiyao Wang, Xingyu Chen, Pierre Gleize, Hongfei Xue, Siwei Lyu, Kris Kitani, Matt Feiszli, Hao Tang |
| 2025 | A General Adaptive Dual-level Weighting Mechanism for Remote Sensing Pansharpening. | Jie Huang, Haorui Chen, Jiaxuan Ren, Siran Peng, Liangjian Deng |
| 2025 | SpiritSight Agent: Advanced GUI Agent with One Look. | Zhiyuan Huang, Ziming Cheng, Junting Pan, Zhaohui Hou, Mingjie Zhan |
| 2025 | PatchDPO: Patch-level DPO for Finetuning-free Personalized Image Generation. | Qihan Huang, Long Chan, Jinlong Liu, Wanggui He, Hao Jiang, Mingli Song, Jie Song |
| 2025 | IM-Zero: Instance-level Motion Controllable Video Generation in a Zero-shot Manner. | Yuyang Huang, Yabo Chen, Li Ding, Xiaopeng Zhang, Wenrui Dai, Junni Zou, Hongkai Xiong, Qi Tian |
| 2025 | Zero-shot 3D Question Answering via Voxel-based Dynamic Token Compression. | Hsiang-Wei Huang, Fu-Chen Chen, Wenhao Chai, Che-Chun Su, Lu Xia, Sanghun Jung, Cheng-Yen Yang, Jenq-Neng Hwang, Min Sun, Cheng-Hao Kuo |
| 2025 | RoboGround: Robotic Manipulation with Grounded Vision-Language Priors. | Haifeng Huang, Xinyi Chen, Yilun Chen, Hao Li, Xiaoshen Han, Zehan Wang, Tai Wang, Jiangmiao Pang, Zhou Zhao |
| 2025 | SPAR3D: Stable Point-Aware Reconstruction of 3D Objects from Single Images. | Zixuan Huang, Mark Boss, Aaryaman Vasishta, James M. Rehg, Varun Jampani |
| 2025 | FirePlace: Geometric Refinements of LLM Common Sense Reasoning for 3D Object Placement. | Ian Huang, Yanan Bao, Karen Truong, Howard Zhou, Cordelia Schmid, Leonidas J. Guibas, Alireza Fathi |
| 2025 | GIVEPose: Gradual Intra-class Variation Elimination for RGB-based Category-Level Object Pose Estimation. | Ziqin Huang, Gu Wang, Chenyangguang Zhang, Ruida Zhang, Xiu Li, Xiangyang Ji |
| 2025 | Navigating the Unseen: Zero-shot Scene Graph Generation via Capsule-Based Equivariant Features. | Wenhuan Huang, Yi Ji, Guiqian Zhu, Li Ying, Chunping Liu |
| 2025 | Reconstructing Close Human Interaction with Appearance and Proxemics Reasoning. | Buzhen Huang, Chen Li, Chongyang Xu, Dongyue Lu, Jinnan Chen, Yangang Wang, Gim Hee Lee |
| 2025 | Sound Bridge: Associating Egocentric and Exocentric Videos via Audio Cues. | Sihong Huang, Jiaxin Wu, Xiaoyong Wei, Yi Cai, Dongmei Jiang, Yaowei Wang |
| 2025 | FINECAPTION: Compositional Image Captioning Focusing on Wherever You Want at Any Granularity. | Hang Hua, Qing Liu, Lingzhi Zhang, Jing Shi, Soo Ye Kim, Zhifei Zhang, Yilin Wang, Jianming Zhang, Zhe Lin, Jiebo Luo |
| 2025 | CL-MoE: Enhancing Multimodal Large Language Model with Dual Momentum Mixture-of-Experts for Continual Visual Question Answering. | Tianyu Huai, Jie Zhou, Xingjiao Wu, Qin Chen, Qingchun Bai, Ze Zhou, Liang He |
| 2025 | PosterO: Structuring Layout Trees to Enable Language Models in Generalized Content-Aware Layout Generation. | HsiaoYuan Hsu, Yuxin Peng |
| 2025 | Syn3DTxt: Embedding 3D Cues for Scene Text Generation. | Li-Syun Hsiung, Jun-Kai Tu, Kuan-Wu Chu, Yu-Hsuan Chiu, Yan-Tsung Peng, Sheng-Luen Chung, Gee-Sern Hsu |
| 2025 | DeDe: Detecting Backdoor Samples for SSL Encoders via Decoders. | Sizai Hou, Songze Li, Duanyi Yao |
2,426–2,450 of 31,646← PreviousNext →
Comparable venues
Other A*/A conferences filed under the same field of research.