Skip to content

Yongming Rao

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

44

Venues

9

Active years

2017–2026

Best venue rank

A*

Where they publish

Papers

44 indexed papers, newest first.

YearVenueTitleAuthors
2026WACVBREEN: Bridge Data-Efficient Encoder-Free Multimodal Learning with Learnable Queries.Tianle Li, Yongming Rao, Winston Hu, Yu Cheng
2025CVPRInsight-V: Exploring Long-Chain Visual Reasoning with Multimodal Large Language Models.Yuhao Dong, Zuyan Liu, Hai-Long Sun, Jingkang Yang, Winston Hu, Yongming Rao, Ziwei Liu
2025CVPRCoarse Correspondences Boost Spatial-Temporal Reasoning in Multimodal Language Model.Benlin Liu, Yuhao Dong, Yiqin Wang, Zixian Ma, Yansong Tang, Luming Tang, Yongming Rao, Wei-Chiu Ma, Ranjay Krishna
2025ICCVSparseMM: Head Sparsity Emerges from Visual Concept Responses in MLLMs.Jiahui Wang, Zuyan Liu, Yongming Rao, Jiwen Lu
2025ICLROryx MLLM: On-Demand Spatial-Temporal Understanding at Arbitrary Resolution.Zuyan Liu, Yuhao Dong, Ziwei Liu, Winston Hu, Jiwen Lu, Yongming Rao
2025ICMLRBench: Graduate-level Multi-disciplinary Benchmarks for LLM & MLLM Complex Reasoning Evaluation.Meng-Hao Guo, Jiajun Xu, Yi Zhang, Jiaxi Song, Haoyang Peng, Yi-Xuan Deng, Xinzhi Dong, Kiyohiro Nakayama, Zhengyang Geng, Chen Wang, Bolin Ni, Guo-Wei Yang, Yongming Rao, Houwen Peng, Han Hu, Gordon Wetzstein, Shimin Hu
2024CVPRSherpa3D: Boosting High-Fidelity Text-to-3D Generation via Coarse 3D Prior.Fangfu Liu, Diankun Wu, Yi Wei, Yongming Rao, Yueqi Duan
2024CVPRGenerative Multimodal Models are In-Context Learners.Quan Sun, Yufeng Cui, Xiaosong Zhang, Fan Zhang, Qiying Yu, Yueze Wang, Yongming Rao, Jingjing Liu, Tiejun Huang, Xinlong Wang
2024CVPRX-3D: Explicit 3D Structure Modeling for Point Cloud Recognition.Shuofeng Sun, Yongming Rao, Jiwen Lu, Haibin Yan
2024ECCVEfficient Inference of Vision Instruction-Following Models with Elastic Cache.Zuyan Liu, Benlin Liu, Jiahui Wang, Yuhao Dong, Guangyi Chen, Yongming Rao, Ranjay Krishna, Jiwen Lu
2023CVPRFLAG3D: A 3D Fitness Activity Dataset with Language Instruction.Yansong Tang, Jinpeng Liu, Aoyang Liu, Bin Yang, Wenxun Dai, Yongming Rao, Jiwen Lu, Jie Zhou, Xiu Li
2023CVPRDiffSwap: High-Fidelity and Controllable Face Swapping via 3D-Aware Masked Diffusion.Wenliang Zhao, Yongming Rao, Weikang Shi, Zuyan Liu, Jie Zhou, Jiwen Lu
2023ICCVTake-A-Photo: 3D-to-2D Generative Pre-training of Point Cloud Models.Ziyi Wang, Xumin Yu, Yongming Rao, Jie Zhou, Jiwen Lu
2023ICCVTCOVIS: Temporally Consistent Online Video Instance Segmentation.Junlong Li, Bingyao Yu, Yongming Rao, Jie Zhou, Jiwen Lu
2023ICCVUnleashing Text-to-Image Diffusion Models for Visual Perception.Wenliang Zhao, Yongming Rao, Zuyan Liu, Benlin Liu, Jie Zhou, Jiwen Lu
2023ICLRPLOT: Prompt Learning with Optimal Transport for Vision-Language Models.Guangyi Chen, Weiran Yao, Xiangchen Song, Xinyue Li, Yongming Rao, Kun Zhang
2022CoRLSurroundDepth: Entangling Surrounding Views for Self-Supervised Multi-Camera Depth Estimation.Yi Wei, Linqing Zhao, Wenzhao Zheng, Zheng Zhu, Yongming Rao, Guan Huang, Jiwen Lu, Jie Zhou
2022CVPRStochastic Trajectory Prediction via Motion Indeterminacy Diffusion.Tianpei Gu, Guangyi Chen, Junlong Li, Chunze Lin, Yongming Rao, Jie Zhou, Jiwen Lu
2022CVPRDenseCLIP: Language-Guided Dense Prediction with Context-Aware Prompting.Yongming Rao, Wenliang Zhao, Guangyi Chen, Yansong Tang, Zheng Zhu, Guan Huang, Jie Zhou, Jiwen Lu
2022CVPRSemAffiNet: Semantic-Affine Transformation for Point Cloud Segmentation.Ziyi Wang, Yongming Rao, Xumin Yu, Jie Zhou, Jiwen Lu
2022CVPRFineDiving: A Fine-grained Dataset for Procedure-aware Action Quality Assessment.Jinglin Xu, Yongming Rao, Xumin Yu, Guangyi Chen, Jie Zhou, Jiwen Lu
2022CVPRBack to Reality: Weakly-supervised 3D Object Detection with Shape-guided Label Enhancement.Xiuwei Xu, Yifan Wang, Yu Zheng, Yongming Rao, Jie Zhou, Jiwen Lu
2022CVPRPoint-BERT: Pre-training 3D Point Cloud Transformers with Masked Point Modeling.Xumin Yu, Lulu Tang, Yongming Rao, Tiejun Huang, Jie Zhou, Jiwen Lu
2022ECCVAMixer: Adaptive Weight Mixing for Self-attention Free Vision Transformers.Yongming Rao, Wenliang Zhao, Jie Zhou, Jiwen Lu
2022ECCVLiDAR Distillation: Bridging the Beam-Induced Domain Gap for 3D Object Detection.Yi Wei, Zibu Wei, Yongming Rao, Jiaxin Li, Jie Zhou, Jiwen Lu
2021AAAIMulti-Proxy Wasserstein Classifier for Image Classification.Benlin Liu, Yongming Rao, Jiwen Lu, Jie Zhou, Cho-Jui Hsieh
2021CVPRPV-RAFT: Point-Voxel Correlation Fields for Scene Flow Estimation of Point Clouds.Yi Wei, Ziyi Wang, Yongming Rao, Jiwen Lu, Jie Zhou
2021ICCVCounterfactual Attention Learning for Fine-Grained Visual Categorization and Re-identification.Yongming Rao, Guangyi Chen, Jiwen Lu, Jie Zhou
2021ICCVRandomRooms: Unsupervised Pre-training from Synthetic Shapes and Randomized Layouts for 3D Object Detection.Yongming Rao, Benlin Liu, Yi Wei, Jiwen Lu, Cho-Jui Hsieh, Jie Zhou
2021ICCVNerfingMVS: Guided Optimization of Neural Radiance Fields for Indoor Multi-view Stereo.Yi Wei, Shaohui Liu, Yongming Rao, Wang Zhao, Jiwen Lu, Jie Zhou
2021ICCVPoinTr: Diverse Point Cloud Completion with Geometry-Aware Transformers.Xumin Yu, Yongming Rao, Ziyi Wang, Zuyan Liu, Jiwen Lu, Jie Zhou
2021ICCVGroup-aware Contrastive Regression for Action Quality Assessment.Xumin Yu, Yongming Rao, Wenliang Zhao, Jiwen Lu, Jie Zhou
2021ICCVTowards Interpretable Deep Metric Learning with Structural Matching.Wenliang Zhao, Yongming Rao, Ziyi Wang, Jiwen Lu, Jie Zhou
2020CVPRDeep Face Super-Resolution With Iterative Collaboration Between Attentive Recovery and Landmark Estimation.Cheng Ma, Zhenyu Jiang, Yongming Rao, Jiwen Lu, Jie Zhou
2020CVPRStructure-Preserving Super Resolution With Gradient Guidance.Cheng Ma, Yongming Rao, Yean Cheng, Ce Chen, Jiwen Lu, Jie Zhou
2020CVPRGlobal-Local Bidirectional Reasoning for Unsupervised Representation Learning of 3D Point Clouds.Yongming Rao, Jiwen Lu, Jie Zhou
2020ECCVTemporal Coherence or Temporal Motion: Which Is More Critical for Video-Based Person Re-identification?Guangyi Chen, Yongming Rao, Jiwen Lu, Jie Zhou
2020ECCVMetaDistiller: Network Self-Boosting via Meta-Learned Top-Down Distillation.Benlin Liu, Yongming Rao, Jiwen Lu, Jie Zhou, Cho-Jui Hsieh
2019CVPRSpherical Fractal Convolutional Neural Networks for Point Cloud Recognition.Yongming Rao, Jiwen Lu, Jie Zhou
2019CVPRCOIN: A Large-Scale Dataset for Comprehensive Instructional Video Analysis.Yansong Tang, Dajun Ding, Yongming Rao, Yu Zheng, Danyang Zhang, Lili Zhao, Jiwen Lu, Jie Zhou
2018CVPRLearning Globally Optimized Object Detector via Policy Gradient.Yongming Rao, Dahua Lin, Jiwen Lu, Jie Zhou
2017ICCVAttention-Aware Deep Reinforcement Learning for Video Face Recognition.Yongming Rao, Jiwen Lu, Jie Zhou
2017ICCVLearning Discriminative Aggregation Network for Video-Based Face Recognition.Yongming Rao, Ji Lin, Jiwen Lu, Jie Zhou
2017ICDEV-Tree: Efficient kNN Search on Moving Objects with Road-Network Constraints.Bilong Shen, Ying Zhao, Guoliang Li, Weimin Zheng, Yue Qin, Bo Yuan, Yongming Rao