Skip to content

Renrui Zhang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

64

Venues

15

Active years

2021–2026

Best venue rank

A*

Where they publish

Papers

64 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAINL2CA: Auto-formalizing Cognitive Decision-Making from Natural Language Using an Unsupervised CriticNL2LTL Framework.Zihao Deng, Yijia Li, Renrui Zhang, Peijun Ye
2026AAAITIDE: Temporal-Aware Sparse Autoencoders for Interpretable Diffusion Transformers in Image Generation.Victor Shea-Jay Huang, Le Zhuo, Yi Xin, Zhaokai Wang, Fu-Yun Wang, Yuchi Wang, Renrui Zhang, Peng Gao, Hongsheng Li
2026WACVPiSA: A Self-Augmented Data Engine and Training Strategy for 3D Understanding with Large Models.Zilu Guo, Hongbin Lin, Zhihao Yuan, Chaoda Zheng, Pengshuo Qiu, Dongzhi Jiang, Renrui Zhang, Chun-Mei Feng, Zhen Li
2025AAAIMM-Mixing: Multi-Modal Mixing Alignment for 3D Understanding.Jiaze Wang, Yi Wang, Ziyu Guo, Renrui Zhang, Donghao Zhou, Guangyong Chen, Anfeng Liu, Pheng-Ann Heng
2025AAAILiDAR-LLM: Exploring the Potential of Large Language Models for 3D LiDAR Understanding.Senqiao Yang, Jiaming Liu, Renrui Zhang, Mingjie Pan, Ziyu Guo, Xiaoqi Li, Zehui Chen, Peng Gao, Hongsheng Li, Yandong Guo, Shanghang Zhang
2025ACLSciVerse: Unveiling the Knowledge Comprehension and Visual Reasoning of LMMs on Multi-modal Scientific Problems.Ziyu Guo, Renrui Zhang, Hao Chen, Jialin Gao, Dongzhi Jiang, Jiaze Wang, Pheng-Ann Heng
2025CVPRVideo-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis.Chaoyou Fu, Yuhan Dai, Yongdong Luo, Lei Li, Shuhuai Ren, Renrui Zhang, Zihan Wang, Chenyu Zhou, Yunhang Shen, Mengdan Zhang, Peixian Chen, Yanwei Li, Shaohui Lin, Sirui Zhao, Ke Li, Tong Xu, Xiawu Zheng, Enhong Chen, Caifeng Shan, Ran He, Xing Sun
2025CVPRLift3D Policy: Lifting 2D Foundation Models for Robust 3D Robotic Manipulation.Yueru Jia, Jiaming Liu, Sixiang Chen, Chenyang Gu, Zhilue Wang, Longzan Luo, Xiaoqi Li, Pengwei Wang, Zhongyuan Wang, Renrui Zhang, Shanghang Zhang
2025CVPRLet's Verify and Reinforce Image Generation Step by Step.Renrui Zhang, Chengzhuo Tong, Zhizheng Zhao, Ziyu Guo, Haoquan Zhang, Manyuan Zhang, Jiaming Liu, Peng Gao, Hongsheng Li
2025ICCVChimera: Improving Generalist Model with Domain-Specific Experts.Tianshuo Peng, Mingsheng Li, Jiakang Yuan, Hongbin Zhou, Renqiu Xia, Renrui Zhang, Lei Bai, Song Mao, Bin Wang, Aojun Zhou, Botian Shi, Tao Chen, Bo Zhang, Xiangyu Yue
2025ICCVBeyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs.Qizhe Zhang, Aosong Cheng, Ming Lu, Renrui Zhang, Zhiyong Zhuo, Jiajun Cao, Shaobo Guo, Qi She, Shanghang Zhang
2025ICCVDetect Anything 3D in the Wild.Hanxue Zhang, Haoran Jiang, Qingsong Yao, Yanan Sun, Renrui Zhang, Hao Zhao, Hongyang Li, Hongzi Zhu, Zetong Yang
2025ICCVTAR3D: Creating High-Quality 3D Assets Via Next-Part Prediction.Xuying Zhang, Yutong Liu, Yangguang Li, Renrui Zhang, Yufei Liu, Kai Wang, Wanli Ouyang, Zhiwei Xiong, Peng Gao, Qibin Hou, Ming-Ming Cheng
2025ICCVFrom Reflection to Perfection: Scaling Inference-Time Optimization for Text-to-Image Diffusion Models via Reflection Tuning.Le Zhuo, Liangbing Zhao, Sayak Paul, Yue Liao, Renrui Zhang, Yi Xin, Peng Gao, Mohamed Elhoseiny, Hongsheng Li
2025ICLRLumina-T2X: Scalable Flow-based Large Diffusion Transformer for Flexible Resolution Generation.Peng Gao, Le Zhuo, Dongyang Liu, Ruoyi Du, Xu Luo, Longtian Qiu, Yuhang Zhang, Rongjie Huang, Shijie Geng, Renrui Zhang, Junlin Xie, Wenqi Shao, Zhengkai Jiang, Tianshuo Yang, Weicai Ye, Tong He, Jingwen He, Junjun He, Yu Qiao, Hongsheng Li
2025ICLRMMSearch: Unveiling the Potential of Large Models as Multi-modal Search Engines.Dongzhi Jiang, Renrui Zhang, Ziyu Guo, Yanmin Wu, Jiayi Lei, Pengshuo Qiu, Pan Lu, Zehui Chen, Guanglu Song, Peng Gao, Yu Liu, Chunyuan Li, Hongsheng Li
2025ICLRPixWizard: Versatile Image-to-Image Visual Assistant with Open-Language Instructions.Weifeng Lin, Xinyu Wei, Renrui Zhang, Le Zhuo, Shitian Zhao, Siyuan Huang, Junlin Xie, Peng Gao, Hongsheng Li
2025ICLRLLaVA-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models.Feng Li, Renrui Zhang, Hao Zhang, Yuanhan Zhang, Bo Li, Wei Li, Zejun Ma, Chunyuan Li
2025ICLRMAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine.Renrui Zhang, Xinyu Wei, Dongzhi Jiang, Ziyu Guo, Yichi Zhang, Chengzhuo Tong, Jiaming Liu, Aojun Zhou, Shanghang Zhang, Peng Gao, Hongsheng Li
2025ICMLMME-CoT: Benchmarking Chain-of-Thought in Large Multimodal Models for Reasoning Quality, Robustness, and Efficiency.Dongzhi Jiang, Renrui Zhang, Ziyu Guo, Yanwei Li, Yu Qi, Xinyan Chen, Liuhui Wang, Jianhan Jin, Claire Guo, Shen Yan, Bo Zhang, Chaoyou Fu, Peng Gao, Hongsheng Li
2024AAAIParsing All Adverse Scenes: Severity-Aware Semantic Segmentation with Mask-Enhanced Cross-Domain Consistency.Fuhao Li, Ziyang Gong, Yupeng Deng, Xianzheng Ma, Renrui Zhang, Zhenming Ji, Xiangwei Zhu, Hong Zhang
2024AAAIReferred by Multi-Modality: A Unified Temporal Transformer for Video Object Segmentation.Shilin Yan, Renrui Zhang, Ziyu Guo, Wenchao Chen, Wei Zhang, Hongyang Li, Yu Qiao, Hao Dong, Zhongjiang He, Peng Gao
2024AAAIFM-OV3D: Foundation Model-Based Cross-Modal Knowledge Blending for Open-Vocabulary 3D Detection.Dongmei Zhang, Chang Li, Renrui Zhang, Shenghao Xie, Wei Xue, Xiaodong Xie, Shanghang Zhang
2024CVPRManipLLM: Embodied Multimodal Large Language Model for Object-Centric Robotic Manipulation.Xiaoqi Li, Mingxu Zhang, Yiran Geng, Haoran Geng, Yuxing Long, Yan Shen, Renrui Zhang, Jiaming Liu, Hao Dong
2024CVPROneTracker: Unifying Visual Object Tracking with Foundation Models and Efficient Tuning.Lingyi Hong, Shilin Yan, Renrui Zhang, Wanyun Li, Xinyu Zhou, Pinxue Guo, Kaixun Jiang, Yiting Chen, Jinglun Li, Zhaoyu Chen, Wenqiang Zhang
2024CVPRContinual-MAE: Adaptive Distribution Masked Autoencoders for Continual Test-Time Adaptation.Jiaming Liu, Ran Xu, Senqiao Yang, Renrui Zhang, Qizhe Zhang, Zehui Chen, Yandong Guo, Shanghang Zhang
2024CVPRCloud-Device Collaborative Learning for Multimodal Large Language Models.Guanqun Wang, Jiaming Liu, Chenxuan Li, Yuan Zhang, Junpeng Ma, Xinyu Wei, Kevin Zhang, Maurice Chong, Renrui Zhang, Yijiang Liu, Shanghang Zhang
2024CVPRNTO3D: Neural Target Object 3D Reconstruction with Segment Anything.Xiaobao Wei, Renrui Zhang, Jiarui Wu, Jiaming Liu, Ming Lu, Yandong Guo, Shanghang Zhang
2024CVPRGradient-based Parameter Selection for Efficient Fine-Tuning.Zhi Zhang, Qizhe Zhang, Zijun Gao, Renrui Zhang, Ekaterina Shutova, Shiji Zhou, Shanghang Zhang
2024CVPRNo Time to Train: Empowering Non-Parametric Networks for Few-Shot 3D Scene Segmentation.Xiangyang Zhu, Renrui Zhang, Bowei He, Ziyu Guo, Jiaming Liu, Han Xiao, Chaoyou Fu, Hao Dong, Peng Gao
2024ECCVSPHINX: A Mixer of Weights, Visual Embeddings and Image Scales for Multi-modal Large Language Models.Ziyi Lin, Dongyang Liu, Renrui Zhang, Peng Gao, Longtian Qiu, Han Xiao, Han Qiu, Wenqi Shao, Keqin Chen, Jiaming Han, Siyuan Huang, Yichi Zhang, Xuming He, Yu Qiao, Hongsheng Li
2024ECCVPanoVOS: Bridging Non-panoramic and Panoramic Views with Transformer for Video Segmentation.Shilin Yan, Xiaohao Xu, Renrui Zhang, Lingyi Hong, Wenchao Chen, Wenqiang Zhang, Wei Zhang
2024ECCVMATHVERSE: Does Your Multi-modal LLM Truly See the Diagrams in Visual Math Problems?Renrui Zhang, Dongzhi Jiang, Yichi Zhang, Haokun Lin, Ziyu Guo, Pengshuo Qiu, Aojun Zhou, Pan Lu, Kai-Wei Chang, Yu Qiao, Peng Gao, Hongsheng Li
2024EMNLPUnleashing the Potentials of Likelihood Composition for Multi-modal Language Models.Shitian Zhao, Renrui Zhang, Xu Luo, Yan Wang, Shanghang Zhang, Peng Gao
2024ICLRViDA: Homeostatic Visual Domain Adapter for Continual Test Time Adaptation.Jiaming Liu, Senqiao Yang, Peidong Jia, Renrui Zhang, Ming Lu, Yandong Guo, Wei Xue, Shanghang Zhang
2024ICLRMathCoder: Seamless Code Integration in LLMs for Enhanced Mathematical Reasoning.Ke Wang, Houxing Ren, Aojun Zhou, Zimu Lu, Sichun Luo, Weikang Shi, Renrui Zhang, Linqi Song, Mingjie Zhan, Hongsheng Li
2024ICLRPersonalize Segment Anything Model with One Shot.Renrui Zhang, Zhengkai Jiang, Ziyu Guo, Shilin Yan, Junting Pan, Hao Dong, Yu Qiao, Peng Gao, Hongsheng Li
2024ICLRLLaMA-Adapter: Efficient Fine-tuning of Large Language Models with Zero-initialized Attention.Renrui Zhang, Jiaming Han, Chris Liu, Aojun Zhou, Pan Lu, Yu Qiao, Hongsheng Li, Peng Gao
2024ICMLSPHINX-X: Scaling Data and Parameters for a Family of Multi-modal Large Language Models.Dongyang Liu, Renrui Zhang, Longtian Qiu, Siyuan Huang, Weifeng Lin, Shitian Zhao, Shijie Geng, Ziyi Lin, Peng Jin, Kaipeng Zhang, Wenqi Shao, Chao Xu, Conghui He, Junjun He, Hao Shao, Pan Lu, Yu Qiao, Hongsheng Li, Peng Gao
2024ICMLSPP: Sparsity-Preserved Parameter-Efficient Fine-Tuning for Large Language Models.Xudong Lu, Aojun Zhou, Yuhui Xu, Renrui Zhang, Peng Gao, Hongsheng Li
2024ICMLMMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI.Kaining Ying, Fanqing Meng, Jin Wang, Zhiqian Li, Han Lin, Yue Yang, Hao Zhang, Wenbo Zhang, Yuqi Lin, Shuo Liu, Jiayi Lei, Quanfeng Lu, Runjian Chen, Peng Xu, Renrui Zhang, Haozhe Zhang, Peng Gao, Yali Wang, Yu Qiao, Ping Luo, Kaipeng Zhang, Wenqi Shao
2024ICRARenderOcc: Vision-Centric 3D Occupancy Prediction with 2D Rendering Supervision.Mingjie Pan, Jiaming Liu, Renrui Zhang, Peixiang Huang, Xiaoqi Li, Hongwei Xie, Bing Wang, Li Liu, Shanghang Zhang
2023AAAIDecorate the Newcomers: Visual Domain Prompt for Continual Test Time Adaptation.Yulu Gan, Yan Bai, Yihang Lou, Xianzheng Ma, Renrui Zhang, Nian Shi, Lin Luo
2023AAAICALIP: Zero-Shot Enhancement of CLIP with Parameter-Free Attention.Ziyu Guo, Renrui Zhang, Longtian Qiu, Xianzheng Ma, Xupeng Miao, Xuming He, Bin Cui
2023CIKMDynamic Embedding Size Search with Minimum Regret for Streaming Recommender System.Bowei He, Xu He, Renrui Zhang, Yingxue Zhang, Ruiming Tang, Chen Ma
2023CVPRiQuery: Instruments as Queries for Audio-Visual Sound Separation.Jiaben Chen, Renrui Zhang, Dongze Lian, Jiaqi Yang, Ziyao Zeng, Jianbo Shi
2023CVPRPiMAE: Point Cloud and Image Interactive Masked Autoencoders for 3D Object Detection.Anthony Chen, Kevin Zhang, Renrui Zhang, Zihan Wang, Yuheng Lu, Yandong Guo, Shanghang Zhang
2023CVPREDA: Explicit Text-Decoupling and Dense Alignment for 3D Visual Grounding.Yanmin Wu, Xinhua Cheng, Renrui Zhang, Zesen Cheng, Jian Zhang
2023CVPRPrompt, Generate, Then Cache: Cascade of Foundation Models Makes Strong Few-Shot Learners.Renrui Zhang, Xiangfei Hu, Bohao Li, Siyuan Huang, Hanqiu Deng, Yu Qiao, Peng Gao, Hongsheng Li
2023CVPRLearning 3D Representations from 2D Pre-Trained Models via Image-to-Point Masked Autoencoders.Renrui Zhang, Liuhui Wang, Yu Qiao, Peng Gao, Hongsheng Li
2023CVPRStarting from Non-Parametric Networks for 3D Point Cloud Analysis.Renrui Zhang, Liuhui Wang, Yali Wang, Peng Gao, Hongsheng Li, Jianbo Shi
2023ICCVMonoDETR: Depth-guided Transformer for Monocular 3D Object Detection.Renrui Zhang, Han Qiu, Tai Wang, Ziyu Guo, Ziteng Cui, Yu Qiao, Hongsheng Li, Peng Gao
2023ICCVSparseMAE: Sparse Training Meets Masked Autoencoders.Aojun Zhou, Yang Li, Zipeng Qin, Jianbo Liu, Junting Pan, Renrui Zhang, Rui Zhao, Peng Gao, Hongsheng Li
2023ICCVPointCLIP V2: Prompting CLIP and GPT for Powerful 3D Open-world Learning.Xiangyang Zhu, Renrui Zhang, Bowei He, Ziyu Guo, Ziyao Zeng, Zipeng Qin, Shanghang Zhang, Peng Gao
2023ICCVNot All Features Matter: Enhancing Few-shot CLIP with Adaptive Prior Refinement.Xiangyang Zhu, Renrui Zhang, Bowei He, Aojun Zhou, Dong Wang, Bin Zhao, Peng Gao
2023IJCAIJoint-MAE: 2D-3D Joint Masked Autoencoders for 3D Point Cloud Pre-training.Ziyu Guo, Renrui Zhang, Longtian Qiu, Xianzhi Li, Pheng-Ann Heng
2023IROSRevisiting Event-Based Video Frame Interpolation.Jiaben Chen, Yichen Zhu, Dongze Lian, Jiaqi Yang, Yifu Wang, Renrui Zhang, Xinhang Liu, Shenhan Qian, Laurent Kneip, Shenghua Gao
2023SMCDS-Point: A Dual-Scale 3D Framework for Point Cloud Understanding.Renrui Zhang, Ziyao Zeng, Ziyu Guo, Borui Chen, Guangnan Zhang, Xilan Liu
2023WACVNearest Neighbors Meet Deep Neural Networks for Point Cloud Analysis.Renrui Zhang, Liuhui Wang, Ziyu Guo, Jianbo Shi
2022CVPRPointCLIP: Point Cloud Understanding by CLIP.Renrui Zhang, Ziyu Guo, Wei Zhang, Kunchang Li, Xupeng Miao, Bin Cui, Yu Qiao, Peng Gao, Hongsheng Li
2022ECCVExploring Resolution and Degradation Clues as Self-supervised Signal for Low Quality Object Detection.Ziteng Cui, Yingying Zhu, Lin Gu, Guo-Jun Qi, Xiaoxiao Li, Renrui Zhang, Zenghui Zhang, Tatsuya Harada
2022ECCVFrozen CLIP Models are Efficient Video Learners.Ziyi Lin, Shijie Geng, Renrui Zhang, Peng Gao, Gerard de Melo, Xiaogang Wang, Jifeng Dai, Yu Qiao, Hongsheng Li
2022ECCVTip-Adapter: Training-Free Adaption of CLIP for Few-Shot Classification.Renrui Zhang, Wei Zhang, Rongyao Fang, Peng Gao, Kunchang Li, Jifeng Dai, Yu Qiao, Hongsheng Li
2021BMVCEnd-to-End Object Detection with Adaptive Clustering Transformer.Minghang Zheng, Peng Gao, Renrui Zhang, Kunchang Li, Hongsheng Li, Hao Dong