Skip to content

Wenqi Shao

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

54

Venues

10

Active years

2019–2026

Best venue rank

A*

Where they publish

Papers

54 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAID-GARA: A Dynamic Benchmarking Framework for GUI Agent Robustness in Real-World Anomalies.Sen Chen, Tong Zhao, Yi Bin, Fei Ma, Wenqi Shao, Zheng Wang
2026AAAIMDK12-Bench: A Multi-Discipline Benchmark for Evaluating Reasoning in Multimodal Large Language Models.Pengfei Zhou, Xiaopeng Peng, Fanrui Zhang, Zhaopan Xu, Jiaxin Ai, Yansheng Qiu, Wangbo Zhao, Jiajun Song, Chuanhao Li, Weidong Tang, Zhen Li, Haoquan Zhang, Zizhen Li, Xiaofeng Mao, Yukang Feng, Jianwen Sun, Kai Wang, Xiaojun Chang, Wenqi Shao, Yang You, Kaipeng Zhang
2026ACLDesign First, Code Later: Aesthetically Pleasing Template-Free Slides Generation.Zhiyao Cui, Chenxu Wang, Shuyue Hu, Yiqun Zhang, Wenqi Shao, Qiaosheng Zhang, Zhen Wang
2025ACLEfficientQAT: Efficient Quantization-Aware Training for Large Language Models.Mengzhao Chen, Wenqi Shao, Peng Xu, Jiahao Wang, Peng Gao, Kaipeng Zhang, Ping Luo
2025ACLHiAgent: Hierarchical Working Memory Management for Solving Long-Horizon Agent Tasks with Large Language Model.Mengkang Hu, Tianxing Chen, Qiguang Chen, Yao Mu, Wenqi Shao, Ping Luo
2025ACLText2World: Benchmarking Large Language Models for Symbolic World Model Generation.Mengkang Hu, Tianxing Chen, Yude Zou, Yuheng Lei, Qiguang Chen, Ming Li, Yao Mu, Hongyuan Zhang, Wenqi Shao, Ping Luo
2025ACLMPBench: A Comprehensive Multimodal Reasoning Benchmark for Process Errors Identification.Xu Zhao Pan, Pengfei Zhou, Jiaxin Ai, Wangbo Zhao, Kai Wang, Xiaojiang Peng, Wenqi Shao, Hongxun Yao, Kaipeng Zhang
2025CVPRJiSAM: Alleviate Labeling Burden and Corner Case Problems in Autonomous Driving via Minimal Real-World Data.Runjian Chen, Wenqi Shao, Bo Zhang, Shaoshuai Shi, Li Jiang, Ping Luo
2025CVPRDistilling Monocular Foundation Model for Fine-grained Depth Completion.Yingping Liang, Yutao Hu, Wenqi Shao, Ying Fu
2025CVPRDexHandDiff: Interaction-aware Diffusion Planning for Adaptive Dexterous Manipulation.Zhixuan Liang, Yao Mu, Yixiao Wang, Tianxing Chen, Wenqi Shao, Wei Zhan, Masayoshi Tomizuka, Ping Luo, Mingyu Ding
2025CVPRForensics-Bench: A Comprehensive Forgery Detection Benchmark Suite for Large Vision Language Models.Jin Wang, Chenghui Lv, Xian Li, Shichao Dong, Huadong Li, Kelu Yao, Chao Li, Wenqi Shao, Ping Luo
2025CVPROpenING: A Comprehensive Benchmark for Judging Open-ended Interleaved Image-Text Generation.Pengfei Zhou, Xiaopeng Peng, Jiajun Song, Chuanhao Li, Zhaopan Xu, Yue Yang, Ziyao Guo, Hao Zhang, Yuqi Lin, Yefei He, Lirui Zhao, Shuo Liu, Tianhua Li, Yuxuan Xie, Xiaojun Chang, Yu Qiao, Wenqi Shao, Kaipeng Zhang
2025ICCVZipVL: Accelerating Vision-Language Models Through Dynamic Token Sparsity.Yefei He, Feng Chen, Jing Liu, Wenqi Shao, Hong Zhou, Kaipeng Zhang, Bohan Zhuang
2025ICCVPrompt-A-Video: Prompt your Video Diffusion Model via Preference-Aligned LLM.Yatai Ji, Jiacheng Zhang, Jie Wu, Shilong Zhang, Shoufa Chen, Chongjian Ge, Peize Sun, Weifeng Chen, Wenqi Shao, Xuefeng Xiao, Weilin Huang, Ping Luo
2025ICCVLearning Dense Feature Matching via Lifting Single 2D Image to 3D Space.Yingping Liang, Yutao Hu, Wenqi Shao, Ying Fu
2025ICCVGUIOdyssey: A Comprehensive Dataset for Cross-App GUI Navigation on Mobile Devices.Quanfeng Lu, Wenqi Shao, Zitao Liu, Lingxiao Du, Fanqing Meng, Boxuan Li, Botong Chen, Siyuan Huang, Kaipeng Zhang, Ping Luo
2025ICCVTemporal Overlapping Prediction: A Self-Supervised Pre-Training Method for LiDAR Moving Object Segmentation.Ziliang Miao, Runjian Chen, Yixi Cai, Buwei He, Wenquan Zhao, Wenqi Shao, Bo Zhang, Fu Zhang
2025ICCVLiT: Delving into a Simple Linear Diffusion Transformer for Image Generation.Jiahao Wang, Ning Kang, Lewei Yao, Mengzhao Chen, Chengyue Wu, Songyang Zhang, Shuchen Xue, Yong Liu, Taiqiang Wu, Xihui Liu, Kaipeng Zhang, Shifeng Zhang, Wenqi Shao, Zhenguo Li, Ping Luo
2025ICCVCross-Subject Mind Decoding from Inaccurate Representations.Yangyang Xu, Bangzhen Liu, Wenqi Shao, Yong Du, Shengfeng He, Tingting Zhu
2025ICLREMOS: Embodiment-aware Heterogeneous Multi-robot Operating System with LLM Agents.Junting Chen, Checheng Yu, Xunzhe Zhou, Tianqi Xu, Yao Mu, Mengkang Hu, Wenqi Shao, Yikai Wang, Guohao Li, Lin Shao
2025ICLRLumina-T2X: Scalable Flow-based Large Diffusion Transformer for Flexible Resolution Generation.Peng Gao, Le Zhuo, Dongyang Liu, Ruoyi Du, Xu Luo, Longtian Qiu, Yuhang Zhang, Rongjie Huang, Shijie Geng, Renrui Zhang, Junlin Xie, Wenqi Shao, Zhengkai Jiang, Tianshuo Yang, Weicai Ye, Tong He, Jingwen He, Junjun He, Yu Qiao, Hongsheng Li
2025ICLRSAMRefiner: Taming Segment Anything Model for Universal Mask Refinement.Yuqi Lin, Hengjia Li, Wenqi Shao, Zheng Yang, Jun Zhao, Xiaofei He, Ping Luo, Kaipeng Zhang
2025ICLRMMIU: Multimodal Multi-image Understanding for Evaluating Large Vision-Language Models.Fanqing Meng, Jin Wang, Chuanhao Li, Quanfeng Lu, Hao Tian, Tianshuo Yang, Jiaqi Liao, Xizhou Zhu, Jifeng Dai, Yu Qiao, Ping Luo, Kaipeng Zhang, Wenqi Shao
2025ICLRDynamic Multimodal Evaluation with Flexible Complexity by Vision-Language Bootstrapping.Yue Yang, Shuibo Zhang, Kaipeng Zhang, Yi Bin, Yu Wang, Ping Luo, Wenqi Shao
2025ICMLTowards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation.Fanqing Meng, Jiaqi Liao, Xinyu Tan, Quanfeng Lu, Wenqi Shao, Kaipeng Zhang, Yu Cheng, Dianqi Li, Ping Luo
2025IJCAITP-Eval: Tap Multimodal LLMs' Potential in Evaluation by Customizing Prompts.Yuxuan Xie, Tianhua Li, Wenqi Shao, Kaipeng Zhang
2024AAAICached Transformers: Improving Transformers with Differentiable Memory Cachde.Zhaoyang Zhang, Wenqi Shao, Yixiao Ge, Xiaogang Wang, Jinwei Gu, Ping Luo
2024ACLChartAssistant: A Universal Chart Multimodal Language Model via Chart-to-Table Pre-training and Multitask Instruction Tuning.Fanqing Meng, Wenqi Shao, Quanfeng Lu, Peng Gao, Kaipeng Zhang, Yu Qiao, Ping Luo
2024CVPROmniMedVQA: A New Large-Scale Comprehensive Evaluation Benchmark for Medical LVLM.Yutao Hu, Tianbin Li, Quanfeng Lu, Wenqi Shao, Junjun He, Yu Qiao, Ping Luo
2024CVPRDiffAgent: Fast and Accurate Text-to-Image API Selection with Large Language Model.Lirui Zhao, Yue Yang, Kaipeng Zhang, Wenqi Shao, Yuxin Zhang, Yu Qiao, Ping Luo, Rongrong Ji
2024ECCVSPHINX: A Mixer of Weights, Visual Embeddings and Image Scales for Multi-modal Large Language Models.Ziyi Lin, Dongyang Liu, Renrui Zhang, Peng Gao, Longtian Qiu, Han Xiao, Han Qiu, Wenqi Shao, Keqin Chen, Jiaming Han, Siyuan Huang, Yichi Zhang, Xuming He, Yu Qiao, Hongsheng Li
2024ECCVGPT4RoI: Instruction Tuning Large Language Model on Region-of-Interest.Shilong Zhang, Peize Sun, Shoufa Chen, Min Xiao, Wenqi Shao, Wenwei Zhang, Yu Liu, Kai Chen, Ping Luo
2024ICASSPAlign, Adapt and Inject: Audio-Guided Image Generation, Editing and Stylization.Yue Yang, Kaipeng Zhang, Yuying Ge, Wenqi Shao, Zeyue Xue, Yu Qiao, Ping Luo
2024ICLRTree-Planner: Efficient Close-loop Task Planning with Large Language Models.Mengkang Hu, Yao Mu, Xinmiao Yu, Mingyu Ding, Shiguang Wu, Wenqi Shao, Qiguang Chen, Bin Wang, Yu Qiao, Ping Luo
2024ICLROmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models.Wenqi Shao, Mengzhao Chen, Zhaoyang Zhang, Peng Xu, Lirui Zhao, Zhiqian Li, Kaipeng Zhang, Peng Gao, Yu Qiao, Ping Luo
2024ICLRBESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation.Peng Xu, Wenqi Shao, Mengzhao Chen, Shitao Tang, Kaipeng Zhang, Peng Gao, Fengwei An, Yu Qiao, Ping Luo
2024ICMLRoboCodeX: Multimodal Code Generation for Robotic Behavior Synthesis.Yao Mu, Junting Chen, Qinglong Zhang, Shoufa Chen, Qiaojun Yu, Chongjian Ge, Runjian Chen, Zhixuan Liang, Mengkang Hu, Chaofan Tao, Peize Sun, Haibao Yu, Chao Yang, Wenqi Shao, Wenhai Wang, Jifeng Dai, Yu Qiao, Mingyu Ding, Ping Luo
2024ICMLSPHINX-X: Scaling Data and Parameters for a Family of Multi-modal Large Language Models.Dongyang Liu, Renrui Zhang, Longtian Qiu, Siyuan Huang, Weifeng Lin, Shitian Zhao, Shijie Geng, Ziyi Lin, Peng Jin, Kaipeng Zhang, Wenqi Shao, Chao Xu, Conghui He, Junjun He, Hao Shao, Pan Lu, Yu Qiao, Hongsheng Li, Peng Gao
2024ICMLPosition: Towards Implicit Prompt For Text-To-Image Models.Yue Yang, Yuqi Lin, Hong Liu, Wenqi Shao, Runjian Chen, Hailong Shang, Yu Wang, Yu Qiao, Kaipeng Zhang, Ping Luo
2024ICMLMMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI.Kaining Ying, Fanqing Meng, Jin Wang, Zhiqian Li, Han Lin, Yue Yang, Hao Zhang, Wenbo Zhang, Yuqi Lin, Shuo Liu, Jiayi Lei, Quanfeng Lu, Runjian Chen, Peng Xu, Renrui Zhang, Haozhe Zhang, Peng Gao, Yali Wang, Yu Qiao, Ping Luo, Kaipeng Zhang, Wenqi Shao
2023CVPRReal-Time Controllable Denoising for Image and Video.Zhaoyang Zhang, Yitong Jiang, Wenqi Shao, Xiaogang Wang, Ping Luo, Kaimo Lin, Jinwei Gu
2023ICCVDiffRate : Differentiable Compression Rate for Efficient Vision Transformers.Mengzhao Chen, Wenqi Shao, Peng Xu, Mingbao Lin, Kaipeng Zhang, Fei Chao, Rongrong Ji, Yu Qiao, Ping Luo
2023ICCVBeyond One-to-One: Rethinking the Referring Image Segmentation.Yutao Hu, Qixiong Wang, Wenqi Shao, Enze Xie, Zhenguo Li, Jungong Han, Ping Luo
2023ICLRCO3: Cooperative Unsupervised 3D Representation Learning for Autonomous Driving.Runjian Chen, Yao Mu, Runsen Xu, Wenqi Shao, Chenhan Jiang, Hang Xu, Yu Qiao, Zhenguo Li, Ping Luo
2022ECCVNot All Models Are Equal: Predicting Model Transferability in a Self-challenging Fisher Space.Wenqi Shao, Xun Zhao, Yixiao Ge, Zhaoyang Zhang, Lei Yang, Xiaogang Wang, Ying Shan, Ping Luo
2022ICLRDynamic Token Normalization improves Vision Transformers.Wenqi Shao, Yixiao Ge, Zhaoyang Zhang, Xuyuan Xu, Xiaogang Wang, Ying Shan, Ping Luo
2021ICMLWhat Makes for End-to-End Object Detection?Peize Sun, Yi Jiang, Enze Xie, Wenqi Shao, Zehuan Yuan, Changhu Wang, Ping Luo
2021ICMLDifferentiable Dynamic Quantization with Mixed Precision and Adaptive Resolution.Zhaoyang Zhang, Wenqi Shao, Jinwei Gu, Xiaogang Wang, Ping Luo
2020ICMLChannel Equilibrium Networks for Learning Deep Representation.Wenqi Shao, Shitao Tang, Xingang Pan, Ping Tan, Xiaogang Wang, Ping Luo
2019BMVCLearning Efficient Detector with Semi-supervised Adaptive Distillation.Shitao Tang, Litong Feng, Wenqi Shao, Zhanghui Kuang, Wayne Zhang, Zheng Lu
2019CVPRSSN: Learning Sparse Switchable Normalization via SparsestMax.Wenqi Shao, Tianjian Meng, Jingyu Li, Ruimao Zhang, Yudian Li, Xiaogang Wang, Ping Luo
2019ICCVDifferentiable Learning-to-Group Channels via Groupable Convolutional Neural Networks.Zhaoyang Zhang, Jingyu Li, Wenqi Shao, Zhanglin Peng, Ruimao Zhang, Xiaogang Wang, Ping Luo
2019ICLRTowards Understanding Regularization in Batch Normalization.Ping Luo, Xinjiang Wang, Wenqi Shao, Zhanglin Peng
2019ICMLDifferentiable Dynamic Normalization for Learning Deep Representation.Ping Luo, Zhanglin Peng, Wenqi Shao, Ruimao Zhang, Jiamin Ren, Lingyun Wu