Wenqi Shao
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
54
Venues
10
Active years
2019–2026
Best venue rank
A*
Where they publish
Papers
54 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | D-GARA: A Dynamic Benchmarking Framework for GUI Agent Robustness in Real-World Anomalies. | Sen Chen, Tong Zhao, Yi Bin, Fei Ma, Wenqi Shao, Zheng Wang |
| 2026 | AAAI | MDK12-Bench: A Multi-Discipline Benchmark for Evaluating Reasoning in Multimodal Large Language Models. | Pengfei Zhou, Xiaopeng Peng, Fanrui Zhang, Zhaopan Xu, Jiaxin Ai, Yansheng Qiu, Wangbo Zhao, Jiajun Song, Chuanhao Li, Weidong Tang, Zhen Li, Haoquan Zhang, Zizhen Li, Xiaofeng Mao, Yukang Feng, Jianwen Sun, Kai Wang, Xiaojun Chang, Wenqi Shao, Yang You, Kaipeng Zhang |
| 2026 | ACL | Design First, Code Later: Aesthetically Pleasing Template-Free Slides Generation. | Zhiyao Cui, Chenxu Wang, Shuyue Hu, Yiqun Zhang, Wenqi Shao, Qiaosheng Zhang, Zhen Wang |
| 2025 | ACL | EfficientQAT: Efficient Quantization-Aware Training for Large Language Models. | Mengzhao Chen, Wenqi Shao, Peng Xu, Jiahao Wang, Peng Gao, Kaipeng Zhang, Ping Luo |
| 2025 | ACL | HiAgent: Hierarchical Working Memory Management for Solving Long-Horizon Agent Tasks with Large Language Model. | Mengkang Hu, Tianxing Chen, Qiguang Chen, Yao Mu, Wenqi Shao, Ping Luo |
| 2025 | ACL | Text2World: Benchmarking Large Language Models for Symbolic World Model Generation. | Mengkang Hu, Tianxing Chen, Yude Zou, Yuheng Lei, Qiguang Chen, Ming Li, Yao Mu, Hongyuan Zhang, Wenqi Shao, Ping Luo |
| 2025 | ACL | MPBench: A Comprehensive Multimodal Reasoning Benchmark for Process Errors Identification. | Xu Zhao Pan, Pengfei Zhou, Jiaxin Ai, Wangbo Zhao, Kai Wang, Xiaojiang Peng, Wenqi Shao, Hongxun Yao, Kaipeng Zhang |
| 2025 | CVPR | JiSAM: Alleviate Labeling Burden and Corner Case Problems in Autonomous Driving via Minimal Real-World Data. | Runjian Chen, Wenqi Shao, Bo Zhang, Shaoshuai Shi, Li Jiang, Ping Luo |
| 2025 | CVPR | Distilling Monocular Foundation Model for Fine-grained Depth Completion. | Yingping Liang, Yutao Hu, Wenqi Shao, Ying Fu |
| 2025 | CVPR | DexHandDiff: Interaction-aware Diffusion Planning for Adaptive Dexterous Manipulation. | Zhixuan Liang, Yao Mu, Yixiao Wang, Tianxing Chen, Wenqi Shao, Wei Zhan, Masayoshi Tomizuka, Ping Luo, Mingyu Ding |
| 2025 | CVPR | Forensics-Bench: A Comprehensive Forgery Detection Benchmark Suite for Large Vision Language Models. | Jin Wang, Chenghui Lv, Xian Li, Shichao Dong, Huadong Li, Kelu Yao, Chao Li, Wenqi Shao, Ping Luo |
| 2025 | CVPR | OpenING: A Comprehensive Benchmark for Judging Open-ended Interleaved Image-Text Generation. | Pengfei Zhou, Xiaopeng Peng, Jiajun Song, Chuanhao Li, Zhaopan Xu, Yue Yang, Ziyao Guo, Hao Zhang, Yuqi Lin, Yefei He, Lirui Zhao, Shuo Liu, Tianhua Li, Yuxuan Xie, Xiaojun Chang, Yu Qiao, Wenqi Shao, Kaipeng Zhang |
| 2025 | ICCV | ZipVL: Accelerating Vision-Language Models Through Dynamic Token Sparsity. | Yefei He, Feng Chen, Jing Liu, Wenqi Shao, Hong Zhou, Kaipeng Zhang, Bohan Zhuang |
| 2025 | ICCV | Prompt-A-Video: Prompt your Video Diffusion Model via Preference-Aligned LLM. | Yatai Ji, Jiacheng Zhang, Jie Wu, Shilong Zhang, Shoufa Chen, Chongjian Ge, Peize Sun, Weifeng Chen, Wenqi Shao, Xuefeng Xiao, Weilin Huang, Ping Luo |
| 2025 | ICCV | Learning Dense Feature Matching via Lifting Single 2D Image to 3D Space. | Yingping Liang, Yutao Hu, Wenqi Shao, Ying Fu |
| 2025 | ICCV | GUIOdyssey: A Comprehensive Dataset for Cross-App GUI Navigation on Mobile Devices. | Quanfeng Lu, Wenqi Shao, Zitao Liu, Lingxiao Du, Fanqing Meng, Boxuan Li, Botong Chen, Siyuan Huang, Kaipeng Zhang, Ping Luo |
| 2025 | ICCV | Temporal Overlapping Prediction: A Self-Supervised Pre-Training Method for LiDAR Moving Object Segmentation. | Ziliang Miao, Runjian Chen, Yixi Cai, Buwei He, Wenquan Zhao, Wenqi Shao, Bo Zhang, Fu Zhang |
| 2025 | ICCV | LiT: Delving into a Simple Linear Diffusion Transformer for Image Generation. | Jiahao Wang, Ning Kang, Lewei Yao, Mengzhao Chen, Chengyue Wu, Songyang Zhang, Shuchen Xue, Yong Liu, Taiqiang Wu, Xihui Liu, Kaipeng Zhang, Shifeng Zhang, Wenqi Shao, Zhenguo Li, Ping Luo |
| 2025 | ICCV | Cross-Subject Mind Decoding from Inaccurate Representations. | Yangyang Xu, Bangzhen Liu, Wenqi Shao, Yong Du, Shengfeng He, Tingting Zhu |
| 2025 | ICLR | EMOS: Embodiment-aware Heterogeneous Multi-robot Operating System with LLM Agents. | Junting Chen, Checheng Yu, Xunzhe Zhou, Tianqi Xu, Yao Mu, Mengkang Hu, Wenqi Shao, Yikai Wang, Guohao Li, Lin Shao |
| 2025 | ICLR | Lumina-T2X: Scalable Flow-based Large Diffusion Transformer for Flexible Resolution Generation. | Peng Gao, Le Zhuo, Dongyang Liu, Ruoyi Du, Xu Luo, Longtian Qiu, Yuhang Zhang, Rongjie Huang, Shijie Geng, Renrui Zhang, Junlin Xie, Wenqi Shao, Zhengkai Jiang, Tianshuo Yang, Weicai Ye, Tong He, Jingwen He, Junjun He, Yu Qiao, Hongsheng Li |
| 2025 | ICLR | SAMRefiner: Taming Segment Anything Model for Universal Mask Refinement. | Yuqi Lin, Hengjia Li, Wenqi Shao, Zheng Yang, Jun Zhao, Xiaofei He, Ping Luo, Kaipeng Zhang |
| 2025 | ICLR | MMIU: Multimodal Multi-image Understanding for Evaluating Large Vision-Language Models. | Fanqing Meng, Jin Wang, Chuanhao Li, Quanfeng Lu, Hao Tian, Tianshuo Yang, Jiaqi Liao, Xizhou Zhu, Jifeng Dai, Yu Qiao, Ping Luo, Kaipeng Zhang, Wenqi Shao |
| 2025 | ICLR | Dynamic Multimodal Evaluation with Flexible Complexity by Vision-Language Bootstrapping. | Yue Yang, Shuibo Zhang, Kaipeng Zhang, Yi Bin, Yu Wang, Ping Luo, Wenqi Shao |
| 2025 | ICML | Towards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation. | Fanqing Meng, Jiaqi Liao, Xinyu Tan, Quanfeng Lu, Wenqi Shao, Kaipeng Zhang, Yu Cheng, Dianqi Li, Ping Luo |
| 2025 | IJCAI | TP-Eval: Tap Multimodal LLMs' Potential in Evaluation by Customizing Prompts. | Yuxuan Xie, Tianhua Li, Wenqi Shao, Kaipeng Zhang |
| 2024 | AAAI | Cached Transformers: Improving Transformers with Differentiable Memory Cachde. | Zhaoyang Zhang, Wenqi Shao, Yixiao Ge, Xiaogang Wang, Jinwei Gu, Ping Luo |
| 2024 | ACL | ChartAssistant: A Universal Chart Multimodal Language Model via Chart-to-Table Pre-training and Multitask Instruction Tuning. | Fanqing Meng, Wenqi Shao, Quanfeng Lu, Peng Gao, Kaipeng Zhang, Yu Qiao, Ping Luo |
| 2024 | CVPR | OmniMedVQA: A New Large-Scale Comprehensive Evaluation Benchmark for Medical LVLM. | Yutao Hu, Tianbin Li, Quanfeng Lu, Wenqi Shao, Junjun He, Yu Qiao, Ping Luo |
| 2024 | CVPR | DiffAgent: Fast and Accurate Text-to-Image API Selection with Large Language Model. | Lirui Zhao, Yue Yang, Kaipeng Zhang, Wenqi Shao, Yuxin Zhang, Yu Qiao, Ping Luo, Rongrong Ji |
| 2024 | ECCV | SPHINX: A Mixer of Weights, Visual Embeddings and Image Scales for Multi-modal Large Language Models. | Ziyi Lin, Dongyang Liu, Renrui Zhang, Peng Gao, Longtian Qiu, Han Xiao, Han Qiu, Wenqi Shao, Keqin Chen, Jiaming Han, Siyuan Huang, Yichi Zhang, Xuming He, Yu Qiao, Hongsheng Li |
| 2024 | ECCV | GPT4RoI: Instruction Tuning Large Language Model on Region-of-Interest. | Shilong Zhang, Peize Sun, Shoufa Chen, Min Xiao, Wenqi Shao, Wenwei Zhang, Yu Liu, Kai Chen, Ping Luo |
| 2024 | ICASSP | Align, Adapt and Inject: Audio-Guided Image Generation, Editing and Stylization. | Yue Yang, Kaipeng Zhang, Yuying Ge, Wenqi Shao, Zeyue Xue, Yu Qiao, Ping Luo |
| 2024 | ICLR | Tree-Planner: Efficient Close-loop Task Planning with Large Language Models. | Mengkang Hu, Yao Mu, Xinmiao Yu, Mingyu Ding, Shiguang Wu, Wenqi Shao, Qiguang Chen, Bin Wang, Yu Qiao, Ping Luo |
| 2024 | ICLR | OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models. | Wenqi Shao, Mengzhao Chen, Zhaoyang Zhang, Peng Xu, Lirui Zhao, Zhiqian Li, Kaipeng Zhang, Peng Gao, Yu Qiao, Ping Luo |
| 2024 | ICLR | BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation. | Peng Xu, Wenqi Shao, Mengzhao Chen, Shitao Tang, Kaipeng Zhang, Peng Gao, Fengwei An, Yu Qiao, Ping Luo |
| 2024 | ICML | RoboCodeX: Multimodal Code Generation for Robotic Behavior Synthesis. | Yao Mu, Junting Chen, Qinglong Zhang, Shoufa Chen, Qiaojun Yu, Chongjian Ge, Runjian Chen, Zhixuan Liang, Mengkang Hu, Chaofan Tao, Peize Sun, Haibao Yu, Chao Yang, Wenqi Shao, Wenhai Wang, Jifeng Dai, Yu Qiao, Mingyu Ding, Ping Luo |
| 2024 | ICML | SPHINX-X: Scaling Data and Parameters for a Family of Multi-modal Large Language Models. | Dongyang Liu, Renrui Zhang, Longtian Qiu, Siyuan Huang, Weifeng Lin, Shitian Zhao, Shijie Geng, Ziyi Lin, Peng Jin, Kaipeng Zhang, Wenqi Shao, Chao Xu, Conghui He, Junjun He, Hao Shao, Pan Lu, Yu Qiao, Hongsheng Li, Peng Gao |
| 2024 | ICML | Position: Towards Implicit Prompt For Text-To-Image Models. | Yue Yang, Yuqi Lin, Hong Liu, Wenqi Shao, Runjian Chen, Hailong Shang, Yu Wang, Yu Qiao, Kaipeng Zhang, Ping Luo |
| 2024 | ICML | MMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI. | Kaining Ying, Fanqing Meng, Jin Wang, Zhiqian Li, Han Lin, Yue Yang, Hao Zhang, Wenbo Zhang, Yuqi Lin, Shuo Liu, Jiayi Lei, Quanfeng Lu, Runjian Chen, Peng Xu, Renrui Zhang, Haozhe Zhang, Peng Gao, Yali Wang, Yu Qiao, Ping Luo, Kaipeng Zhang, Wenqi Shao |
| 2023 | CVPR | Real-Time Controllable Denoising for Image and Video. | Zhaoyang Zhang, Yitong Jiang, Wenqi Shao, Xiaogang Wang, Ping Luo, Kaimo Lin, Jinwei Gu |
| 2023 | ICCV | DiffRate : Differentiable Compression Rate for Efficient Vision Transformers. | Mengzhao Chen, Wenqi Shao, Peng Xu, Mingbao Lin, Kaipeng Zhang, Fei Chao, Rongrong Ji, Yu Qiao, Ping Luo |
| 2023 | ICCV | Beyond One-to-One: Rethinking the Referring Image Segmentation. | Yutao Hu, Qixiong Wang, Wenqi Shao, Enze Xie, Zhenguo Li, Jungong Han, Ping Luo |
| 2023 | ICLR | CO3: Cooperative Unsupervised 3D Representation Learning for Autonomous Driving. | Runjian Chen, Yao Mu, Runsen Xu, Wenqi Shao, Chenhan Jiang, Hang Xu, Yu Qiao, Zhenguo Li, Ping Luo |
| 2022 | ECCV | Not All Models Are Equal: Predicting Model Transferability in a Self-challenging Fisher Space. | Wenqi Shao, Xun Zhao, Yixiao Ge, Zhaoyang Zhang, Lei Yang, Xiaogang Wang, Ying Shan, Ping Luo |
| 2022 | ICLR | Dynamic Token Normalization improves Vision Transformers. | Wenqi Shao, Yixiao Ge, Zhaoyang Zhang, Xuyuan Xu, Xiaogang Wang, Ying Shan, Ping Luo |
| 2021 | ICML | What Makes for End-to-End Object Detection? | Peize Sun, Yi Jiang, Enze Xie, Wenqi Shao, Zehuan Yuan, Changhu Wang, Ping Luo |
| 2021 | ICML | Differentiable Dynamic Quantization with Mixed Precision and Adaptive Resolution. | Zhaoyang Zhang, Wenqi Shao, Jinwei Gu, Xiaogang Wang, Ping Luo |
| 2020 | ICML | Channel Equilibrium Networks for Learning Deep Representation. | Wenqi Shao, Shitao Tang, Xingang Pan, Ping Tan, Xiaogang Wang, Ping Luo |
| 2019 | BMVC | Learning Efficient Detector with Semi-supervised Adaptive Distillation. | Shitao Tang, Litong Feng, Wenqi Shao, Zhanghui Kuang, Wayne Zhang, Zheng Lu |
| 2019 | CVPR | SSN: Learning Sparse Switchable Normalization via SparsestMax. | Wenqi Shao, Tianjian Meng, Jingyu Li, Ruimao Zhang, Yudian Li, Xiaogang Wang, Ping Luo |
| 2019 | ICCV | Differentiable Learning-to-Group Channels via Groupable Convolutional Neural Networks. | Zhaoyang Zhang, Jingyu Li, Wenqi Shao, Zhanglin Peng, Ruimao Zhang, Xiaogang Wang, Ping Luo |
| 2019 | ICLR | Towards Understanding Regularization in Batch Normalization. | Ping Luo, Xinjiang Wang, Wenqi Shao, Zhanglin Peng |
| 2019 | ICML | Differentiable Dynamic Normalization for Learning Deep Representation. | Ping Luo, Zhanglin Peng, Wenqi Shao, Ruimao Zhang, Jiamin Ren, Lingyun Wu |