Skip to content

Kaipeng Zhang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

47

Venues

15

Active years

2016–2026

Best venue rank

A*

Where they publish

Papers

47 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIMDK12-Bench: A Multi-Discipline Benchmark for Evaluating Reasoning in Multimodal Large Language Models.Pengfei Zhou, Xiaopeng Peng, Fanrui Zhang, Zhaopan Xu, Jiaxin Ai, Yansheng Qiu, Wangbo Zhao, Jiajun Song, Chuanhao Li, Weidong Tang, Zhen Li, Haoquan Zhang, Zizhen Li, Xiaofeng Mao, Yukang Feng, Jianwen Sun, Kai Wang, Xiaojun Chang, Wenqi Shao, Yang You, Kaipeng Zhang
2026ACLLongCLI-Bench: A Preliminary Benchmark and Study for Long-horizon Agentic Programming in Command-Line Interfaces.Yukang Feng, Jianwen Sun, Zelai Yang, Jiaxin Ai, Chuanhao Li, Zizhen Li, Fanrui Zhang, Kang He, Rui Ma, Jifan Lin, Jie Sun, Yang Xiao, Sizhuo Zhou, Wenxiao Wu, Yiming Liu, Pengfei Liu, Shenglin Zhang, Kaipeng Zhang
2026ACLUncertainty-Calibrated Elastic Alignment for Multimodal Sentiment Analysis with Missing Modalities.Kang He, Yuzhe Ding, Rao Fu, Yukang Feng, Kaipeng Zhang, Yiming Liu, Fei Li, Chong Teng, Donghong Ji
2026ACLMeepleLM: A Virtual Playtester Simulating Diverse Subjective Experiences.Zizhen Li, Chuanhao Li, Yibin Wang, Jianwen Sun, Yukang Feng, Jiaxin Ai, Fanrui Zhang, Mingzhu Sun, Yifei Huang, Kaipeng Zhang
2026WWWNavigating Truth in Multimodal Fact-checking via Retrieval- and Reasoning-Enhanced Large Language Models.Fanrui Zhang, Qiang Zhang, Jianwen Sun, Chuanhao Li, Jiaxin Ai, Yukang Feng, Zizhen Li, Kaipeng Zhang, Jiawei Liu, Zheng-Jun Zha
2025ACLEfficientQAT: Efficient Quantization-Aware Training for Large Language Models.Mengzhao Chen, Wenqi Shao, Peng Xu, Jiahao Wang, Peng Gao, Kaipeng Zhang, Ping Luo
2025ACLMPBench: A Comprehensive Multimodal Reasoning Benchmark for Process Errors Identification.Xu Zhao Pan, Pengfei Zhou, Jiaxin Ai, Wangbo Zhao, Kai Wang, Xiaojiang Peng, Wenqi Shao, Hongxun Yao, Kaipeng Zhang
2025CVPROpenING: A Comprehensive Benchmark for Judging Open-ended Interleaved Image-Text Generation.Pengfei Zhou, Xiaopeng Peng, Jiajun Song, Chuanhao Li, Zhaopan Xu, Yue Yang, Ziyao Guo, Hao Zhang, Yuqi Lin, Yefei He, Lirui Zhao, Shuo Liu, Tianhua Li, Yuxuan Xie, Xiaojun Chang, Yu Qiao, Wenqi Shao, Kaipeng Zhang
2025EMNLPInMind: Evaluating LLMs in Capturing and Applying Individual Human Reasoning Styles.Zizhen Li, Chuanhao Li, Yibin Wang, Qi Chen, Diping Song, Yukang Feng, Jianwen Sun, Jiaxin Ai, Fanrui Zhang, Mingzhu Sun, Kaipeng Zhang
2025ICCVProJudge: A Multi-Modal Multi-Discipline Benchmark and Instruction-Tuning Dataset for Mllm-Based Process Judges.Jiaxin Ai, Pengfei Zhou, Zhaopan Xu, Ming Li, Fanrui Zhang, Zizhen Li, Jianwen Sun, Yukang Feng, Baojin Huang, Zhongyuan Wang, Kaipeng Zhang
2025ICCVZipVL: Accelerating Vision-Language Models Through Dynamic Token Sparsity.Yefei He, Feng Chen, Jing Liu, Wenqi Shao, Hong Zhou, Kaipeng Zhang, Bohan Zhuang
2025ICCVNeighboring Autoregressive Modeling for Efficient Visual Generation.Yefei He, Yuanyu He, Shaoxuan He, Feng Chen, Hong Zhou, Kaipeng Zhang, Bohan Zhuang
2025ICCVGUIOdyssey: A Comprehensive Dataset for Cross-App GUI Navigation on Mobile Devices.Quanfeng Lu, Wenqi Shao, Zitao Liu, Lingxiao Du, Fanqing Meng, Boxuan Li, Botong Chen, Siyuan Huang, Kaipeng Zhang, Ping Luo
2025ICCVLiT: Delving into a Simple Linear Diffusion Transformer for Image Generation.Jiahao Wang, Ning Kang, Lewei Yao, Mengzhao Chen, Chengyue Wu, Songyang Zhang, Shuchen Xue, Yong Liu, Taiqiang Wu, Xihui Liu, Kaipeng Zhang, Shifeng Zhang, Wenqi Shao, Zhenguo Li, Ping Luo
2025ICLRSAMRefiner: Taming Segment Anything Model for Universal Mask Refinement.Yuqi Lin, Hengjia Li, Wenqi Shao, Zheng Yang, Jun Zhao, Xiaofei He, Ping Luo, Kaipeng Zhang
2025ICLRMMIU: Multimodal Multi-image Understanding for Evaluating Large Vision-Language Models.Fanqing Meng, Jin Wang, Chuanhao Li, Quanfeng Lu, Hao Tian, Tianshuo Yang, Jiaqi Liao, Xizhou Zhu, Jifeng Dai, Yu Qiao, Ping Luo, Kaipeng Zhang, Wenqi Shao
2025ICLRDynamic Multimodal Evaluation with Flexible Complexity by Vision-Language Bootstrapping.Yue Yang, Shuibo Zhang, Kaipeng Zhang, Yi Bin, Yu Wang, Ping Luo, Wenqi Shao
2025ICMLZipAR: Parallel Autoregressive Image Generation through Spatial Locality.Yefei He, Feng Chen, Yuanyu He, Shaoxuan He, Hong Zhou, Kaipeng Zhang, Bohan Zhuang
2025ICMLTowards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation.Fanqing Meng, Jiaqi Liao, Xinyu Tan, Quanfeng Lu, Wenqi Shao, Kaipeng Zhang, Yu Cheng, Dianqi Li, Ping Luo
2025IJCAITP-Eval: Tap Multimodal LLMs' Potential in Evaluation by Customizing Prompts.Yuxuan Xie, Tianhua Li, Wenqi Shao, Kaipeng Zhang
2024AAAITagCLIP: A Local-to-Global Framework to Enhance Open-Vocabulary Multi-Label Classification of CLIP without Training.Yuqi Lin, Minghao Chen, Kaipeng Zhang, Hengjia Li, Mingming Li, Zheng Yang, Dongqin Lv, Binbin Lin, Haifeng Liu, Deng Cai
2024AAAIData Adaptive Traceback for Vision-Language Foundation Models in Image Classification.Wenshuo Peng, Kaipeng Zhang, Yue Yang, Hao Zhang, Yu Qiao
2024ACLChartAssistant: A Universal Chart Multimodal Language Model via Chart-to-Table Pre-training and Multitask Instruction Tuning.Fanqing Meng, Wenqi Shao, Quanfeng Lu, Peng Gao, Kaipeng Zhang, Yu Qiao, Ping Luo
2024CVPROneLLM: One Framework to Align All Modalities with Language.Jiaming Han, Kaixiong Gong, Yiyuan Zhang, Jiaqi Wang, Kaipeng Zhang, Dahua Lin, Yu Qiao, Peng Gao, Xiangyu Yue
2024CVPRDiffAgent: Fast and Accurate Text-to-Image API Selection with Large Language Model.Lirui Zhao, Yue Yang, Kaipeng Zhang, Wenqi Shao, Yuxin Zhang, Yu Qiao, Ping Luo, Rongrong Ji
2024ICASSPAlign, Adapt and Inject: Audio-Guided Image Generation, Editing and Stylization.Yue Yang, Kaipeng Zhang, Yuying Ge, Wenqi Shao, Zeyue Xue, Yu Qiao, Ping Luo
2024ICLRTowards Lossless Dataset Distillation via Difficulty-Aligned Trajectory Matching.Ziyao Guo, Kai Wang, George Cazenavette, Hui Li, Kaipeng Zhang, Yang You
2024ICLROmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models.Wenqi Shao, Mengzhao Chen, Zhaoyang Zhang, Peng Xu, Lirui Zhao, Zhiqian Li, Kaipeng Zhang, Peng Gao, Yu Qiao, Ping Luo
2024ICLRBESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation.Peng Xu, Wenqi Shao, Mengzhao Chen, Shitao Tang, Kaipeng Zhang, Peng Gao, Fengwei An, Yu Qiao, Ping Luo
2024ICMLSPHINX-X: Scaling Data and Parameters for a Family of Multi-modal Large Language Models.Dongyang Liu, Renrui Zhang, Longtian Qiu, Siyuan Huang, Weifeng Lin, Shitian Zhao, Shijie Geng, Ziyi Lin, Peng Jin, Kaipeng Zhang, Wenqi Shao, Chao Xu, Conghui He, Junjun He, Hao Shao, Pan Lu, Yu Qiao, Hongsheng Li, Peng Gao
2024ICMLPosition: Towards Implicit Prompt For Text-To-Image Models.Yue Yang, Yuqi Lin, Hong Liu, Wenqi Shao, Runjian Chen, Hailong Shang, Yu Wang, Yu Qiao, Kaipeng Zhang, Ping Luo
2024ICMLMMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI.Kaining Ying, Fanqing Meng, Jin Wang, Zhiqian Li, Han Lin, Yue Yang, Hao Zhang, Wenbo Zhang, Yuqi Lin, Shuo Liu, Jiayi Lei, Quanfeng Lu, Runjian Chen, Peng Xu, Renrui Zhang, Haozhe Zhang, Peng Gao, Yali Wang, Yu Qiao, Ping Luo, Kaipeng Zhang, Wenqi Shao
2024NAACLT3M: Text Guided 3D Human Motion Synthesis from Speech.Wenshuo Peng, Kaipeng Zhang, Sai Qian Zhang
2023ICCVDiffRate : Differentiable Compression Rate for Efficient Vision Transformers.Mengzhao Chen, Wenqi Shao, Peng Xu, Mingbao Lin, Kaipeng Zhang, Fei Chao, Rongrong Ji, Yu Qiao, Ping Luo
2023IJCAIRaMLP: Vision MLP via Region-aware Mixing.Shenqi Lai, Xi Du, Jia Guo, Kaipeng Zhang
2020ICRAFarSee-Net: Real-Time Semantic Segmentation by Efficient Multi-scale Context Aggregation and Feature Space Super-resolution.Zhanpeng Zhang, Kaipeng Zhang
2019ICMIExploring Regularizations with Face, Body and Image Cues for Group Cohesion Prediction.Da Guo, Kai Wang, Jianfei Yang, Kaipeng Zhang, Xiaojiang Peng, Yu Qiao
2019ICMIBootstrap Model Ensemble and Rank Loss for Engagement Intensity Regression.Kai Wang, Jianfei Yang, Da Guo, Kaipeng Zhang, Xiaojiang Peng, Yu Qiao
2018ACCVPIVTONS: Pose Invariant Virtual Try-On Shoe with Conditional Image Completion.Chao-Te Chou, Cheng-Han Lee, Kaipeng Zhang, Hu-Cheng Lee, Winston H. Hsu
2018CVPRAttribute Augmented Convolutional Neural Network for Face Hallucination.Cheng-Han Lee, Kaipeng Zhang, Hu-Cheng Lee, Chia-Wen Cheng, Winston H. Hsu
2018CVPRDeep Disguised Faces Recognition.Kaipeng Zhang, Ya-Liang Chang, Winston H. Hsu
2018ECCVSuper-Identity Convolutional Neural Network for Face Hallucination.Kaipeng Zhang, Zhanpeng Zhang, Chia-Wen Cheng, Winston H. Hsu, Yu Qiao, Wei Liu, Tong Zhang
2018ICMICascade Attention Networks For Group Emotion Recognition with Face, Body and Image Cues.Kai Wang, Xiaoxing Zeng, Jianfei Yang, Debin Meng, Kaipeng Zhang, Xiaojiang Peng, Yu Qiao
2017ICCVDetecting Faces Using Inside Cascaded Contextual CNN.Kaipeng Zhang, Zhanpeng Zhang, Hao Wang, Zhifeng Li, Yu Qiao, Wei Liu
2017ICMIGroup emotion recognition with individual facial emotion CNNs and global image based CNNs.Lianzhi Tan, Kaipeng Zhang, Kai Wang, Xiaoxing Zeng, Xiaojiang Peng, Yu Qiao
2016CVPRGender and Smile Classification Using Deep Convolutional Neural Networks.Kaipeng Zhang, Lianzhi Tan, Zhifeng Li, Yu Qiao
2016ECCVA Discriminative Feature Learning Approach for Deep Face Recognition.Yandong Wen, Kaipeng Zhang, Zhifeng Li, Yu Qiao