Skip to content

Jiabo Ye

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

15

Venues

9

Active years

2022–2026

Best venue rank

A*

Where they publish

Papers

15 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLExperience-driven Multi-turn Reinforcement Learning for GUI Agents.Zhengxi Lu, Jiabo Ye, Fei Tang, Yongliang Shen, Haiyang Xu, Ziwei Zheng, Weiming Lu, Ming Yan, Fei Huang, Jun Xiao, Yueting Zhuang
2025ACLmPLUG-DocOwl2: High-resolution Compressing for OCR-free Multi-page Document Understanding.Anwen Hu, Haiyang Xu, Liang Zhang, Jiabo Ye, Ming Yan, Ji Zhang, Qin Jin, Fei Huang, Jingren Zhou
2025CVPRAdaMMS: Model Merging for Heterogeneous Multimodal Large Language Models with Unsupervised Coefficient Optimization.Yiyang Du, Xiaochen Wang, Chi Chen, Jiabo Ye, Yiru Wang, Peng Li, Ming Yan, Ji Zhang, Fei Huang, Zhifang Sui, Maosong Sun, Yang Liu
2025ICLRmPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models.Jiabo Ye, Haiyang Xu, Haowei Liu, Anwen Hu, Ming Yan, Qi Qian, Ji Zhang, Fei Huang, Jingren Zhou
2025ICMLExploiting Presentative Feature Distributions for Parameter-Efficient Continual Learning of Large Language Models.Xin Cheng, Jiabo Ye, Haiyang Xu, Ming Yan, Ji Zhang, Feng Liu, Fei Huang, Lei Feng
2024COLINGMNER-MI: A Multi-image Dataset for Multimodal Named Entity Recognition in Social Media.Shizhou Huang, Bo Xu, Changqun Li, Jiabo Ye, Xin Lin
2024CVPRmPLUG-OwI2: Revolutionizing Multi-modal Large Language Model with Modality Collaboration.Qinghao Ye, Haiyang Xu, Jiabo Ye, Ming Yan, Anwen Hu, Haowei Liu, Qi Qian, Ji Zhang, Fei Huang
2024EMNLPmPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding.Anwen Hu, Haiyang Xu, Jiabo Ye, Ming Yan, Liang Zhang, Bo Zhang, Ji Zhang, Qin Jin, Fei Huang, Jingren Zhou
2024MMMPart-Aware Prompt Tuning for Weakly Supervised Referring Expression Grounding.Chenlin Zhao, Jiabo Ye, Yaguang Song, Ming Yan, Xiaoshan Yang, Changsheng Xu
2023EMNLPUReader: Universal OCR-free Visually-situated Language Understanding with Multimodal Large Language Model.Jiabo Ye, Anwen Hu, Haiyang Xu, Qinghao Ye, Ming Yan, Guohai Xu, Chenliang Li, Junfeng Tian, Qi Qian, Ji Zhang, Qin Jin, Liang He, Xin Lin, Fei Huang
2023ICASSPPseudo-Query Generation For Semi-Supervised Visual Grounding With Knowledge Distillation.Jianglin Jin, Jiabo Ye, Xin Lin, Liang He
2023ICMLmPLUG-2: A Modularized Multi-modal Foundation Model Across Text, Image and Video.Haiyang Xu, Qinghao Ye, Ming Yan, Yaya Shi, Jiabo Ye, Yuanhong Xu, Chenliang Li, Bin Bi, Qi Qian, Wei Wang, Guohai Xu, Ji Zhang, Songfang Huang, Fei Huang, Jingren Zhou
2022CVPRShifting More Attention to Visual Backbone: Query-modulated Refinement Networks for End-to-End Visual Grounding.Jiabo Ye, Junfeng Tian, Ming Yan, Xiaoshan Yang, Xuwu Wang, Ji Zhang, Liang He, Xin Lin
2022DASFAAPromptMNER: Prompt-Based Entity-Related Visual Clue Extraction and Integration for Multimodal Named Entity Recognition.Xuwu Wang, Junfeng Tian, Min Gui, Zhixu Li, Jiabo Ye, Ming Yan, Yanghua Xiao
2022EMNLPmPLUG: Effective and Efficient Vision-Language Learning by Cross-modal Skip-connections.Chenliang Li, Haiyang Xu, Junfeng Tian, Wei Wang, Ming Yan, Bin Bi, Jiabo Ye, He Chen, Guohai Xu, Zheng Cao, Ji Zhang, Songfang Huang, Fei Huang, Jingren Zhou, Luo Si