Jiabo Ye
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
15
Venues
9
Active years
2022–2026
Best venue rank
A*
Where they publish
Papers
15 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Experience-driven Multi-turn Reinforcement Learning for GUI Agents. | Zhengxi Lu, Jiabo Ye, Fei Tang, Yongliang Shen, Haiyang Xu, Ziwei Zheng, Weiming Lu, Ming Yan, Fei Huang, Jun Xiao, Yueting Zhuang |
| 2025 | ACL | mPLUG-DocOwl2: High-resolution Compressing for OCR-free Multi-page Document Understanding. | Anwen Hu, Haiyang Xu, Liang Zhang, Jiabo Ye, Ming Yan, Ji Zhang, Qin Jin, Fei Huang, Jingren Zhou |
| 2025 | CVPR | AdaMMS: Model Merging for Heterogeneous Multimodal Large Language Models with Unsupervised Coefficient Optimization. | Yiyang Du, Xiaochen Wang, Chi Chen, Jiabo Ye, Yiru Wang, Peng Li, Ming Yan, Ji Zhang, Fei Huang, Zhifang Sui, Maosong Sun, Yang Liu |
| 2025 | ICLR | mPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models. | Jiabo Ye, Haiyang Xu, Haowei Liu, Anwen Hu, Ming Yan, Qi Qian, Ji Zhang, Fei Huang, Jingren Zhou |
| 2025 | ICML | Exploiting Presentative Feature Distributions for Parameter-Efficient Continual Learning of Large Language Models. | Xin Cheng, Jiabo Ye, Haiyang Xu, Ming Yan, Ji Zhang, Feng Liu, Fei Huang, Lei Feng |
| 2024 | COLING | MNER-MI: A Multi-image Dataset for Multimodal Named Entity Recognition in Social Media. | Shizhou Huang, Bo Xu, Changqun Li, Jiabo Ye, Xin Lin |
| 2024 | CVPR | mPLUG-OwI2: Revolutionizing Multi-modal Large Language Model with Modality Collaboration. | Qinghao Ye, Haiyang Xu, Jiabo Ye, Ming Yan, Anwen Hu, Haowei Liu, Qi Qian, Ji Zhang, Fei Huang |
| 2024 | EMNLP | mPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding. | Anwen Hu, Haiyang Xu, Jiabo Ye, Ming Yan, Liang Zhang, Bo Zhang, Ji Zhang, Qin Jin, Fei Huang, Jingren Zhou |
| 2024 | MMM | Part-Aware Prompt Tuning for Weakly Supervised Referring Expression Grounding. | Chenlin Zhao, Jiabo Ye, Yaguang Song, Ming Yan, Xiaoshan Yang, Changsheng Xu |
| 2023 | EMNLP | UReader: Universal OCR-free Visually-situated Language Understanding with Multimodal Large Language Model. | Jiabo Ye, Anwen Hu, Haiyang Xu, Qinghao Ye, Ming Yan, Guohai Xu, Chenliang Li, Junfeng Tian, Qi Qian, Ji Zhang, Qin Jin, Liang He, Xin Lin, Fei Huang |
| 2023 | ICASSP | Pseudo-Query Generation For Semi-Supervised Visual Grounding With Knowledge Distillation. | Jianglin Jin, Jiabo Ye, Xin Lin, Liang He |
| 2023 | ICML | mPLUG-2: A Modularized Multi-modal Foundation Model Across Text, Image and Video. | Haiyang Xu, Qinghao Ye, Ming Yan, Yaya Shi, Jiabo Ye, Yuanhong Xu, Chenliang Li, Bin Bi, Qi Qian, Wei Wang, Guohai Xu, Ji Zhang, Songfang Huang, Fei Huang, Jingren Zhou |
| 2022 | CVPR | Shifting More Attention to Visual Backbone: Query-modulated Refinement Networks for End-to-End Visual Grounding. | Jiabo Ye, Junfeng Tian, Ming Yan, Xiaoshan Yang, Xuwu Wang, Ji Zhang, Liang He, Xin Lin |
| 2022 | DASFAA | PromptMNER: Prompt-Based Entity-Related Visual Clue Extraction and Integration for Multimodal Named Entity Recognition. | Xuwu Wang, Junfeng Tian, Min Gui, Zhixu Li, Jiabo Ye, Ming Yan, Yanghua Xiao |
| 2022 | EMNLP | mPLUG: Effective and Efficient Vision-Language Learning by Cross-modal Skip-connections. | Chenliang Li, Haiyang Xu, Junfeng Tian, Wei Wang, Ming Yan, Bin Bi, Jiabo Ye, He Chen, Guohai Xu, Zheng Cao, Ji Zhang, Songfang Huang, Fei Huang, Jingren Zhou, Luo Si |