Skip to content

Anwen Hu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

13

Venues

6

Active years

2020–2025

Best venue rank

A*

Where they publish

Papers

13 indexed papers, newest first.

YearVenueTitleAuthors
2025ACLmPLUG-DocOwl2: High-resolution Compressing for OCR-free Multi-page Document Understanding.Anwen Hu, Haiyang Xu, Liang Zhang, Jiabo Ye, Ming Yan, Ji Zhang, Qin Jin, Fei Huang, Jingren Zhou
2025ICLRmPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models.Jiabo Ye, Haiyang Xu, Haowei Liu, Anwen Hu, Ming Yan, Qi Qian, Ji Zhang, Fei Huang, Jingren Zhou
2024CVPRmPLUG-OwI2: Revolutionizing Multi-modal Large Language Model with Modality Collaboration.Qinghao Ye, Haiyang Xu, Jiabo Ye, Ming Yan, Anwen Hu, Haowei Liu, Qi Qian, Ji Zhang, Fei Huang
2024EMNLPmPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding.Anwen Hu, Haiyang Xu, Jiabo Ye, Ming Yan, Liang Zhang, Bo Zhang, Ji Zhang, Qin Jin, Fei Huang, Jingren Zhou
2024EMNLPTinyChart: Efficient Chart Understanding with Program-of-Thoughts Learning and Visual Token Merging.Liang Zhang, Anwen Hu, Haiyang Xu, Ming Yan, Yichen Xu, Qin Jin, Ji Zhang, Fei Huang
2023AAAIAccommodating Audio Modality in CLIP for Multimodal Processing.Ludan Ruan, Anwen Hu, Yuqing Song, Liang Zhang, Sipeng Zheng, Qin Jin
2023AAAIMPMQA: Multimodal Question Answering on Product Manuals.Liang Zhang, Anwen Hu, Jing Zhang, Shuo Hu, Qin Jin
2023ACLInfoMetIC: An Informative Metric for Reference-free Image Caption Evaluation.Anwen Hu, Shizhe Chen, Liang Zhang, Qin Jin
2023ACLMovie101: A New Movie Understanding Benchmark.Zihao Yue, Qi Zhang, Anwen Hu, Liang Zhang, Ziheng Wang, Qin Jin
2023EMNLPUReader: Universal OCR-free Visually-situated Language Understanding with Multimodal Large Language Model.Jiabo Ye, Anwen Hu, Haiyang Xu, Qinghao Ye, Ming Yan, Guohai Xu, Chenliang Li, Junfeng Tian, Qi Qian, Ji Zhang, Qin Jin, Liang He, Xin Lin, Fei Huang
2023ICCVExplore and Tell: Embodied Visual Captioning in 3D Environments.Anwen Hu, Shizhe Chen, Liang Zhang, Qin Jin
2022EMNLPMovieUN: A Dataset for Movie Understanding and Narrating.Qi Zhang, Zihao Yue, Anwen Hu, Ziheng Wang, Qin Jin
2020AAAILeveraging Multi-Token Entities in Document-Level Named Entity Recognition.Anwen Hu, Zhicheng Dou, Jian-Yun Nie, Ji-Rong Wen