Anwen Hu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
13
Venues
6
Active years
2020–2025
Best venue rank
A*
Where they publish
Papers
13 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ACL | mPLUG-DocOwl2: High-resolution Compressing for OCR-free Multi-page Document Understanding. | Anwen Hu, Haiyang Xu, Liang Zhang, Jiabo Ye, Ming Yan, Ji Zhang, Qin Jin, Fei Huang, Jingren Zhou |
| 2025 | ICLR | mPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models. | Jiabo Ye, Haiyang Xu, Haowei Liu, Anwen Hu, Ming Yan, Qi Qian, Ji Zhang, Fei Huang, Jingren Zhou |
| 2024 | CVPR | mPLUG-OwI2: Revolutionizing Multi-modal Large Language Model with Modality Collaboration. | Qinghao Ye, Haiyang Xu, Jiabo Ye, Ming Yan, Anwen Hu, Haowei Liu, Qi Qian, Ji Zhang, Fei Huang |
| 2024 | EMNLP | mPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding. | Anwen Hu, Haiyang Xu, Jiabo Ye, Ming Yan, Liang Zhang, Bo Zhang, Ji Zhang, Qin Jin, Fei Huang, Jingren Zhou |
| 2024 | EMNLP | TinyChart: Efficient Chart Understanding with Program-of-Thoughts Learning and Visual Token Merging. | Liang Zhang, Anwen Hu, Haiyang Xu, Ming Yan, Yichen Xu, Qin Jin, Ji Zhang, Fei Huang |
| 2023 | AAAI | Accommodating Audio Modality in CLIP for Multimodal Processing. | Ludan Ruan, Anwen Hu, Yuqing Song, Liang Zhang, Sipeng Zheng, Qin Jin |
| 2023 | AAAI | MPMQA: Multimodal Question Answering on Product Manuals. | Liang Zhang, Anwen Hu, Jing Zhang, Shuo Hu, Qin Jin |
| 2023 | ACL | InfoMetIC: An Informative Metric for Reference-free Image Caption Evaluation. | Anwen Hu, Shizhe Chen, Liang Zhang, Qin Jin |
| 2023 | ACL | Movie101: A New Movie Understanding Benchmark. | Zihao Yue, Qi Zhang, Anwen Hu, Liang Zhang, Ziheng Wang, Qin Jin |
| 2023 | EMNLP | UReader: Universal OCR-free Visually-situated Language Understanding with Multimodal Large Language Model. | Jiabo Ye, Anwen Hu, Haiyang Xu, Qinghao Ye, Ming Yan, Guohai Xu, Chenliang Li, Junfeng Tian, Qi Qian, Ji Zhang, Qin Jin, Liang He, Xin Lin, Fei Huang |
| 2023 | ICCV | Explore and Tell: Embodied Visual Captioning in 3D Environments. | Anwen Hu, Shizhe Chen, Liang Zhang, Qin Jin |
| 2022 | EMNLP | MovieUN: A Dataset for Movie Understanding and Narrating. | Qi Zhang, Zihao Yue, Anwen Hu, Ziheng Wang, Qin Jin |
| 2020 | AAAI | Leveraging Multi-Token Entities in Document-Level Named Entity Recognition. | Anwen Hu, Zhicheng Dou, Jian-Yun Nie, Ji-Rong Wen |