| 2026 | AAAI | A Disease-Aware Dual-Stage Framework for Chest X-ray Report Generation. | Puzhen Wu, Hexin Dong, Yi Lin, Yihao Ding, Yifan Peng |
| 2026 | ACL | A Survey on MLLM-based Visually Rich Document Understanding: Methods, Challenges, and Emerging Trends. | Yihao Ding, Siwen Luo, Yue Dai, Yanbei Jiang, Zechuan Li, Qiang Sun, Geoffrey Martin, Wei Liu, Yifan Peng |
| 2026 | ACL | MARCH: Multi-Agent Radiology Clinical Hierarchy for CT Report Generation. | Yi Lin, Yihao Ding, Yonghui Wu, Yifan Peng |
| 2026 | WWW | Docs2Synth: A Synthetic Data Tuned Retriever Framework for Documents Understanding. | Yihao Ding, Qiang Sun, Puzhen Wu, Sirui Li, Siwen Luo, Wei Liu |
| 2026 | WWW | Unstructured to Structured: Building Knowledge Graphs from Documents for Web Applications. | Qiang Sun, Yihao Ding, Sirui Li, Wei Liu |
| 2026 | WWW | STIndex: A Context-Aware Multi-Dimensional Spatiotemporal Information Extraction System. | Wenxiao Zhang, Yu Liu, Qiang Sun, Yihao Ding, Sirui Li, Yanbing Liu, Jin B. Hong, Wei Liu |
| 2025 | ACL | Beyond Perception: Evaluating Abstract Visual Reasoning through Multi-Stage Task. | Yanbei Jiang, Yihao Ding, Chao Lei, Jiayang Ao, Jey Han Lau, Krista A. Ehinger |
| 2025 | ACL | Natural Language Processing in Support of Evidence-based Medicine: A Scoping Review. | Zihan Xu, Haotian Ma, Yihao Ding, Gongbo Zhang, Chunhua Weng, Yifan Peng |
| 2025 | CIKM | KIEPrompter: Leveraging Lightweight Models' Predictions for Cost-Effective Key Information Extraction using Vision LLMs. | Lorenzo Vaiani, Yihao Ding, Luca Cagliero, Jean Lee, Paolo Garza, Josiah Poon, Soyeon Caren Han |
| 2025 | CVPR | GO-N3RDet: Geometry Optimized NeRF-enhanced 3D Object Detector. | Zechuan Li, Hongshan Yu, Yihao Ding, Jinhao Qiao, Basim Azam, Naveed Akhtar |
| 2025 | IJCAI | VRD-IU: Lessons from Visually Rich Document Intelligence and Understanding. | Yihao Ding, Soyeon Caren Han, Yan Li, Josiah Poon |
| 2024 | AAAI | The Language Model Can Have the Personality: Joint Learning for Personality Enhanced Language Model (Student Abstract). | Tianyi Chen, Feiqi Cao, Yihao Ding, Soyeon Caren Han |
| 2024 | ACL | 3MVRD: Multimodal Multi-task Multi-teacher Visually-Rich Form Document Understanding. | Yihao Ding, Lorenzo Vaiani, Soyeon Caren Han, Jean Lee, Paolo Garza, Josiah Poon, Luca Cagliero |
| 2024 | IJCAI | MMVQA: A Comprehensive Dataset for Investigating Multipage Multimodal Information Retrieval in PDF-based Visual Question Answering. | Yihao Ding, Kaixuan Ren, Jiabin Huang, Siwen Luo, Soyeon Caren Han |
| 2023 | CIKM | Workshop on Document Intelligence Understanding. | Soyeon Caren Han, Yihao Ding, Siwen Luo, Josiah Poon, Hee-Guen Yoon, Zhe Huang, Paul Duuring, Eun-Jung Holden |
| 2023 | SIGIR | Form-NLU: Dataset for the Form Natural Language Understanding. | Yihao Ding, Siqu Long, Jiabin Huang, Kaixuan Ren, Xingxiang Luo, Hyunsuk Chung, Soyeon Caren Han |
| 2022 | COLING | Doc-GCN: Heterogeneous Graph Convolutional Networks for Document Layout Analysis. | Siwen Luo, Yihao Ding, Siqu Long, Josiah Poon, Soyeon Caren Han |
| 2022 | CVPR | V-Doc : Visual questions answers with Documents. | Yihao Ding, Zhe Huang, Runlin Wang, Yanhang Zhang, Xianru Chen, Yuzhong Ma, Hyunsuk Chung, Soyeon Caren Han |