| 2026 | EACL | Unveiling the Deficiencies of Pre-trained Text-and-Layout Models in Real-world Visually-rich Document Information Extraction. | Chong Zhang, Yixi Zhao, Yulu Xie, Chenshu Yuan, Yi Tu, Ya Guo, Mingxu Chai, Ziyu Shen, Yue Zhang, Qi Zhang |
| 2025 | ICCV | Can Knowledge be Transferred from Unimodal to Multimodal? Investigating the Transitivity of Multimodal Knowledge Editing. | Lingyong Fang, Xinzhong Wang, Depeng Wang, Zongru Wu, Ya Guo, Huijia Zhu, Zhuosheng Zhang, Gongshen Liu |
| 2024 | EMNLP | Modeling Layout Reading Order as Ordering Relations for Visually-rich Document Understanding. | Chong Zhang, Yi Tu, Yixi Zhao, Chenshu Yuan, Huan Chen, Yue Zhang, Mingxu Chai, Ya Guo, Huijia Zhu, Qi Zhang, Tao Gui |
| 2023 | ACL | LayoutMask: Enhance Text-Layout Interaction in Multi-modal Pre-training for Document Understanding. | Yi Tu, Ya Guo, Huan Chen, Jinyang Tang |
| 2023 | EMNLP | Reading Order Matters: Information Extraction from Visually-rich Documents by Token Path Prediction. | Chong Zhang, Ya Guo, Yi Tu, Huan Chen, Jinyang Tang, Huijia Zhu, Qi Zhang, Tao Gui |
| 2023 | IJCNN | OSDet: Towards Open-Set Object Detection. | Chao Gao, Jiaran Hao, Ya Guo |
| 2016 | EMNLP | Generating Abbreviations for Chinese Named Entities Using Recurrent Neural Network with Dynamic Dictionary. | Qi Zhang, Jin Qian, Ya Guo, Yaqian Zhou, Xuanjing Huang |
| 2016 | HCI | Based on High Order Aberration Analysis of Influence Index of Vision Fatigue by Watching 3D TV. | Fan Yang, Jianqi Cai, Ya Guo, Qian-Xiang Zhou, Zhong-Qi Liu |
| 2015 | AAAI | Retweet Behavior Prediction Using Hierarchical Dirichlet Process. | Qi Zhang, Yeyun Gong, Ya Guo, Xuanjing Huang |
| 2014 | COLING | A Generative Model for Identifying Target Companies of Microblogs. | Yeyun Gong, Yaqian Zhou, Ya Guo, Qi Zhang, Xuanjing Huang |