| 2025 | AAAI | ProcTag: Process Tagging for Assessing the Efficacy of Document Instruction Data. | Yufan Shen, Chuwei Luo, Zhaoqing Zhu, Yang Chen, Qi Zheng, Zhi Yu, Jiajun Bu, Cong Yao |
| 2025 | CVPR | A Simple yet Effective Layout Token in Large Language Models for Document Understanding. | Zhaoqing Zhu, Chuwei Luo, Zirui Shao, Feiyu Gao, Hangdi Xing, Qi Zheng, Ji Zhang |
| 2025 | EMNLP | Is Cognition Consistent with Perception? Assessing and Mitigating Multimodal Knowledge Conflicts in Document Understanding. | Zirui Shao, Feiyu Gao, Zhaoqing Zhu, Chuwei Luo, Hangdi Xing, Zhi Yu, Qi Zheng, Ming Yan, Jiajun Bu |
| 2025 | EMNLP | Intelligent Document Parsing: Towards End-to-end Document Parsing via Decoupled Content Parsing and Layout Grounding. | Hangdi Xing, Feiyu Gao, Qi Zheng, Zhaoqing Zhu, Zirui Shao, Ming Yan |
| 2024 | CVPR | LayoutLLM: Layout Instruction Tuning with Large Language Models for Document Understanding. | Chuwei Luo, Yufan Shen, Zhaoqing Zhu, Qi Zheng, Zhi Yu, Cong Yao |
| 2023 | AAAI | Intensity-Aware Loss for Dynamic Facial Expression Recognition in the Wild. | Hanting Li, Hongjing Niu, Zhaoqing Zhu, Feng Zhao |
| 2023 | ICIP | AFNet-M: Adaptive Fusion Network with Masks for 2D+3D Facial Expression Recognition. | Mingzhe Sui, Hanting Li, Zhaoqing Zhu, Feng Zhao |
| 2022 | EMNLP | RelCLIP: Adapting Language-Image Pretraining for Visual Relationship Detection via Relational Contrastive Learning. | Yi Zhu, Zhaoqing Zhu, Bingqian Lin, Xiaodan Liang, Feng Zhao, Jianzhuang Liu |
| 2022 | IJCAI | MMNet: Muscle Motion-Guided Network for Micro-Expression Recognition. | Hanting Li, Mingzhe Sui, Zhaoqing Zhu, Feng Zhao |