| 2026 | ACL | ErrorRadar: Benchmarking Complex Mathematical Reasoning of Multimodal Large Language Models Via Error Detection. | Yibo Yan, Shen Wang, Jiahao Huo, Hang Li, Boyan Li, Jiamin Su, Xiong Gao, Yifan Zhang, Tianlong Xu, Zhendong Chu, Aoxiao Zhong, Kun Wang, Hui Xiong, Philip S. Yu, Xuming Hu, Qingsong Wen |
| 2026 | AIED | Can MLLMs Read Students' Minds? Unpacking Multimodal Error Analysis in Handwritten Math. | Dingjie Song, Tianlong Xu, Yifan Zhang, Hang Li, Zhiling Yan, Xing Fan, Haoyang Li, Lichao Sun, Qingsong Wen |
| 2026 | KDD | Breaking the Boundary Barrier: Robust Model Fingerprinting via Unlearnable Examples in Model-Parameter Space. | Tianlong Xu, Zixiong Wang, Gaoyang Liu, Jian Chen, Ahmed M. Abdelmoniem, Chen Wang |
| 2025 | AAAI | Knowledge Tagging with Large Language Model Based Multi-Agent System. | Hang Li, Tianlong Xu, Ethan Chang, Qingsong Wen |
| 2025 | AAAI | AI-Driven Virtual Teacher for Enhanced Educational Efficiency: Leveraging Large Pretrain Models for Autonomous Error Analysis and Correction. | Tianlong Xu, Yifan Zhang, Zhendong Chu, Shen Wang, Qingsong Wen |
| 2025 | ACL | Ask-Before-Detection: Identifying and Mitigating Conformity Bias in LLM-Powered Error Detector for Math Word Problem Solutions. | Hang Li, Tianlong Xu, Kaiqi Yang, Yucheng Chu, Yanling Chen, Yichi Song, Qingsong Wen, Hui Liu |