| 2026 | AAAI | EduGuardBench: A Holistic Benchmark for Evaluating the Pedagogical Fidelity and Adversarial Safety of LLMs as Simulated Teachers. | Yilin Jiang, Mingzi Zhang, Xuanyu Yin, Sheng Jin, Suyu Lu, Zuocan Ying, Zengyi Yu, Xiangjie Kong |
| 2026 | EACL | KidsArtBench: Multi-Dimensional Children's Art Evaluation with Attribute-Aware MLLMs. | Mingrui Ye, Chanjin Zheng, Zengyi Yu, Chenyu Xiang, Zhixue Zhao, Zheng Yuan, Helen Yannakoudakis |
| 2025 | ACL | Decoding LLM Personality Measurement: Forced-Choice vs. Likert. | Xiaoyu Li, Haoran Shi, Zengyi Yu, Yukun Tu, Chanjin Zheng |
| 2025 | CHI | ArtMentor: AI-Assisted Evaluation of Artworks to Explore Multimodal Large Language Models Capabilities. | Chanjin Zheng, Zengyi Yu, Yilin Jiang, Mingzi Zhang, Xunuo Lu, Jing Jin, Liteng Gao |
| 2025 | EMNLP | EMNLP: Educator-role Moral and Normative Large Language Models Profiling. | Yilin Jiang, Mingzi Zhang, Sheng Jin, Zengyi Yu, Xiangjie Kong, Binghao Tu |
| 2024 | IJCNN | Integrating Social and Knowledge Graphs in GNN-Based Recommender Systems. | Zengyi Yu, Yonggu Wang, Mengfang Hu, Zihan Wang |