| 2026 | ACL | Towards Self-Improving Error Diagnosis in Multi-Agent Systems. | Jiazheng Li, Emine Yilmaz, Bei Chen, Thu Le |
| 2026 | EACL | SALT: Step-level Advantage Assignment for Long-horizon Agents via Trajectory Graph. | Jiazheng Li, Yawei Wang, Qiaojing Yan, Yijun Tian, Zhichao Xu, Huan Song, Panpan Xu, Lin Lee Cheong |
| 2025 | AAAI | An Automated Explainable Educational Assessment System Built on LLMs. | Jiazheng Li, Artem Bobrov, David West, Cesare Aloisi, Yulan He |
| 2025 | AAAI | ExDDI: Explaining Drug-Drug Interaction Predictions with Natural Language. | Zhaoyue Sun, Jiazheng Li, Gabriele Pergola, Yulan He |
| 2025 | ACL | Drift: Enhancing LLM Faithfulness in Rationale Generation via Dual-Reward Probabilistic Inference. | Jiazheng Li, Hanqi Yan, Yulan He |
| 2025 | ACL | RoleMRC: A Fine-Grained Composite Benchmark for Role-Playing and Instruction-Following. | Junru Lu, Jiazheng Li, Guodong Shen, Lin Gui, Siyu An, Yulan He, Di Yin, Xing Sun |
| 2025 | ACL | EnigmaToM: Improve LLMs' Theory-of-Mind Reasoning Capabilities with Neural Knowledge Base of Entity States. | Hainiu Xu, Siya Qi, Jiazheng Li, Yuxiang Zhou, Jinhua Du, Caroline Catmur, Yulan He |
| 2025 | EMNLP | AERA Chat: An Interactive Platform for Automated Explainable Student Answer Assessment. | Jiazheng Li, Artem Bobrov, Runcong Zhao, Cesare Aloisi, Yulan He |
| 2025 | EMNLP | Two Heads Are Better Than One: Dual-Model Verbal Reflection at Inference-Time. | Jiazheng Li, Yuxiang Zhou, Junru Lu, Gladys Tyen, Lin Gui, Cesare Aloisi, Yulan He |
| 2025 | EMNLP | LearnLens: LLM-Enabled Personalised, Curriculum-Grounded Feedback with Educators in the Loop. | Runcong Zhao, Artem Bobrov, Jiazheng Li, Cesare Aloisi, Yulan He |
| 2025 | ICML | MASS: Mathematical Data Selection via Skill Graphs for Pretraining Large Language Models. | Jiazheng Li, Lu Yu, Qing Cui, Zhiqiang Zhang, Jun Zhou, Yanfang Ye, Chuxu Zhang |
| 2025 | ICML | Scalable Model Merging with Progressive Layer-wise Distillation. | Jing Xu, Jiazheng Li, Jingzhao Zhang |
| 2025 | ICML | Position: LLMs Need a Bayesian Meta-Reasoning Framework for More Robust and Generalizable Reasoning. | Hanqi Yan, Linhai Zhang, Jiazheng Li, Zhenyi Shen, Yulan He |
| 2025 | KDD | Graph Prompting for Graph Learning Models: Recent Advances and Future Directions. | Xingbo Fu, Zehong Wang, Zihan Chen, Jiazheng Li, Yaochen Zhu, Zhenyu Lei, Cong Shen, Yanfang Ye, Chuxu Zhang, Jundong Li |
| 2024 | AAAI | NarrativePlay: An Automated System for Crafting Visual Worlds in Novels for Role-Playing. | Runcong Zhao, Wenjia Zhang, Jiazheng Li, Lixing Zhu, Yanran Li, Yulan He, Lin Gui |
| 2024 | ACL | Large Language Models Fall Short: Understanding Complex Relationships in Detective Narratives. | Runcong Zhao, Qinglin Zhu, Hainiu Xu, Jiazheng Li, Yuxiang Zhou, Yulan He, Lin Gui |
| 2024 | EACL | NarrativePlay: Interactive Narrative Understanding. | Runcong Zhao, Wenjia Zhang, Jiazheng Li, Lixing Zhu, Yanran Li, Yulan He, Lin Gui |
| 2024 | EMNLP | Calibrating LLMs with Preference Optimization on Thought Trees for Generating Rationale in Science Question Scoring. | Jiazheng Li, Hainiu Xu, Zhaoyue Sun, Yuxiang Zhou, David West, Cesare Aloisi, Yulan He |
| 2024 | EMNLP | Eliminating Biased Length Reliance of Direct Preference Optimization via Down-Sampled KL Divergence. | Junru Lu, Jiazheng Li, Siyu An, Meng Zhao, Yulan He, Di Yin, Xing Sun |
| 2024 | EMNLP | The Mystery of In-Context Learning: A Comprehensive Survey on Interpretation and Analysis. | Yuxiang Zhou, Jiazheng Li, Yanzheng Xiang, Hanqi Yan, Lin Gui, Yulan He |
| 2024 | ISPA | A Model for Vulnerability Classification based on Res-CNN-BiTLSTM. | Jiazheng Li, Jiadong Ren, Shuailin Yang, Chenghao Zhi, Chunjiao Bao |
| 2023 | CIKM | Heterogeneous Temporal Graph Neural Network Explainer. | Jiazheng Li, Chunhui Zhang, Chuxu Zhang |
| 2023 | CIKM | A Multi-Modality Framework for Drug-Drug Interaction Prediction by Harnessing Multi-source Data. | Qianlong Wen, Jiazheng Li, Chuxu Zhang, Yanfang Ye |
| 2023 | EACL | NapSS: Paragraph-level Medical Text Simplification via Narrative Prompting and Sentence-matching Summarization. | Junru Lu, Jiazheng Li, Byron C. Wallace, Yulan He, Gabriele Pergola |
| 2023 | EMNLP | Distilling ChatGPT for Explainable Automated Student Answer Assessment. | Jiazheng Li, Lin Gui, Yuxiang Zhou, David West, Cesare Aloisi, Yulan He |
| 2023 | UAI | CUE: An Uncertainty Interpretation Framework for Text Classifiers Built on Pre-Trained Language Models. | Jiazheng Li, Zhaoyue Sun, Bin Liang, Lin Gui, Yulan He |
| 2022 | AAAI | NumHTML: Numeric-Oriented Hierarchical Transformer Model for Multi-Task Financial Forecasting. | Linyi Yang, Jiazheng Li, Ruihai Dong, Yue Zhang, Barry Smyth |
| 2022 | EMNLP | PHEE: A Dataset for Pharmacovigilance Event Extraction from Text. | Zhaoyue Sun, Jiazheng Li, Gabriele Pergola, Byron C. Wallace, Bino John, Nigel Greene, Joseph Kim, Yulan He |
| 2022 | ICTAI | Pyramid Transformer: A Multi-size Object Detection Model with Limited Device Requirements for the Nursing Robot. | Jiazheng Li, Jiexin Xie, Jiaxin Wang, Yujian Wen, Shijie Guo |
| 2022 | MMSys | AQP: an open modular Python platform for objective speech and audio quality metrics. | Jack Geraghty, Jiazheng Li, Alessandro Ragano, Andrew Hines |
| 2021 | ACL | Exploring the Efficacy of Automatically Generated Counterfactuals for Sentiment Analysis. | Linyi Yang, Jiazheng Li, Padraig Cunningham, Yue Zhang, Barry Smyth, Ruihai Dong |
| 2020 | CIKM | MAEC: A Multimodal Aligned Earnings Conference Call Dataset for Financial Risk Prediction. | Jiazheng Li, Linyi Yang, Barry Smyth, Ruihai Dong |