| 2026 | AAAI | JudgeBoard: Benchmarking and Enhancing Small Language Models for Reasoning Evaluation. | Zhenyu Bi, Gaurav Srivastava, Yang Li, Swastik Roy, Meng Lu, Morteza Ziyadi, Xuan Wang |
| 2025 | AAAI | Population Aware Diffusion for Time Series Generation. | Yang Li, Han Meng, Zhenyu Bi, Ingolv T. Urnes, Haipeng Chen |
| 2025 | ACL | CROSSAGENTIE: Cross-Type and Cross-Task Multi-Agent LLM Collaboration for Zero-Shot Information Extraction. | Meng Lu, Yuzhang Xie, Zhenyu Bi, Shuxiang Cao, Xuan Wang |
| 2025 | EMNLP | DEBATE, TRAIN, EVOLVE: Self-Evolution of Language Model Reasoning. | Gaurav Srivastava, Zhenyu Bi, Meng Lu, Xuan Wang |
| 2025 | IJCNLP | OPTAGENT: Optimizing Multi-Agent LLM Interactions Through Verbal Reinforcement Learning for Enhanced Reasoning. | Zhenyu Bi, Meng Lu, Yang Li, Swastik Roy, Weijie Guan, Morteza Ziyadi, Xuan Wang |
| 2024 | EMNLP | AI for Science in the Era of Large Language Models. | Zhenyu Bi, Minghao Xu, Jian Tang, Xuan Wang |
| 2021 | KDD | UCPhrase: Unsupervised Context-aware Quality Phrase Tagging. | Xiaotao Gu, Zihan Wang, Zhenyu Bi, Yu Meng, Liyuan Liu, Jiawei Han, Jingbo Shang |