| 2026 | ACL | Empowering GUI Agents via Autonomous Experience Exploration and Hindsight Experience Utilization for Task Planning. | Tianyi Men, Zhuoran Jin, Pengfei Cao, Yubo Chen, Kang Liu, Jun Zhao |
| 2025 | ACL | RAG-RewardBench: Benchmarking Reward Models in Retrieval Augmented Generation for Preference Alignment. | Zhuoran Jin, Hongbang Yuan, Tianyi Men, Pengfei Cao, Yubo Chen, Jiexin Xu, Huaijun Li, Xiaojian Jiang, Kang Liu, Jun Zhao |
| 2025 | ACL | A Troublemaker with Contagious Jailbreak Makes Chaos in Honest Towns. | Tianyi Men, Pengfei Cao, Zhuoran Jin, Yubo Chen, Kang Liu, Jun Zhao |
| 2025 | ACL | Agent-RewardBench: Towards a Unified Benchmark for Reward Modeling across Perception, Planning, and Safety in Real-World Multimodal Agents. | Tianyi Men, Zhuoran Jin, Pengfei Cao, Yubo Chen, Kang Liu, Jun Zhao |
| 2024 | EMNLP | Unlocking the Future: Exploring Look-Ahead Planning Mechanistic Interpretability in Large Language Models. | Tianyi Men, Pengfei Cao, Zhuoran Jin, Yubo Chen, Kang Liu, Jun Zhao |
| 2022 | ACL | CogKGE: A Knowledge Graph Embedding Toolkit and Benchmark for Representing Multi-source and Heterogeneous Knowledge. | Zhuoran Jin, Tianyi Men, Hongbang Yuan, Zhitao He, Dianbo Sui, Chenhao Wang, Zhipeng Xue, Yubo Chen, Jun Zhao |
| 2022 | EMNLP | CogKTR: A Knowledge-Enhanced Text Representation Toolkit for Natural Language Understanding. | Zhuoran Jin, Tianyi Men, Hongbang Yuan, Yuyang Zhou, Pengfei Cao, Yubo Chen, Zhipeng Xue, Kang Liu, Jun Zhao |