| 2026 | AAAI | PADiff: Predictive and Adaptive Diffusion Policies for Ad Hoc Teamwork. | Hohei Chan, Xinzhi Zhang, Antao Xiang, Weinan Zhang, Mengchen Zhao |
| 2026 | ACL | Unlocking Human-Like Visible Logic: How Logic Diagrams Boost Logic Reasoning in Large Language Models? | Xin Wu, Yuqi Bu, Mengchen Zhao, Qingbao Huang, Yi Cai |
| 2026 | ACL | MavenCoder: Competitive Code Generation via Model Adaptive Planning Strategies and Multi-Perspective Verification Enhancement. | ZhenChun Xu, Yi Cai, Dajun Zheng, Li Yuan, Mengchen Zhao, Qixiang Wang, Jiexin Wang |
| 2026 | ACL | SeDev: Structured Semantic Exploration for LLM-Driven Code Generation. | Ronghui Yang, Jie Liu, Jiajie Zeng, Jiexin Wang, Jiuchuan Jiang, Bo An, Yi Cai, Mengchen Zhao |
| 2025 | ACL | RTADev: Intention Aligned Multi-Agent Framework for Software Development. | Jie Liu, Guohua Wang, Ronghui Yang, Jiajie Zeng, Mengchen Zhao, Yi Cai |
| 2025 | ECAI | DiTAC: Discrete Teamwork Abstraction for Ad Hoc Collaboration. | Jing Wang, Pengjie Gu, Mengchen Zhao, Guangyong Chen, Furui Liu, Pheng-Ann Heng |
| 2025 | ICML | Ad Hoc Teamwork via Offline Goal-Based Decision Transformers. | Xinzhi Zhang, Hohei Chan, Deheng Ye, Yi Cai, Mengchen Zhao |
| 2024 | CVPR | Improving Unsupervised Hierarchical Representation With Reinforcement Learning. | Ruyi An, Yewen Li, Xu He, Pengjie Gu, Mengchen Zhao, Dong Li, Jianye Hao, Chaojie Wang, Bo An, Mingyuan Zhou |
| 2024 | IJCAI | PoRank: A Practical Framework for Learning to Rank Policies. | Pengjie Gu, Mengchen Zhao, Xu He, Yi Cai, Bo An |
| 2023 | CVPR | Co-speech Gesture Synthesis by Reinforcement Learning with Contrastive Pretrained Rewards. | Mingyang Sun, Mengchen Zhao, Yaqing Hou, Minglei Li, Huang Xu, Songcen Xu, Jianye Hao |
| 2023 | PAKDD | RLMixer: A Reinforcement Learning Approach for Integrated Ranking with Contrastive User Preference Modeling. | Jing Wang, Mengchen Zhao, Wei Xia, Zhenhua Dong, Ruiming Tang, Rui Zhang, Jianye Hao, Guangyong Chen, Pheng-Ann Heng |
| 2022 | DASFAA | Efficient Dual-Process Cognitive Recommender Balancing Accuracy and Diversity. | Yixu Gao, Kun Shao, Zhijian Duan, Zhongyu Wei, Dong Li, Bin Wang, Mengchen Zhao, Jianye Hao |
| 2022 | ICLR | Online Ad Hoc Teamwork under Partial Observability. | Pengjie Gu, Mengchen Zhao, Jianye Hao, Bo An |
| 2022 | ICMI | The ReprGesture entry to the GENEA Challenge 2022. | Sicheng Yang, Zhiyong Wu, Minglei Li, Mengchen Zhao, Jiuxin Lin, Liyang Chen, Weihong Bao |
| 2022 | ICML | Learning Pseudometric-based Action Representations for Offline Reinforcement Learning. | Pengjie Gu, Mengchen Zhao, Chen Chen, Dong Li, Jianye Hao, Bo An |
| 2022 | WSDM | Modeling Scale-free Graphs with Hyperbolic Geometry for Knowledge-aware Recommendation. | Yankai Chen, Menglin Yang, Yingxue Zhang, Mengchen Zhao, Ziqiao Meng, Jianye Hao, Irwin King |
| 2021 | CIKM | CMML: Contextual Modulation Meta Learning for Cold-Start Recommendation. | Xidong Feng, Chen Chen, Dong Li, Mengchen Zhao, Jianye Hao, Jun Wang |
| 2019 | WWW | Securing the Deep Fraud Detector in Large-Scale E-Commerce Platform via Adversarial Machine Learning Approach. | Qingyu Guo, Zhao Li, Bo An, Pengrui Hui, Jiaming Huang, Long Zhang, Mengchen Zhao |
| 2018 | AAAI | HogRider: Champion Agent of Microsoft Malmo Collaborative AI Challenge. | Yanhai Xiong, Haipeng Chen, Mengchen Zhao, Bo An |
| 2018 | AAAI | Data Poisoning Attacks on Multi-Task Relationship Learning. | Mengchen Zhao, Bo An, Yaodong Yu, Sulin Liu, Sinno Jialin Pan |
| 2018 | IJCAI | Impression Allocation for Combating Fraud in E-commerce Via Deep Reinforcement Learning with Action Norm Penalty. | Mengchen Zhao, Zhao Li, Bo An, Haifeng Lu, Yifan Yang, Chen Chu |
| 2017 | IJCAI | Efficient Label Contamination Attacks Against Black-Box Learning Models. | Mengchen Zhao, Bo An, Wei Gao, Teng Zhang |
| 2016 | AAAI | Optimizing Personalized Email Filtering Thresholds to Mitigate Sequential Spear Phishing Attacks. | Mengchen Zhao, Bo An, Christopher Kiekintveld |