| 2025 | ICML | Avoiding Catastrophe in Online Learning by Asking for Help. | Benjamin Plaut, Hanlin Zhu, Stuart Russell |
| 2025 | ICML | Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning. | DiJia Su, Hanlin Zhu, Yingchen Xu, Jiantao Jiao, Yuandong Tian, Qinqing Zheng |
| 2025 | IJCNN | PD-YOLOv11s: An End-to-End Paper Surface Detection for Specific Visible Angle Defect. | Shupan Li, Hanlin Zhu, Xiangrong Zhong, Mingyuan Jiu, Wei Guo, Yan Chen, Ming Liang Xu |
| 2024 | EMNLP | Learning Personalized Alignment for Evaluating Open-ended Text Generation. | Danqing Wang, Kevin Yang, Hanlin Zhu, Xiaomeng Yang, Andrew Cohen, Lei Li, Yuandong Tian |
| 2024 | ICLR | On Representation Complexity of Model-based and Model-free Reinforcement Learning. | Hanlin Zhu, Baihe Huang, Stuart Russell |
| 2023 | AISTATS | Provably Efficient Reinforcement Learning via Surprise Bound. | Hanlin Zhu, Ruosong Wang, Jason D. Lee |
| 2023 | ICLR | Optimal Conservative Offline RL with General Function Approximation via Augmented Lagrangian. | Paria Rashidinejad, Hanlin Zhu, Kunhe Yang, Stuart Russell, Jiantao Jiao |
| 2021 | COLT | Average-Case Communication Complexity of Statistical Problems. | Cyrus Rashtchian, David P. Woodruff, Peng Ye, Hanlin Zhu |
| 2019 | EMNLP | Guided Dialog Policy Learning: Reward Estimation for Multi-Domain Task-Oriented Dialog. | Ryuichi Takanobu, Hanlin Zhu, Minlie Huang |