Banghua Zhu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
18
Venues
7
Active years
2020–2025
Best venue rank
A*
Where they publish
Papers
18 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ALT | Noisy Computing of the Threshold Function. | Ziao Wang, Nadim Ghaddar, Banghua Zhu, Lele Wang |
| 2025 | ICLR | How to Evaluate Reward Models for RLHF. | Evan Frick, Tianle Li, Connor Chen, Wei-Lin Chiang, Anastasios Nikolas Angelopoulos, Jiantao Jiao, Banghua Zhu, Joseph E. Gonzalez, Ion Stoica |
| 2025 | ICLR | Taming Overconfidence in LLMs: Reward Calibration in RLHF. | Jixuan Leng, Chengsong Huang, Banghua Zhu, Jiaxin Huang |
| 2025 | ICML | From Crowdsourced Data to High-quality Benchmarks: Arena-Hard and Benchbuilder Pipeline. | Tianle Li, Wei-Lin Chiang, Evan Frick, Lisa Dunlap, Tianhao Wu, Banghua Zhu, Joseph E. Gonzalez, Ion Stoica |
| 2024 | ICLR | The Effective Horizon Explains Deep RL Performance in Stochastic Environments. | Cassidy Laidlaw, Banghua Zhu, Stuart Russell, Anca D. Dragan |
| 2024 | ICLR | Towards the Fundamental Limits of Knowledge Transfer over Finite Domains. | Qingyue Zhao, Banghua Zhu |
| 2024 | ICML | Chatbot Arena: An Open Platform for Evaluating LLMs by Human Preference. | Wei-Lin Chiang, Lianmin Zheng, Ying Sheng, Anastasios Nikolas Angelopoulos, Tianle Li, Dacheng Li, Banghua Zhu, Hao Zhang, Michael I. Jordan, Joseph E. Gonzalez, Ion Stoica |
| 2024 | ICML | Iterative Data Smoothing: Mitigating Reward Overfitting and Overoptimization in RLHF. | Banghua Zhu, Michael I. Jordan, Jiantao Jiao |
| 2024 | ICRA | Guided Online Distillation: Promoting Safe Reinforcement Learning by Offline Demonstration. | Jinning Li, Xinyi Liu, Banghua Zhu, Jiantao Jiao, Masayoshi Tomizuka, Chen Tang, Wei Zhan |
| 2024 | OSDI | Fairness in Serving Large Language Models. | Ying Sheng, Shiyi Cao, Dacheng Li, Banghua Zhu, Zhuohan Li, Danyang Zhuo, Joseph E. Gonzalez, Ion Stoica |
| 2023 | AISTATS | Byzantine-Robust Federated Learning with Optimal Statistical Rates. | Banghua Zhu, Lun Wang, Qi Pang, Shuai Wang, Jiantao Jiao, Dawn Song, Michael I. Jordan |
| 2023 | ICML | Jump-Start Reinforcement Learning. | Ikechukwu Uchendu, Ted Xiao, Yao Lu, Banghua Zhu, Mengyuan Yan, Josphine Simon, Matthew Bennice, Chuyuan Fu, Cong Ma, Jiantao Jiao, Sergey Levine, Karol Hausman |
| 2023 | ICML | Online Learning in Stackelberg Games with an Omniscient Follower. | Geng Zhao, Banghua Zhu, Jiantao Jiao, Michael I. Jordan |
| 2023 | ICML | Principled Reinforcement Learning with Human Feedback from Pairwise or K-wise Comparisons. | Banghua Zhu, Michael I. Jordan, Jiantao Jiao |
| 2023 | ISIT | Variable-Length Insertion-Based Noisy Sorting. | Ziao Wang, Nadim Ghaddar, Banghua Zhu, Lele Wang |
| 2023 | ISIT | On the Optimal Bounds for Noisy Computing. | Banghua Zhu, Ziao Wang, Nadim Ghaddar, Jiantao Jiao, Lele Wang |
| 2022 | ISIT | Robust Estimation for Non-parametric Families via Generative Adversarial Networks. | Banghua Zhu, Jiantao Jiao, Michael I. Jordan |
| 2020 | ISIT | When does the Tukey Median work? | Banghua Zhu, Jiantao Jiao, Jacob Steinhardt |