Skip to content

Banghua Zhu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

18

Venues

7

Active years

2020–2025

Best venue rank

A*

Where they publish

Papers

18 indexed papers, newest first.

YearVenueTitleAuthors
2025ALTNoisy Computing of the Threshold Function.Ziao Wang, Nadim Ghaddar, Banghua Zhu, Lele Wang
2025ICLRHow to Evaluate Reward Models for RLHF.Evan Frick, Tianle Li, Connor Chen, Wei-Lin Chiang, Anastasios Nikolas Angelopoulos, Jiantao Jiao, Banghua Zhu, Joseph E. Gonzalez, Ion Stoica
2025ICLRTaming Overconfidence in LLMs: Reward Calibration in RLHF.Jixuan Leng, Chengsong Huang, Banghua Zhu, Jiaxin Huang
2025ICMLFrom Crowdsourced Data to High-quality Benchmarks: Arena-Hard and Benchbuilder Pipeline.Tianle Li, Wei-Lin Chiang, Evan Frick, Lisa Dunlap, Tianhao Wu, Banghua Zhu, Joseph E. Gonzalez, Ion Stoica
2024ICLRThe Effective Horizon Explains Deep RL Performance in Stochastic Environments.Cassidy Laidlaw, Banghua Zhu, Stuart Russell, Anca D. Dragan
2024ICLRTowards the Fundamental Limits of Knowledge Transfer over Finite Domains.Qingyue Zhao, Banghua Zhu
2024ICMLChatbot Arena: An Open Platform for Evaluating LLMs by Human Preference.Wei-Lin Chiang, Lianmin Zheng, Ying Sheng, Anastasios Nikolas Angelopoulos, Tianle Li, Dacheng Li, Banghua Zhu, Hao Zhang, Michael I. Jordan, Joseph E. Gonzalez, Ion Stoica
2024ICMLIterative Data Smoothing: Mitigating Reward Overfitting and Overoptimization in RLHF.Banghua Zhu, Michael I. Jordan, Jiantao Jiao
2024ICRAGuided Online Distillation: Promoting Safe Reinforcement Learning by Offline Demonstration.Jinning Li, Xinyi Liu, Banghua Zhu, Jiantao Jiao, Masayoshi Tomizuka, Chen Tang, Wei Zhan
2024OSDIFairness in Serving Large Language Models.Ying Sheng, Shiyi Cao, Dacheng Li, Banghua Zhu, Zhuohan Li, Danyang Zhuo, Joseph E. Gonzalez, Ion Stoica
2023AISTATSByzantine-Robust Federated Learning with Optimal Statistical Rates.Banghua Zhu, Lun Wang, Qi Pang, Shuai Wang, Jiantao Jiao, Dawn Song, Michael I. Jordan
2023ICMLJump-Start Reinforcement Learning.Ikechukwu Uchendu, Ted Xiao, Yao Lu, Banghua Zhu, Mengyuan Yan, Josphine Simon, Matthew Bennice, Chuyuan Fu, Cong Ma, Jiantao Jiao, Sergey Levine, Karol Hausman
2023ICMLOnline Learning in Stackelberg Games with an Omniscient Follower.Geng Zhao, Banghua Zhu, Jiantao Jiao, Michael I. Jordan
2023ICMLPrincipled Reinforcement Learning with Human Feedback from Pairwise or K-wise Comparisons.Banghua Zhu, Michael I. Jordan, Jiantao Jiao
2023ISITVariable-Length Insertion-Based Noisy Sorting.Ziao Wang, Nadim Ghaddar, Banghua Zhu, Lele Wang
2023ISITOn the Optimal Bounds for Noisy Computing.Banghua Zhu, Ziao Wang, Nadim Ghaddar, Jiantao Jiao, Lele Wang
2022ISITRobust Estimation for Non-parametric Families via Generative Adversarial Networks.Banghua Zhu, Jiantao Jiao, Michael I. Jordan
2020ISITWhen does the Tukey Median work?Banghua Zhu, Jiantao Jiao, Jacob Steinhardt