Skip to content

Jiantao Jiao

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

37

Venues

12

Active years

2010–2025

Best venue rank

A*

Where they publish

Papers

37 indexed papers, newest first.

YearVenueTitleAuthors
2025EMNLPMeta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge.Tianhao Wu, Weizhe Yuan, Olga Golovneva, Jing Xu, Yuandong Tian, Jiantao Jiao, Jason E. Weston, Sainbayar Sukhbaatar
2025ICLRHow to Evaluate Reward Models for RLHF.Evan Frick, Tianle Li, Connor Chen, Wei-Lin Chiang, Anastasios Nikolas Angelopoulos, Jiantao Jiao, Banghua Zhu, Joseph E. Gonzalez, Ion Stoica
2025ICLREmbedLLM: Learning Compact Representations of Large Language Models.Richard Zhuang, Tianhao Wu, Zhaojin Wen, Andrew Li, Jiantao Jiao, Kannan Ramchandran
2025ICMLThinking LLMs: General Instruction Following with Thought Generation.Tianhao Wu, Janice Lan, Weizhe Yuan, Jiantao Jiao, Jason E. Weston, Sainbayar Sukhbaatar
2025ICMLToken Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning.DiJia Su, Hanlin Zhu, Yingchen Xu, Jiantao Jiao, Yuandong Tian, Qinqing Zheng
2024ICMLIterative Data Smoothing: Mitigating Reward Overfitting and Overoptimization in RLHF.Banghua Zhu, Michael I. Jordan, Jiantao Jiao
2024ICRAGuided Online Distillation: Promoting Safe Reinforcement Learning by Offline Demonstration.Jinning Li, Xinyi Liu, Banghua Zhu, Jiantao Jiao, Masayoshi Tomizuka, Chen Tang, Wei Zhan
2023AAAISecuring Secure Aggregation: Mitigating Multi-Round Privacy Leakage in Federated Learning.Jinhyun So, Ramy E. Ali, Basak Gler, Jiantao Jiao, Amir Salman Avestimehr
2023AISTATSByzantine-Robust Federated Learning with Optimal Statistical Rates.Banghua Zhu, Lun Wang, Qi Pang, Shuai Wang, Jiantao Jiao, Dawn Song, Michael I. Jordan
2023ICLROptimal Conservative Offline RL with General Function Approximation via Augmented Lagrangian.Paria Rashidinejad, Hanlin Zhu, Kunhe Yang, Stuart Russell, Jiantao Jiao
2023ICMLJump-Start Reinforcement Learning.Ikechukwu Uchendu, Ted Xiao, Yao Lu, Banghua Zhu, Mengyuan Yan, Josphine Simon, Matthew Bennice, Chuyuan Fu, Cong Ma, Jiantao Jiao, Sergey Levine, Karol Hausman
2023ICMLOnline Learning in Stackelberg Games with an Omniscient Follower.Geng Zhao, Banghua Zhu, Jiantao Jiao, Michael I. Jordan
2023ICMLPrincipled Reinforcement Learning with Human Feedback from Pairwise or K-wise Comparisons.Banghua Zhu, Michael I. Jordan, Jiantao Jiao
2023ISITOn the Optimal Bounds for Noisy Computing.Banghua Zhu, Ziao Wang, Nadim Ghaddar, Jiantao Jiao, Lele Wang
2022ICMLNearly Optimal Policy Optimization with Stable at Any Time Guarantee.Tianhao Wu, Yunchang Yang, Han Zhong, Liwei Wang, Simon S. Du, Jiantao Jiao
2022ISITRobust Estimation for Non-parametric Families via Generative Adversarial Networks.Banghua Zhu, Jiantao Jiao, Michael I. Jordan
2020ISITWhen does the Tukey Median work?Banghua Zhu, Jiantao Jiao, Jacob Steinhardt
2019ICMLTheoretically Principled Trade-off between Robustness and Accuracy.Hongyang Zhang, Yaodong Yu, Jiantao Jiao, Eric P. Xing, Laurent El Ghaoui, Michael I. Jordan
2019MOBIHOCBarracuda: The Power of ℓ-polling in Proof-of-Stake Blockchains.Giulia Fanti, Jiantao Jiao, Ashok Vardhan Makkuva, Sewoong Oh, Ranvir Rana, Pramod Viswanath
2018COLTLocal moment matching: A unified methodology for symmetric functional estimation and distribution estimation under Wasserstein distance.Yanjun Han, Jiantao Jiao, Tsachy Weissman
2018ISITMinimax Redundancy for Markov Chains with Large State Space.Kedar Tatwawadi, Jiantao Jiao, Tsachy Weissman
2017ISITDependence measures bounding the exploration bias for general measurements.Jiantao Jiao, Yanjun Han, Tsachy Weissman
2016ACSSCBeyond maximum likelihood: Boosting the Chow-Liu algorithm for large alphabets.Jiantao Jiao, Yanjun Han, Tsachy Weissman
2016ISITMinimax estimation of the L1 distance.Jiantao Jiao, Yanjun Han, Tsachy Weissman
2016ISITMutual information, relative entropy and estimation error in semi-martingale channels.Jiantao Jiao, Kartik Venkat, Tsachy Weissman
2016ISITAMinimax rate-optimal estimation of KL divergence between discrete distributions.Yanjun Han, Jiantao Jiao, Tsachy Weissman
2015ISITDoes dirichlet prior smoothing solve the Shannon entropy estimation problem?Yanjun Han, Jiantao Jiao, Tsachy Weissman
2015ISITAdaptive estimation of Shannon entropy.Yanjun Han, Jiantao Jiao, Tsachy Weissman
2015ISITMinimax estimation of discrete distributions.Yanjun Han, Jiantao Jiao, Tsachy Weissman
2015ISITMaximum Likelihood Estimation of information measures.Jiantao Jiao, Kartik Venkat, Yanjun Han, Tsachy Weissman
2015ISITMinimax estimation of information measures.Jiantao Jiao, Kartik Venkat, Yanjun Han, Tsachy Weissman
2014ISITInformation divergences and the curious case of the binary alphabet.Jiantao Jiao, Thomas A. Courtade, Albert No, Kartik Venkat, Tsachy Weissman
2014ISITJustification of logarithmic loss via the benefit of side information.Jiantao Jiao, Thomas A. Courtade, Kartik Venkat, Tsachy Weissman
2014ISITRelations between information and estimation in scalar Lvy channels.Jiantao Jiao, Kartik Venkat, Tsachy Weissman
2013ISITPointwise relations between information and estimation in the Poisson channel.Jiantao Jiao, Kartik Venkat, Tsachy Weissman
2012ISITUniversal estimation of directed information via sequential probability assignments.Jiantao Jiao, Haim H. Permuter, Lei Zhao, Young-Han Kim, Tsachy Weissman
2010SENSYSNOMAD: networked-observation and mobile-agent-based scene abstraction and determination.Lin Zhang, Wenzhu Zhang, Xinyu Mao, Jiantao Jiao, Shijie Zheng, Linglong Li, Yujie Liu, Teng Wang, Ming Gu