Skip to content

Hanze Dong

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

21

Venues

9

Active years

2022–2026

Best venue rank

A*

Where they publish

Papers

21 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLBeyond 'Aha!': Toward Systematic Meta-Abilities Alignment in Large Reasoning Models.Zhiyuan Hu, Yibo Wang, Hanze Dong, Yuhui Xu, Amrita Saha, Caiming Xiong, Bryan Hooi, Junnan Li
2026COLTAlmost Linear Convergence under Minimal Score Assumptions: Quantized Transition Diffusion.Xunpeng Huang, Yingyu Lin, Nikki Lijing Kuang, Hanze Dong, Difan Zou, Yian Ma, Tong Zhang
2025ACLOffline Reinforcement Learning for LLM Multi-step Reasoning.Huaijie Wang, Shibo Hao, Hanze Dong, Shenao Zhang, Yilin Bao, Ziran Yang, Yi Wu
2025ICLRThinK: Thinner Key Cache by Query-Driven Pruning.Yuhui Xu, Zhanming Jie, Hanze Dong, Lei Wang, Xudong Lu, Aojun Zhou, Amrita Saha, Caiming Xiong, Doyen Sahoo
2025ICLRAutomatic Curriculum Expert Iteration for Reliable LLM Reasoning.Zirui Zhao, Hanze Dong, Amrita Saha, Caiming Xiong, Doyen Sahoo
2025ICMLReward-Guided Speculative Decoding for Efficient LLM Reasoning.Baohao Liao, Yuhui Xu, Hanze Dong, Junnan Li, Christof Monz, Silvio Savarese, Doyen Sahoo, Caiming Xiong
2024COLTFaster Sampling without Isoperimetry via Diffusion-based Monte Carlo.Xunpeng Huang, Difan Zou, Hanze Dong, Yi-An Ma, Tong Zhang
2024EMNLPMitigating the Alignment Tax of RLHF.Yong Lin, Hangyu Lin, Wei Xiong, Shizhe Diao, Jianmeng Liu, Jipeng Zhang, Rui Pan, Haoxiang Wang, Wenbin Hu, Hanning Zhang, Hanze Dong, Renjie Pi, Han Zhao, Nan Jiang, Heng Ji, Yuan Yao, Tong Zhang
2024EMNLPMLLM-Protector: Ensuring MLLM's Safety without Hurting Performance.Renjie Pi, Tianyang Han, Jianshu Zhang, Yueqi Xie, Rui Pan, Qing Lian, Hanze Dong, Jipeng Zhang, Tong Zhang
2024EMNLPFIRST: Teach A Reliable Large Language Model Through Efficient Trustworthy Distillation.KaShun Shum, Minrui Xu, Jianshu Zhang, Zixin Chen, Shizhe Diao, Hanze Dong, Jipeng Zhang, Muhammad Omer Raza
2024ICLRReverse Diffusion Monte Carlo.Xunpeng Huang, Hanze Dong, Yifan Hao, Yian Ma, Tong Zhang
2024ICLRSpurious Feature Diversification Improves Out-of-distribution Generalization.Yong Lin, Lu Tan, Yifan Hao, Honam Wong, Hanze Dong, Weizhong Zhang, Yujiu Yang, Tong Zhang
2024ICMLIterative Preference Learning from Human Feedback: Bridging Theory and Practice for RLHF under KL-constraint.Wei Xiong, Hanze Dong, Chenlu Ye, Ziqi Wang, Han Zhong, Heng Ji, Nan Jiang, Tong Zhang
2024ICMLFaster Sampling via Stochastic Gradient Proximal Sampler.Xunpeng Huang, Difan Zou, Hanze Dong, Yian Ma, Tong Zhang
2024NAACLLMFlow: An Extensible Toolkit for Finetuning and Inference of Large Foundation Models.Shizhe Diao, Rui Pan, Hanze Dong, Kashun Shum, Jipeng Zhang, Wei Xiong, Tong Zhang
2024SETTAEnhancing Multi-modal Regular Expression Synthesis via Large Language Models and Semantic Manipulations of Sub-expressions.Zipan Tang, Yixuan Yan, Rongchen Li, Hanze Dong, Haiming Chen, Hongyu Gao
2023AISTATSCatalyst Acceleration of Error Compensated Methods Leads to Better Communication Complexity.Xun Qian, Hanze Dong, Tong Zhang, Peter Richtrik
2023EMNLPDetGPT: Detect What You Need via Reasoning.Renjie Pi, Jiahui Gao, Shizhe Diao, Rui Pan, Hanze Dong, Jipeng Zhang, Lewei Yao, Jianhua Han, Hang Xu, Lingpeng Kong, Tong Zhang
2023ICLRParticle-based Variational Inference with Preconditioned Functional Gradient Flow.Hanze Dong, Xi Wang, Yong Lin, Tong Zhang
2022CVPRBayesian Invariant Risk Minimization.Yong Lin, Hanze Dong, Hao Wang, Tong Zhang
2022ICMLLocal Augmentation for Graph Neural Networks.Songtao Liu, Rex Ying, Hanze Dong, Lanqing Li, Tingyang Xu, Yu Rong, Peilin Zhao, Junzhou Huang, Dinghao Wu