Skip to content

Chuheng Zhang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

21

Venues

9

Active years

2020–2025

Best venue rank

A*

Where they publish

Papers

21 indexed papers, newest first.

YearVenueTitleAuthors
2025ICMLAdaptiveStep: Automatically Dividing Reasoning Step through Model Confidence.Yuliang Liu, Junjie Lu, Chaofeng Qu, Zhaoling Chen, Zefan Cai, Jason Klein Liu, Chonghan Liu, Yunhui Xia, Li Zhao, Jiang Bian, Chuheng Zhang, Wei Shen, Zhouhan Lin
2025ICMLPolicy Filtration for RLHF to Mitigate Noise in Reward Models.Chuheng Zhang, Wei Shen, Li Zhao, Xuyun Zhang, Xiaolong Xu, Wanchun Dou, Jiang Bian
2024ACLHard Prompts Made Interpretable: Sparse Entropy Regularization for Prompt Tuning with RL.Yunseon Choi, Sangmin Bae, Seonghyun Ban, Minchan Jeong, Chuheng Zhang, Lei Song, Li Zhao, Jiang Bian, Kee-Eung Kim
2024ICLRWhittle Index with Multiple Actions and State Constraint for Inventory Management.Chuheng Zhang, Xiangsen Wang, Wei Jiang, Xianliang Yang, Siwei Wang, Lei Song, Jiang Bian
2024IJCAIDiversification of Adaptive Policy for Effective Offline Reinforcement Learning.Yunseon Choi, Li Zhao, Chuheng Zhang, Lei Song, Jiang Bian, Kee-Eung Kim
2023AAAIRePreM: Representation Pre-training with Masked Model for Reinforcement Learning.Yuanying Cai, Chuheng Zhang, Wei Shen, Xuyun Zhang, Wenjie Ruan, Longbo Huang
2023ICMLRobust Situational Reinforcement Learning in Face of Context Disturbances.Jinpeng Zhang, Yufeng Zheng, Chuheng Zhang, Li Zhao, Lei Song, Yuan Zhou, Jiang Bian
2023IJCAITowards Generalizable Reinforcement Learning for Trade Execution.Chuheng Zhang, Yitong Duan, Xiaoyu Chen, Jianyu Chen, Jian Li, Li Zhao
2022CIKMImitation Learning to Outperform Demonstrators by Directly Extrapolating Demonstrations.Yuanying Cai, Chuheng Zhang, Wei Shen, Xiaonan He, Xuyun Zhang, Longbo Huang
2022CIKMA Transformer-Based User Satisfaction Prediction for Proactive Interaction Mechanism in DuerOS.Wei Shen, Xiaonan He, Chuheng Zhang, Xuyun Zhang, Jian Xie
2022CIKMLearning List-wise Representation in Reinforcement Learning for Ads Allocation with Multiple Auxiliary Tasks.Ze Wang, Guogang Liao, Xiaowen Shi, Xiaoxu Wu, Chuheng Zhang, Yongkang Wang, Xingxing Wang, Dong Wang
2022CIKMHybrid Transfer in Deep Reinforcement Learning for Ads Allocation.Ze Wang, Guogang Liao, Xiaowen Shi, Xiaoxu Wu, Chuheng Zhang, Bingqi Zhu, Yongkang Wang, Xingxing Wang, Dong Wang
2022ICDMTD3 with Reverse KL Regularizer for Offline Reinforcement Learning from Mixed Datasets.Yuanying Cai, Chuheng Zhang, Li Zhao, Wei Shen, Xuyun Zhang, Lei Song, Jiang Bian, Tao Qin, Tieyan Liu
2022WWWCross DQN: Cross Deep Q Network for Ads Allocation in Feed.Guogang Liao, Ze Wang, Xiaoxu Wu, Xiaowen Shi, Chuheng Zhang, Yongkang Wang, Xingxing Wang, Dong Wang
2022SIGIRDeep Page-Level Interest Network in Reinforcement Learning for Ads Allocation.Guogang Liao, Xiaowen Shi, Ze Wang, Xiaoxu Wu, Chuheng Zhang, Yongkang Wang, Xingxing Wang, Dong Wang
2021AAAIExploration by Maximizing Renyi Entropy for Reward-Free RL Framework.Chuheng Zhang, Yuanying Cai, Longbo Huang, Jian Li
2021CIKMInductive Matrix Completion Using Graph Autoencoder.Wei Shen, Chuheng Zhang, Yun Tian, Liang Zeng, Xiaonan He, Wanchun Dou, Xiaolong Xu
2021ICLRReturn-Based Contrastive Representation Learning for Reinforcement Learning.Guoqing Liu, Chuheng Zhang, Li Zhao, Tao Qin, Jinhua Zhu, Jian Li, Nenghai Yu, Tie-Yan Liu
2020AAAIPolicy Search by Target Distribution Learning for Continuous Control.Chuheng Zhang, Yuanqi Li, Jian Li
2020CIKMAuxiliary-task Based Deep Reinforcement Learning for Participant Selection Problem in Mobile Crowdsourcing.Wei Shen, Xiaonan He, Chuheng Zhang, Qiang Ni, Wanchun Dou, Yan Wang
2020ICDMDoubleEnsemble: A New Ensemble Method Based on Sample Reweighting and Feature Selection for Financial Data Analysis.Chuheng Zhang, Yuanqi Li, Xi Chen, Yifei Jin, Pingzhong Tang, Jian Li