Skip to content

Shangtong Zhang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

22

Venues

5

Active years

2019–2026

Best venue rank

A*

Where they publish

Papers

22 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIAsymptotic and Finite Sample Analysis of Nonexpansive Stochastic Approximations with Markovian Noise.Ethan Blaser, Shangtong Zhang
2026DATEPRISM: A Locality-Aware Near-Memory Processing Framework for Scalable Triangle Counting.Shangtong Zhang, Xueyan Wang, Yier Jin
2025AAAIEfficient Multi-Policy Evaluation for Reinforcement Learning.Shuze Daniel Liu, Claire Chen, Shangtong Zhang
2025ICLREfficient Policy Evaluation with Safety Constraint for Reinforcement Learning.Claire Chen, Shuze Daniel Liu, Shangtong Zhang
2025ICLRDoubly Optimal Policy Evaluation for Reinforcement Learning.Shuze Daniel Liu, Claire Chen, Shangtong Zhang
2025ICLRRevisiting a Design Choice in Gradient Temporal Difference Learning.Xiaochi Qian, Shangtong Zhang
2025ICLRTransformers Can Learn Temporal Difference Methods for In-Context Reinforcement Learning.Jiuqi Wang, Ethan Blaser, Hadi Daneshmand, Shangtong Zhang
2025ICMLLinear Q-Learning Does Not Diverge in L2: Convergence Rates to a Bounded Set.Xinyu Liu, Zixuan Xie, Shangtong Zhang
2025IJCAICounterfactual Explanations for Continuous Action Reinforcement Learning.Shuyang Dong, Shangtong Zhang, Lu Feng
2024ICMLEfficient Policy Evaluation with Offline Data Informed Behavior Policy Design.Shuze Daniel Liu, Shangtong Zhang
2023AAAIA New Challenge in Policy Evaluation.Shangtong Zhang
2023ICMLOn the Convergence of SARSA with Linear Function Approximation.Shangtong Zhang, Remi Tachet des Combes, Romain Laroche
2022AAAILearning Expected Emphatic Traces for Deep RL.Ray Jiang, Shangtong Zhang, Veronica Chelu, Adam White, Hado van Hasselt
2021AAAIMean-Variance Policy Iteration for Risk-Averse Reinforcement Learning.Shangtong Zhang, Bo Liu, Shimon Whiteson
2021ICMLAverage-Reward Off-Policy Policy Evaluation with Function Approximation.Shangtong Zhang, Yi Wan, Richard S. Sutton, Shimon Whiteson
2021ICMLBreaking the Deadly Triad with a Target Network.Shangtong Zhang, Hengshuai Yao, Shimon Whiteson
2021IJCAIDeep Residual Reinforcement Learning (Extended Abstract).Shangtong Zhang, Wendelin Boehmer, Shimon Whiteson
2020AAAIMega-Reward: Achieving Human-Level Play without Extrinsic Rewards.Yuhang Song, Jianyi Wang, Thomas Lukasiewicz, Zhenghua Xu, Shangtong Zhang, Andrzej Wojcicki, Mai Xu
2020ICMLGradientDICE: Rethinking Generalized Offline Estimation of Stationary Values.Shangtong Zhang, Bo Liu, Shimon Whiteson
2020ICMLProvably Convergent Two-Timescale Off-Policy Actor-Critic with Function Approximation.Shangtong Zhang, Bo Liu, Hengshuai Yao, Shimon Whiteson
2019AAAIACE: An Actor Ensemble Algorithm for Continuous Control with Tree Search.Shangtong Zhang, Hengshuai Yao
2019AAAIQUOTA: The Quantile Option Architecture for Reinforcement Learning.Shangtong Zhang, Hengshuai Yao