Skip to content

Zishun Yu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

8

Venues

5

Active years

2022–2026

Best venue rank

A*

Where they publish

Papers

8 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAILanguage Model Distillation: A Temporal Difference Imitation Learning Perspective.Zishun Yu, Shangzhe Li, Xinhua Zhang
2025AAAITowards Efficient Collaboration via Graph Modeling in Reinforcement Learning.Wenzhe Fan, Zishun Yu, Chengdong Ma, Changye Li, Yaodong Yang, Xinhua Zhang
2025ICMLThink Smarter not Harder: Adaptive Reasoning with Inference Aware Optimization.Zishun Yu, Tengyu Xu, Di Jin, Karthik Abinav Sankararaman, Yun He, Wenxuan Zhou, Zhouhao Zeng, Eryk Helenowski, Chen Zhu, Sinong Wang, Hao Ma, Han Fang
2024ALTSlowly Changing Adversarial Bandit Algorithms are Efficient for Discounted MDPs.Ian A. Kash, Lev Reyzin, Zishun Yu
2024ICLRB-Coder: Value-Based Deep Reinforcement Learning for Program Synthesis.Zishun Yu, Yunzhe Tao, Liyu Chen, Tao Sun, Hongxia Yang
2024UAIOffline Reward Perturbation Boosts Distributional Shift in Online RL.Zishun Yu, Siteng Kang, Xinhua Zhang
2023ICMLActor-Critic Alignment for Offline-to-Online Reinforcement Learning.Zishun Yu, Xinhua Zhang
2022UAIOrthogonal Gromov-Wasserstein discrepancy with efficient lower bound.Hongwei Jin, Zishun Yu, Xinhua Zhang