Skip to content

Shixiang Gu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

17

Venues

5

Active years

2016–2023

Best venue rank

A*

Where they publish

Papers

17 indexed papers, newest first.

YearVenueTitleAuthors
2023EMNLPLarge Language Models Can Self-Improve.Jiaxin Huang, Shixiang Gu, Le Hou, Yuexin Wu, Xuezhi Wang, Hongkun Yu, Jiawei Han
2021ICLRDeployment-Efficient Reinforcement Learning via Model-Based Offline Optimization.Tatsuya Matsushima, Hiroki Furuta, Yutaka Matsuo, Ofir Nachum, Shixiang Gu
2020EMNLPHuman-centric dialog training via offline reinforcement learning.Natasha Jaques, Judy Hanwen Shen, Asma Ghandeharioun, Craig Ferguson, gata Lapedriza, Noah Jones, Shixiang Gu, Rosalind W. Picard
2020ICLRDynamics-Aware Unsupervised Discovery of Skills.Archit Sharma, Shixiang Gu, Sergey Levine, Vikash Kumar, Karol Hausman
2019CoRLA Divergence Minimization Perspective on Imitation Learning Methods.Seyed Kamyar Seyed Ghasemipour, Richard S. Zemel, Shixiang Gu
2019ICLRNear-Optimal Representation Learning for Hierarchical Reinforcement Learning.Ofir Nachum, Shixiang Gu, Honglak Lee, Sergey Levine
2019ICLRDoubly Reparameterized Gradient Estimators for Monte Carlo Objectives.George Tucker, Dieterich Lawson, Shixiang Gu, Chris J. Maddison
2018ICLRLeave no Trace: Learning to Reset for Safe and Autonomous Reinforcement Learning.Benjamin Eysenbach, Shixiang Gu, Julian Ibarz, Sergey Levine
2018ICLRTemporal Difference Models: Model-Free Deep RL for Model-Based Control.Vitchyr Pong, Shixiang Gu, Murtaza Dalal, Sergey Levine
2018ICLRThe Mirage of Action-Dependent Baselines in Reinforcement Learning.George Tucker, Surya Bhupatiraju, Shixiang Gu, Richard E. Turner, Zoubin Ghahramani, Sergey Levine
2018ICMLThe Mirage of Action-Dependent Baselines in Reinforcement Learning.George Tucker, Surya Bhupatiraju, Shixiang Gu, Richard E. Turner, Zoubin Ghahramani, Sergey Levine
2017ICLRQ-Prop: Sample-Efficient Policy Gradient with An Off-Policy Critic.Shixiang Gu, Timothy P. Lillicrap, Zoubin Ghahramani, Richard E. Turner, Sergey Levine
2017ICLRCategorical Reparameterization with Gumbel-Softmax.Eric Jang, Shixiang Gu, Ben Poole
2017ICLRTuning Recurrent Neural Networks with Reinforcement Learning.Natasha Jaques, Shixiang Gu, Richard E. Turner, Douglas Eck
2017ICMLSequence Tutor: Conservative Fine-Tuning of Sequence Generation Models with KL-control.Natasha Jaques, Shixiang Gu, Dzmitry Bahdanau, Jos Miguel Hernndez-Lobato, Richard E. Turner, Douglas Eck
2017ICRADeep reinforcement learning for robotic manipulation with asynchronous off-policy updates.Shixiang Gu, Ethan Holly, Timothy P. Lillicrap, Sergey Levine
2016ICMLContinuous Deep Q-Learning with Model-based Acceleration.Shixiang Gu, Timothy P. Lillicrap, Ilya Sutskever, Sergey Levine