Skip to content

The Mirage of Action-Dependent Baselines in Reinforcement Learning.

George Tucker, Surya Bhupatiraju, Shixiang Gu, Richard E. Turner, Zoubin Ghahramani, Sergey Levine

VenueA*ICLR
Year2018
ProceedingsICLR (Workshop)

Browse the full ICLR paper archive.