Skip to content

Combining policy gradient and Q-learning.

Brendan O'Donoghue, Rmi Munos, Koray Kavukcuoglu, Volodymyr Mnih

VenueA*ICLR
Year2017
ProceedingsICLR (Poster)

Browse the full ICLR paper archive.