Skip to content

Learning Value Functions in Deep Policy Gradients using Residual Variance.

Yannis Flet-Berliac, Reda Ouhamma, Odalric-Ambrym Maillard, Philippe Preux

VenueA*ICLR
Year2021
ProceedingsICLR

Browse the full ICLR paper archive.