Skip to content

Off-Policy Temporal Difference Learning with Function Approximation.

Doina Precup, Richard S. Sutton, Sanjoy Dasgupta

VenueA*ICML
Year2001
ProceedingsICML

Browse the full ICML paper archive.