Skip to content

Learning Intrinsic Rewards as a Bi-Level Optimization Problem.

Bradly C. Stadie, Lunjun Zhang, Jimmy Ba

VenueAUAI
Year2020
ProceedingsUAI

Browse the full UAI paper archive.