Skip to content

OptionGAN: Learning Joint Reward-Policy Options Using Generative Adversarial Inverse Reinforcement Learning.

Peter Henderson, Wei-Di Chang, Pierre-Luc Bacon, David Meger, Joelle Pineau, Doina Precup

VenueA*AAAI
Year2018
ProceedingsAAAI

Browse the full AAAI paper archive.