Diminishing Return of Value Expansion Methods in Model-Based Reinforcement Learning.
Daniel Palenicek, Michael Lutter, Joao Carvalho, Jan Peters
Browse the full ICLR paper archive.
Daniel Palenicek, Michael Lutter, Joao Carvalho, Jan Peters
Browse the full ICLR paper archive.