Sample and Feedback Efficient Hierarchical Reinforcement Learning from Human Preferences.
Robert Pinsler, Riad Akrour, Takayuki Osa, Jan Peters, Gerhard Neumann
Browse the full ICRA paper archive.
Robert Pinsler, Riad Akrour, Takayuki Osa, Jan Peters, Gerhard Neumann
Browse the full ICRA paper archive.