Skip to content

Aligning Human Preferences with Baseline Objectives in Reinforcement Learning.

Daniel Marta, Simon Holk, Christian Pek, Jana Tumova, Iolanda Leite

VenueA*ICRA
Year2023
ProceedingsICRA

Browse the full ICRA paper archive.