Correct Me If I'm Wrong: Using Non-Experts to Repair Reinforcement Learning Policies.
Sanne van Waveren, Christian Pek, Jana Tumova, Iolanda Leite
Browse the full HRI paper archive.
Sanne van Waveren, Christian Pek, Jana Tumova, Iolanda Leite
Browse the full HRI paper archive.