Skip to content

SURF: Semi-supervised Reward Learning with Data Augmentation for Feedback-efficient Preference-based Reinforcement Learning.

Jongjin Park, Younggyo Seo, Jinwoo Shin, Honglak Lee, Pieter Abbeel, Kimin Lee

VenueA*ICLR
Year2022
ProceedingsICLR

Browse the full ICLR paper archive.