Skip to content

Can You Rely on Synthetic Labellers in Preference-Based Reinforcement Learning? It's Complicated.

Katherine Metcalf, Miguel Sarabia, Masha Fedzechkina, Barry-John Theobald

VenueA*AAAI
Year2024
ProceedingsAAAI

Browse the full AAAI paper archive.