Skip to content

Provable Reward-Agnostic Preference-Based Reinforcement Learning.

Wenhao Zhan, Masatoshi Uehara, Wen Sun, Jason D. Lee

VenueA*ICLR
Year2024
ProceedingsICLR

Browse the full ICLR paper archive.