Skip to content

Provable Offline Preference-Based Reinforcement Learning.

Wenhao Zhan, Masatoshi Uehara, Nathan Kallus, Jason D. Lee, Wen Sun

VenueA*ICLR
Year2024
ProceedingsICLR

Browse the full ICLR paper archive.