Skip to content

Flow to Better: Offline Preference-based Reinforcement Learning via Preferred Trajectory Generation.

Zhilong Zhang, Yihao Sun, Junyin Ye, Tian-Shuo Liu, Jiaji Zhang, Yang Yu

VenueA*ICLR
Year2024
ProceedingsICLR

Browse the full ICLR paper archive.