Flow to Better: Offline Preference-based Reinforcement Learning via Preferred Trajectory Generation.
Zhilong Zhang, Yihao Sun, Junyin Ye, Tian-Shuo Liu, Jiaji Zhang, Yang Yu
Browse the full ICLR paper archive.
Zhilong Zhang, Yihao Sun, Junyin Ye, Tian-Shuo Liu, Jiaji Zhang, Yang Yu
Browse the full ICLR paper archive.