Skip to content

In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning.

Songjun Tu, Jingbo Sun, Qichao Zhang, Yaocheng Zhang, Jia Liu, Ke Chen, Dongbin Zhao

VenueA*AAAI
Year2025
ProceedingsAAAI

Browse the full AAAI paper archive.