Skip to content

Query-Policy Misalignment in Preference-Based Reinforcement Learning.

Xiao Hu, Jianxiong Li, Xianyuan Zhan, Qing-Shan Jia, Ya-Qin Zhang

VenueA*ICLR
Year2024
ProceedingsICLR

Browse the full ICLR paper archive.