Skip to content

Value-aligned Behavior Cloning for Offline Reinforcement Learning via Bi-level Optimization.

Xingyu Jiang, Ning Gao, Xiuhui Zhang, Hongkun Dou, Yue Deng

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.