Skip to content

Efficient Online Reinforcement Learning Fine-Tuning Need Not Retain Offline Data.

Zhiyuan Zhou, Andy Peng, Qiyang Li, Sergey Levine, Aviral Kumar

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.