Skip to content

Pessimistic Nonlinear Least-Squares Value Iteration for Offline Reinforcement Learning.

Qiwei Di, Heyang Zhao, Jiafan He, Quanquan Gu

VenueA*ICLR
Year2024
ProceedingsICLR

Browse the full ICLR paper archive.