Skip to content

Nearly Minimax Optimal Offline Reinforcement Learning with Linear Function Approximation: Single-Agent MDP and Markov Game.

Wei Xiong, Han Zhong, Chengshuai Shi, Cong Shen, Liwei Wang, Tong Zhang

VenueA*ICLR
Year2023
ProceedingsICLR

Browse the full ICLR paper archive.