Skip to content

Near-Optimal Provable Uniform Convergence in Offline Policy Evaluation for Reinforcement Learning.

Ming Yin, Yu Bai, Yu-Xiang Wang

Year2021
ProceedingsAISTATS

Browse the full AISTATS paper archive.