Offline Reinforcement Learning with Realizability and Single-policy Concentrability.
Wenhao Zhan, Baihe Huang, Audrey Huang, Nan Jiang, Jason D. Lee
Browse the full COLT paper archive.
Wenhao Zhan, Baihe Huang, Audrey Huang, Nan Jiang, Jason D. Lee
Browse the full COLT paper archive.