Skip to content

A Minimax Learning Approach to Off-Policy Evaluation in Confounded Partially Observable Markov Decision Processes.

Chengchun Shi, Masatoshi Uehara, Jiawei Huang, Nan Jiang

VenueA*ICML
Year2022
ProceedingsICML

Browse the full ICML paper archive.