Skip to content

Learning Adversarial Markov Decision Processes with Bandit Feedback and Unknown Transition.

Chi Jin, Tiancheng Jin, Haipeng Luo, Suvrit Sra, Tiancheng Yu

VenueA*ICML
Year2020
ProceedingsICML

Browse the full ICML paper archive.