Horizon-free Reinforcement Learning in Adversarial Linear Mixture MDPs.
Kaixuan Ji, Qingyue Zhao, Jiafan He, Weitong Zhang, Quanquan Gu
Browse the full ICLR paper archive.
Kaixuan Ji, Qingyue Zhao, Jiafan He, Weitong Zhang, Quanquan Gu
Browse the full ICLR paper archive.