Finite-Memory Near-Optimal Learning for Markov Decision Processes with Long-Run Average Reward.
Jan Kretnsk, Fabian Michel, Lukas Michel, Guillermo A. Prez
Browse the full UAI paper archive.
Jan Kretnsk, Fabian Michel, Lukas Michel, Guillermo A. Prez
Browse the full UAI paper archive.