Model-free Reinforcement Learning in Infinite-horizon Average-reward Markov Decision Processes.
Chen-Yu Wei, Mehdi Jafarnia-Jahromi, Haipeng Luo, Hiteshi Sharma, Rahul Jain
Browse the full ICML paper archive.
Chen-Yu Wei, Mehdi Jafarnia-Jahromi, Haipeng Luo, Hiteshi Sharma, Rahul Jain
Browse the full ICML paper archive.