Randomized Linear Programming for Tabular Average-Cost Multi-agent Reinforcement Learning.
Alec Koppel, Amrit Singh Bedi, Bhargav Ganguly, Vaneet Aggarwal
Browse the full ACSSC paper archive.
Alec Koppel, Amrit Singh Bedi, Bhargav Ganguly, Vaneet Aggarwal
Browse the full ACSSC paper archive.