A decentralized policy gradient approach to multi-task reinforcement learning.
Sihan Zeng, Malik Aqeel Anwar, Thinh T. Doan, Arijit Raychowdhury, Justin Romberg
Browse the full UAI paper archive.
Sihan Zeng, Malik Aqeel Anwar, Thinh T. Doan, Arijit Raychowdhury, Justin Romberg
Browse the full UAI paper archive.