Learning Explicit Credit Assignment for Cooperative Multi-Agent Reinforcement Learning via Polarization Policy Gradient.
Wubing Chen, Wenbin Li, Xiao Liu, Shangdong Yang, Yang Gao
Browse the full AAAI paper archive.
Wubing Chen, Wenbin Li, Xiao Liu, Shangdong Yang, Yang Gao
Browse the full AAAI paper archive.