Q-SAT: Value Factorization with Self-Attention for Deep Multi-Agent Reinforcement Learning.
Xunhan Hu, Jian Zhao, Youpeng Zhao, Wengang Zhou, Houqiang Li
Browse the full IJCNN paper archive.
Xunhan Hu, Jian Zhao, Youpeng Zhao, Wengang Zhou, Houqiang Li
Browse the full IJCNN paper archive.