HCPO: Hierarchical Conductor-Based Policy Optimization in Multi-Agent Reinforcement Learning.
Zejiao Liu, Junqi Tu, Yitian Hong, Luolin Xiong, Yaochu Jin, Yang Tang, Fangfei Li
Browse the full AAAI paper archive.
Zejiao Liu, Junqi Tu, Yitian Hong, Luolin Xiong, Yaochu Jin, Yang Tang, Fangfei Li
Browse the full AAAI paper archive.