Plan Better Amid Conservatism: Offline Multi-Agent Reinforcement Learning with Actor Rectification.
Ling Pan, Longbo Huang, Tengyu Ma, Huazhe Xu
Browse the full ICML paper archive.
Ling Pan, Longbo Huang, Tengyu Ma, Huazhe Xu
Browse the full ICML paper archive.