MA-TREX: Mutli-agent Trajectory-Ranked Reward Extrapolation via Inverse Reinforcement Learning.
Sili Huang, Bo Yang, Hechang Chen, Haiyin Piao, Zhixiao Sun, Yi Chang
Browse the full KSEM paper archive.
Sili Huang, Bo Yang, Hechang Chen, Haiyin Piao, Zhixiao Sun, Yi Chang
Browse the full KSEM paper archive.