OPIRL: Sample Efficient Off-Policy Inverse Reinforcement Learning via Distribution Matching.
Hana Hoshino, Kei Ota, Asako Kanezaki, Rio Yokota
Browse the full ICRA paper archive.
Hana Hoshino, Kei Ota, Asako Kanezaki, Rio Yokota
Browse the full ICRA paper archive.