Robot behavior adaptation for human-robot interaction based on policy gradient reinforcement learning.
Noriaki Mitsunaga, Christian Smith, Takayuki Kanda, Hiroshi Ishiguro, Norihiro Hagita
Browse the full IROS paper archive.
Noriaki Mitsunaga, Christian Smith, Takayuki Kanda, Hiroshi Ishiguro, Norihiro Hagita
Browse the full IROS paper archive.