Continuous valued Q-learning method able to incrementally refine state space.
Masanori Takeda, Takayuki Nakamura, Tsukasa Ogasawara
Browse the full IROS paper archive.
Masanori Takeda, Takayuki Nakamura, Tsukasa Ogasawara
Browse the full IROS paper archive.