Deployment-Efficient Reinforcement Learning via Model-Based Offline Optimization.
Tatsuya Matsushima, Hiroki Furuta, Yutaka Matsuo, Ofir Nachum, Shixiang Gu
Browse the full ICLR paper archive.
Tatsuya Matsushima, Hiroki Furuta, Yutaka Matsuo, Ofir Nachum, Shixiang Gu
Browse the full ICLR paper archive.