Regularizing a Model-based Policy Stationary Distribution to Stabilize Offline Reinforcement Learning.
Shentao Yang, Yihao Feng, Shujian Zhang, Mingyuan Zhou
Browse the full ICML paper archive.
Shentao Yang, Yihao Feng, Shujian Zhang, Mingyuan Zhou
Browse the full ICML paper archive.