Efficient and Stable Offline-to-online Reinforcement Learning via Continual Policy Revitalization.
Rui Kong, Chenyang Wu, Chen-Xiao Gao, Zongzhang Zhang, Ming Li
Browse the full IJCAI paper archive.
Rui Kong, Chenyang Wu, Chen-Xiao Gao, Zongzhang Zhang, Ming Li
Browse the full IJCAI paper archive.