Continual Multi-Objective Reinforcement Learning via Reward Model Rehearsal.
Lihe Li, Ruotong Chen, Ziqian Zhang, Zhichao Wu, Yi-Chen Li, Cong Guan, Yang Yu, Lei Yuan
Browse the full IJCAI paper archive.
Lihe Li, Ruotong Chen, Ziqian Zhang, Zhichao Wu, Yi-Chen Li, Cong Guan, Yang Yu, Lei Yuan
Browse the full IJCAI paper archive.