Skip to content

POCE: Primal Policy Optimization with Conservative Estimation for Multi-constraint Offline Reinforcement Learning.

Jiayi Guan, Li Shen, Ao Zhou, Lusong Li, Han Hu, Xiaodong He, Guang Chen, Changjun Jiang

VenueA*CVPR
Year2024
ProceedingsCVPR

Browse the full CVPR paper archive.