Escaping from zero gradient: Revisiting action-constrained reinforcement learning via Frank-Wolfe policy optimization.
Jyun-Li Lin, Wei Hung, Shang-Hsuan Yang, Ping-Chun Hsieh, Xi Liu
Browse the full UAI paper archive.
Jyun-Li Lin, Wei Hung, Shang-Hsuan Yang, Ping-Chun Hsieh, Xi Liu
Browse the full UAI paper archive.