Skip to content

DiffOP: Reinforcement Learning of Optimization-Based Control Policies via Implicit Policy Gradients.

Yuexin Bian, Jie Feng, Yuanyuan Shi

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.