Skip to content

LPPG-RL: Lexicographically Projected Policy Gradient Reinforcement Learning with Subproblem Exploration.

Ruiyu Qiu, Rui Wang, Guanghui Yang, Xiang Li, Zhijiang Shao

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.