Skip to content

Group Causal Policy Optimization for Post-Training Large Language Models.

Ziyin Gu, Jingyao Wang, Ran Zuo, Chuxiong Sun, Zeen Song, Changwen Zheng, Wenwen Qiang

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.