Skip to content

Gradient-Adaptive Policy Optimization: Towards Multi-Objective Alignment of Large Language Models.

Chengao Li, Hanyu Zhang, Yunkun Xu, Hongyan Xue, Xiang Ao, Qing He

VenueA*ACL
Year2025
ProceedingsACL (1)

Browse the full ACL paper archive.