Skip to content

Forge: Quality-Aware Reinforcement Learning for NP-Hard Optimization in LLMs.

Xiaozhe Li, Xinyu Fang, Shengyuan Ding, Yang Li, Linyang Li, Haodong Duan, Qingwen Liu, Kai Chen

VenueA*ACL
Year2026
ProceedingsACL (Findings)

Browse the full ACL paper archive.