Skip to content

Rethinking Sample Polarity in Reinforcement Learning with Verifiable Rewards.

Xinyu Tang, Yuliang Zhan, Zhixun Li, Xin Zhao, Zhenduo Zhang, Zujie Wen, Zhiqiang Zhang, Jun Zhou

VenueA*ACL
Year2026
ProceedingsACL (1)

Browse the full ACL paper archive.