RiT: Rubrics-in-Thinking Reinforcement Learning for Improved Reasoning in Large Language Models.
Xiaobin Tian, Shuai Yuan, Muyun Ding, Haonan Chen, Xiaoxi Jiang
Browse the full ACL paper archive.
Xiaobin Tian, Shuai Yuan, Muyun Ding, Haonan Chen, Xiaoxi Jiang
Browse the full ACL paper archive.