ERRV: Eliciting Efficient Reasoning through Reasoning Vectors for Policy Optimization in Large Language Models.
Zhuowen Han, Lei Yang, Renren Jin, Dan Shi, Chenxi Sun, Deyi Xiong
Browse the full ACL paper archive.
Zhuowen Han, Lei Yang, Renren Jin, Dan Shi, Chenxi Sun, Deyi Xiong
Browse the full ACL paper archive.