Not All Tokens Matter: Towards Efficient LLM Reasoning via Token Significance in Reinforcement Learning.
Hanbing Liu, Lang Cao, Yuanyi Ren, Mengyu Zhou, Haoyu Dong, Xiaojun Ma, Shi Han, Dongmei Zhang
Browse the full ACL paper archive.
Hanbing Liu, Lang Cao, Yuanyi Ren, Mengyu Zhou, Haoyu Dong, Xiaojun Ma, Shi Han, Dongmei Zhang
Browse the full ACL paper archive.