Skip to content

Turning Trash into Treasure: Accelerating Inference of Large Language Models with Token Recycling.

Xianzhen Luo, Yixuan Wang, Qingfu Zhu, Zhiming Zhang, Xuanyu Zhang, Qing Yang, Dongliang Xu

VenueA*ACL
Year2025
ProceedingsACL (1)

Browse the full ACL paper archive.