Skip to content

EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens.

Chaoqun Yang, Xinyu Lin, Wenjie Wang, Yongqi Li, Teng Sun, Xianjing Han, Tat-Seng Chua

VenueA*KDD
Year2025
ProceedingsKDD (2)

Browse the full KDD paper archive.