EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens.
Chaoqun Yang, Xinyu Lin, Wenjie Wang, Yongqi Li, Teng Sun, Xianjing Han, Tat-Seng Chua
Browse the full KDD paper archive.
Chaoqun Yang, Xinyu Lin, Wenjie Wang, Yongqi Li, Teng Sun, Xianjing Han, Tat-Seng Chua
Browse the full KDD paper archive.