Faster In-Context Learning for LLMs via N-Gram Trie Speculative Decoding.
Jinglin Chen, Qiwei Li, Zuchao Li, Baoyuan Qi, Guoming Liu, Haojun Ai, Hai Zhao, Ping Wang
Browse the full EMNLP paper archive.
Jinglin Chen, Qiwei Li, Zuchao Li, Baoyuan Qi, Guoming Liu, Haojun Ai, Hai Zhao, Ping Wang
Browse the full EMNLP paper archive.