Skip to content

TCRA-LLM: Token Compression Retrieval Augmented Large Language Model for Inference Cost Reduction.

Junyi Liu, Liangzhi Li, Tong Xiang, Bowen Wang, Yiming Qian

VenueA*EMNLP
Year2023
ProceedingsEMNLP (Findings)

Browse the full EMNLP paper archive.