LoPT: Lossless Parallel Tokenization Acceleration for Long Context Inference of Large Language Model.
Wei Shao, Lingchao Zheng, Pengyu Wang, Peizhen Zheng, Li Jun, Yuwei Fan
Browse the full ACL paper archive.
Wei Shao, Lingchao Zheng, Pengyu Wang, Peizhen Zheng, Li Jun, Yuwei Fan
Browse the full ACL paper archive.