Skip to content

Draft& Verify: Lossless Large Language Model Acceleration via Self-Speculative Decoding.

Jun Zhang, Jue Wang, Huan Li, Lidan Shou, Ke Chen, Gang Chen, Sharad Mehrotra

VenueA*ACL
Year2024
ProceedingsACL (1)

Browse the full ACL paper archive.