Skip to content

BATON: Enhancing Batch-wise Inference Efficiency for Large Language Models via Dynamic Re-batching.

Peizhuang Cong, Qizhi Chen, Haochen Zhao, Tong Yang

VenueA*WWW
Year2025
ProceedingsWWW

Browse the full WWW paper archive.