Skip to content

Beyond Next Token Prediction: Patch-Level Training for Large Language Models.

Chenze Shao, Fandong Meng, Jie Zhou

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.