Skip to content

Scaling Instruction-tuned LLMs to Million-token Contexts via Hierarchical Synthetic Data Generation.

Linda He, Jue Wang, Maurice Weber, Shang Zhu, Ben Athiwaratkun, Ce Zhang

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.