Skip to content

Smaller, Weaker, Yet Better: Training LLM Reasoners via Compute-Optimal Sampling.

Hritik Bansal, Arian Hosseini, Rishabh Agarwal, Vinh Q. Tran, Mehran Kazemi

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.