Fine-Tuning on Diverse Reasoning Chains Drives Within-Inference CoT Refinement in LLMs.
Haritz Puerto, Tilek Chubakov, Xiaodan Zhu, Harish Tayyar Madabushi, Iryna Gurevych
Browse the full ACL paper archive.
Haritz Puerto, Tilek Chubakov, Xiaodan Zhu, Harish Tayyar Madabushi, Iryna Gurevych
Browse the full ACL paper archive.