Efficient Test-Time Scaling of Multi-Step Reasoning by Probing Internal States of Large Language Models.
Jingwei Ni, Ekaterina Fadeeva, Tianyi Wu, Mubashara Akhtar, Jiaheng Zhang, Elliott Ash, Markus Leippold, Timothy Baldwin, See-Kiong Ng, Artem Shelmanov, Mrinmaya Sachan
Browse the full ACL paper archive.