Skip to content

Mining Intrinsic Rewards from LLM Hidden States for Efficient Best-of-N Sampling.

Jizhou Guo, Zhaomin Wu, Hanchen Yang, Philip S. Yu

VenueA*KDD
Year2026
ProceedingsKDD (1)

Browse the full KDD paper archive.