Skip to content

Q-Probe: A Lightweight Approach to Reward Maximization for Language Models.

Kenneth Li, Samy Jelassi, Hugh Zhang, Sham M. Kakade, Martin Wattenberg, David Brandfonbrener

VenueA*ICML
Year2024
ProceedingsICML

Browse the full ICML paper archive.