Q-Probe: A Lightweight Approach to Reward Maximization for Language Models.
Kenneth Li, Samy Jelassi, Hugh Zhang, Sham M. Kakade, Martin Wattenberg, David Brandfonbrener
Browse the full ICML paper archive.
Kenneth Li, Samy Jelassi, Hugh Zhang, Sham M. Kakade, Martin Wattenberg, David Brandfonbrener
Browse the full ICML paper archive.