Improving Preference Extraction In LLMs By Identifying Latent Knowledge Through Classifying Probes.
Sharan Maiya, Yinhong Liu, Ramit Debnath, Anna Korhonen
Browse the full ACL paper archive.
Sharan Maiya, Yinhong Liu, Ramit Debnath, Anna Korhonen
Browse the full ACL paper archive.