Skip to content

Reward-Guided Fine-Tuning of Language Models with Social Feedback.

Jared Scott, Jesse Roberts

Year2026
ProceedingsFLAIRS

Browse the full FlAIRS paper archive.