Skip to content

DRIFT: Difference-Aware Reinforcement Through Iterative Fine-Tuning for Language Model.

Wenjie Liao, Xiaohui Song, Haonan Lu

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.