Skip to content

Aligning Language Models Using Follow-up Likelihood as Reward Signal.

Chen Zhang, Dading Chong, Feng Jiang, Chengguang Tang, Anningzhe Gao, Guohua Tang, Haizhou Li

VenueA*AAAI
Year2025
ProceedingsAAAI

Browse the full AAAI paper archive.