Skip to content

Earlier Tokens Contribute More: Learning Direct Preference Optimization From Temporal Decay Perspective.

Ruichen Shao, Bei Li, Gangao Liu, Yang Chen, ZhouXiang, Jingang Wang, Xunliang Cai, Peng Li

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.