Skip to content

Token Preference Optimization with Self-Calibrated Visual-Anchored Rewards for Hallucination Mitigation.

Jihao Gu, Yingyao Wang, Meng Cao, Pi Bu, Jun Song, Bo Zheng, Yancheng He, Shilong Li

VenueA*EMNLP
Year2025
ProceedingsEMNLP (Findings)

Browse the full EMNLP paper archive.