Skip to content

S2H-DPO: Hardness-Aware Preference Optimization for Vision-Language Models.

Nitish Shukla, Surgan Jandial, Arun Ross

VenueA*ACL
Year2026
ProceedingsACL (Findings)

Browse the full ACL paper archive.