Skip to content

Targeting Misalignment: A Conflict-Aware Framework for Reward-Model-based LLM Alignment.

Zixuan Liu, Siavash H. Khajavi, Guangkai Jiang, Xinru Liu

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.