Skip to content

PARM: Multi-Objective Test-Time Alignment via Preference-Aware Autoregressive Reward Model.

Baijiong Lin, Weisen Jiang, Yuancheng Xu, Hao Chen, Ying-Cong Chen

VenueA*ICML
Year2025
ProceedingsICML

Browse the full ICML paper archive.