Skip to content

ALaRM: Align Language Models via Hierarchical Rewards Modeling.

Yuhang Lai, Siyuan Wang, Shujun Liu, Xuanjing Huang, Zhongyu Wei

VenueA*ACL
Year2024
ProceedingsACL (Findings)

Browse the full ACL paper archive.