ALaRM: Align Language Models via Hierarchical Rewards Modeling.
Yuhang Lai, Siyuan Wang, Shujun Liu, Xuanjing Huang, Zhongyu Wei
Browse the full ACL paper archive.
Yuhang Lai, Siyuan Wang, Shujun Liu, Xuanjing Huang, Zhongyu Wei
Browse the full ACL paper archive.