Skip to content

Aligning Large Language Models with Human Preferences through Representation Engineering.

Wenhao Liu, Xiaohua Wang, Muling Wu, Tianlong Li, Changze Lv, Zixuan Ling, Jianhao Zhu, Cenyuan Zhang, Xiaoqing Zheng, Xuanjing Huang

VenueA*ACL
Year2024
ProceedingsACL (1)

Browse the full ACL paper archive.