Rewards-in-Context: Multi-objective Alignment of Foundation Models with Dynamic Preference Adjustment.
Rui Yang, Xiaoman Pan, Feng Luo, Shuang Qiu, Han Zhong, Dong Yu, Jianshu Chen
Browse the full ICML paper archive.
Rui Yang, Xiaoman Pan, Feng Luo, Shuang Qiu, Han Zhong, Dong Yu, Jianshu Chen
Browse the full ICML paper archive.