Skip to content

Enhancing LM's Task Adaptability: Powerful Post-training Framework with Reinforcement Learning from Model Feedback.

Fuju Rong, Weihao Gao, Zhuo Deng, Zheng Gong, Chucheng Chen, Wenze Zhang, Zhiyuan Niu, Fang Li, Lan Ma

VenueCICANN
Year2024
ProceedingsICANN (7)

Browse the full ICANN paper archive.