Skip to content

Text2Reward: Reward Shaping with Language Models for Reinforcement Learning.

Tianbao Xie, Siheng Zhao, Chen Henry Wu, Yitao Liu, Qian Luo, Victor Zhong, Yanchao Yang, Tao Yu

VenueA*ICLR
Year2024
ProceedingsICLR

Browse the full ICLR paper archive.