WebAgent-R1: Training Web Agents via End-to-End Multi-Turn Reinforcement Learning.
Zhepei Wei, Wenlin Yao, Yao Liu, Weizhi Zhang, Qin Lu, Liang Qiu, Changlong Yu, Puyang Xu, Chao Zhang, Bing Yin, Hyokun Yun, Lihong Li
Browse the full EMNLP paper archive.