LMRL Gym: Benchmarks for Multi-Turn Reinforcement Learning with Language Models.
Marwa Abdulhai, Isadora White, Charlie Victor Snell, Charles Sun, Joey Hong, Yuexiang Zhai, Kelvin Xu, Sergey Levine
Browse the full ICML paper archive.
Marwa Abdulhai, Isadora White, Charlie Victor Snell, Charles Sun, Joey Hong, Yuexiang Zhai, Kelvin Xu, Sergey Levine
Browse the full ICML paper archive.