Trajectory Improvement and Reward Learning from Comparative Language Feedback.
Zhaojing Yang, Miru Jun, Jeremy Tien, Stuart Russell, Anca D. Dragan, Erdem Biyik
Browse the full CoRL paper archive.
Zhaojing Yang, Miru Jun, Jeremy Tien, Stuart Russell, Anca D. Dragan, Erdem Biyik
Browse the full CoRL paper archive.