RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs.
Afra Feyza Akyrek, Ekin Akyrek, Ashwin Kalyan, Peter Clark, Derry Tanti Wijaya, Niket Tandon
Browse the full ACL paper archive.
Afra Feyza Akyrek, Ekin Akyrek, Ashwin Kalyan, Peter Clark, Derry Tanti Wijaya, Niket Tandon
Browse the full ACL paper archive.