Skip to content

RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs.

Afra Feyza Akyrek, Ekin Akyrek, Ashwin Kalyan, Peter Clark, Derry Tanti Wijaya, Niket Tandon

VenueA*ACL
Year2023
ProceedingsACL (1)

Browse the full ACL paper archive.