Skip to content

Reinforcement Learning with Token-level Feedback for Controllable Text Generation.

Wendi Li, Wei Wei, Kaihe Xu, Wenfeng Xie, Dangyang Chen, Yu Cheng

VenueANAACL
Year2024
ProceedingsNAACL-HLT (Findings)

Browse the full NAACL paper archive.