Skip to content

Rewarding What Matters: Step-by-Step Reinforcement Learning for Task-Oriented Dialogue.

Huifang Du, Shuqin Li, Minghao Wu, Xuejing Feng, Yuan-Fang Li, Haofen Wang

VenueA*EMNLP
Year2024
ProceedingsEMNLP (Findings)

Browse the full EMNLP paper archive.