Skip to content

An Efficient Task-Oriented Dialogue Policy: Evolutionary Reinforcement Learning Injected by Elite Individuals.

Yangyang Zhao, Ben Niu, Libo Qin, Shihan Wang

VenueA*ACL
Year2025
ProceedingsACL (1)

Browse the full ACL paper archive.