Skip to content

Improving Sample-Efficiency in Reinforcement Learning for Dialogue Systems by Using Trainable-Action-Mask.

Yen-Chen Wu, Bo-Hsiang Tseng, Carl Edward Rasmussen

Year2020
ProceedingsICASSP

Browse the full ICASSP paper archive.