Task-Completion Dialogue Policy Learning via Monte Carlo Tree Search with Dueling Network.
Sihan Wang, Kaijie Zhou, Kunfeng Lai, Jianping Shen
Browse the full EMNLP paper archive.
Sihan Wang, Kaijie Zhou, Kunfeng Lai, Jianping Shen
Browse the full EMNLP paper archive.