Skip to content

Gaussian Process based Deep Dyna-Q approach for Dialogue Policy Learning.

Guanlin Wu, Wenqi Fang, Ji Wang, Jiang Cao, Weidong Bao, Yang Ping, Xiaomin Zhu, Zheng Wang

VenueA*ACL
Year2021
ProceedingsACL/IJCNLP (Findings)

Browse the full ACL paper archive.