Using Reinforcement Learning for Dialogue Management Policies: Towards Understanding MDP Violations and Convergence.
Peter A. Heeman, Jordan Fryer, Rebecca Lunsford, Andrew Rueckert, Ethan Selfridge
Browse the full Interspeech paper archive.
Peter A. Heeman, Jordan Fryer, Rebecca Lunsford, Andrew Rueckert, Ethan Selfridge
Browse the full Interspeech paper archive.