Robot-directed speech detection using Multimodal Semantic Confidence based on speech, image, and motion.
Xiang Zuo, Naoto Iwahashi, Ryo Taguchi, Shigeki Matsuda, Komei Sugiura, Kotaro Funakoshi, Mikio Nakano, Natsuki Oka
Browse the full ICASSP paper archive.