Learning Fine-Grained Semantics in Spoken Language Using Visual Grounding.
Xinsheng Wang, Tian Tian, Jihua Zhu, Odette Scharenborg
Browse the full ISCAS paper archive.
Xinsheng Wang, Tian Tian, Jihua Zhu, Odette Scharenborg
Browse the full ISCAS paper archive.