OLViT: Multi-Modal State Tracking via Attention-Based Embeddings for Video-Grounded Dialog.
Adnen Abdessaied, Manuel von Hochmeister, Andreas Bulling
Browse the full COLING paper archive.
Adnen Abdessaied, Manuel von Hochmeister, Andreas Bulling
Browse the full COLING paper archive.