AlanaVLM: A Multimodal Embodied AI Foundation Model for Egocentric Video Understanding.
Alessandro Suglia, Claudio Greco, Katie Baker, Jose L. Part, Ioannis Papaioannou, Arash Eshghi, Ioannis Konstas, Oliver Lemon
Browse the full EMNLP paper archive.