Skip to content

Words Over Pixels? Rethinking Vision in Multimodal Large Language Models.

Anubhooti Jain, Mayank Vatsa, Richa Singh

VenueA*IJCAI
Year2025
ProceedingsIJCAI

Browse the full IJCAI paper archive.