Skip to content

Multi-Modal Large Language Models are Effective Vision Learners.

Li Sun, Chaitanya Ahuja, Peng Chen, Matt D'Zmura, Kayhan Batmanghelich, Philip Bontrager

VenueAWACV
Year2025
ProceedingsWACV

Browse the full WACV paper archive.