Multi-Modal Large Language Models are Effective Vision Learners.
Li Sun, Chaitanya Ahuja, Peng Chen, Matt D'Zmura, Kayhan Batmanghelich, Philip Bontrager
Browse the full WACV paper archive.
Li Sun, Chaitanya Ahuja, Peng Chen, Matt D'Zmura, Kayhan Batmanghelich, Philip Bontrager
Browse the full WACV paper archive.