Skip to content

Scaling Text-Rich Image Understanding via Code-Guided Synthetic Multimodal Data Generation.

Yue Yang, Ajay Patel, Matt Deitke, Tanmay Gupta, Luca Weihs, Andrew Head, Mark Yatskar, Chris Callison-Burch, Ranjay Krishna, Aniruddha Kembhavi, Christopher Clark

VenueA*ACL
Year2025
ProceedingsACL (1)

Browse the full ACL paper archive.