Skip to content

Locate Then Generate: Bridging Vision and Language with Bounding Box for Scene-Text VQA.

Yongxin Zhu, Zhen Liu, Yukang Liang, Xin Li, Hao Liu, Changcun Bao, Linli Xu

VenueA*AAAI
Year2023
ProceedingsAAAI

Browse the full AAAI paper archive.