Skip to content

Describe Anything Model for Visual Question Answering on Text-Rich Images.

Yen-Linh Vu, Dinh-Thang Duong, Truong-Binh Duong, Anh-Khoi Nguyen, Thanh-Huy Nguyen, Le Thien Phuc Nguyen, Jianhua Xing, Xingjian Li, Tianyang Wang, Ulas Bagci, Min Xu

VenueA*ICCV
Year2025
ProceedingsICCVW

Browse the full ICCV paper archive.