Skip to content

UniTAB: Unifying Text and Box Outputs for Grounded Vision-Language Modeling.

Zhengyuan Yang, Zhe Gan, Jianfeng Wang, Xiaowei Hu, Faisal Ahmed, Zicheng Liu, Yumao Lu, Lijuan Wang

VenueA*ECCV
Year2022
ProceedingsECCV (36)

Browse the full ECCV paper archive.