ViLLa: Video Reasoning Segmentation with Large Language Model.
Rongkun Zheng, Lu Qi, Xi Chen, Yi Wang, Kun Wang, Hengshuang Zhao
Browse the full ICCV paper archive.
Rongkun Zheng, Lu Qi, Xi Chen, Yi Wang, Kun Wang, Hengshuang Zhao
Browse the full ICCV paper archive.