Do We Still Need Text Features for Video Retrieval in the Era of Vision-Language Models?
Jiaqi Samantha Zhan, Crystina Zhang, Shengyao Zhuang, Xueguang Ma, Jimmy Lin
Browse the full ECIR paper archive.
Jiaqi Samantha Zhan, Crystina Zhang, Shengyao Zhuang, Xueguang Ma, Jimmy Lin
Browse the full ECIR paper archive.