Learning Fine-Grained Representations through Textual Token Disentanglement in Composed Video Retrieval.
Yue Wu, Zhaobo Qi, Yiling Wu, Junshu Sun, Yaowei Wang, Shuhui Wang
Browse the full ICLR paper archive.
Yue Wu, Zhaobo Qi, Yiling Wu, Junshu Sun, Yaowei Wang, Shuhui Wang
Browse the full ICLR paper archive.