FaD-VLP: Fashion Vision-and-Language Pre-training towards Unified Retrieval and Captioning.
Suvir Mirchandani, Licheng Yu, Mengjiao Wang, Animesh Sinha, Wenwen Jiang, Tao Xiang, Ning Zhang
Browse the full EMNLP paper archive.
Suvir Mirchandani, Licheng Yu, Mengjiao Wang, Animesh Sinha, Wenwen Jiang, Tao Xiang, Ning Zhang
Browse the full EMNLP paper archive.