Elevating Video Retrieval Capabilities: A Cross-Modal Approach Utilizing Text and Image Generative Models.
Kazuya Ueki, Yuma Suzuki, Haruki Sato, Takayuki Hori, Takumi Takada, Hiroki Takushima, Hayato Tanoue, Aiswariya Manoj Kumar, Hiroki Nishihara
Browse the full CBMI paper archive.