Skip to content

Enhancing Vision-Language Models for Zero-Shot Video Action Recognition via Visual-Textual Refinement and Improved Interpretability.

Adeel Yousaf, Mubarak Shah

VenueA*ICCV
Year2025
ProceedingsICCVW

Browse the full ICCV paper archive.