Skip to content

Learning CLIP Guided Visual-Text Fusion Transformer for Video-based Pedestrian Attribute Recognition.

Jun Zhu, Jiandong Jin, Zihan Yang, Xiaohao Wu, Xiao Wang

VenueA*CVPR
Year2023
ProceedingsCVPR Workshops

Browse the full CVPR paper archive.