Visual-Linguistic Representation Learning with Deep Cross-Modality Fusion for Referring Multi-Object Tracking.
Wenyan He, Yajun Jian, Yang Lu, Hanzi Wang
Browse the full ICASSP paper archive.
Wenyan He, Yajun Jian, Yang Lu, Hanzi Wang
Browse the full ICASSP paper archive.