Towards Noise-Tolerant Speech-Referring Video Object Segmentation: Bridging Speech and Text.
Xiang Li, Jinglu Wang, Xiaohao Xu, Muqiao Yang, Fan Yang, Yizhou Zhao, Rita Singh, Bhiksha Raj
Browse the full EMNLP paper archive.
Xiang Li, Jinglu Wang, Xiaohao Xu, Muqiao Yang, Fan Yang, Yizhou Zhao, Rita Singh, Bhiksha Raj
Browse the full EMNLP paper archive.