Language Models can do Zero-Shot Visual Referring Expression Comprehension.
Xiuchao Sui, Shaohua Li, Hong Yang, Hongyuan Zhu, Yan Wu
Browse the full ICLR paper archive.
Xiuchao Sui, Shaohua Li, Hong Yang, Hongyuan Zhu, Yan Wu
Browse the full ICLR paper archive.