End-to-End Modeling via Information Tree for One-Shot Natural Language Spatial Video Grounding.
Mengze Li, Tianbao Wang, Haoyu Zhang, Shengyu Zhang, Zhou Zhao, Jiaxu Miao, Wenqiao Zhang, Wenming Tan, Jin Wang, Peng Wang, Shiliang Pu, Fei Wu
Browse the full ACL paper archive.