UNICORN: A Unified Causal Video-Oriented Language-Modeling Framework for Temporal Video-Language Tasks.
Yuanhao Xiong, Yixin Nie, Haotian Liu, Boxin Wang, Jun Chen, Rong Jin, Cho-Jui Hsieh, Lorenzo Torresani, Jie Lei
Browse the full EMNLP paper archive.