LiteVL: Efficient Video-Language Learning with Enhanced Spatial-Temporal Modeling.
Dongsheng Chen, Chaofan Tao, Lu Hou, Lifeng Shang, Xin Jiang, Qun Liu
Browse the full EMNLP paper archive.
Dongsheng Chen, Chaofan Tao, Lu Hou, Lifeng Shang, Xin Jiang, Qun Liu
Browse the full EMNLP paper archive.