Skip to content

video-SALMONN: Speech-Enhanced Audio-Visual Large Language Models.

Guangzhi Sun, Wenyi Yu, Changli Tang, Xianzhao Chen, Tian Tan, Wei Li, Lu Lu, Zejun Ma, Yuxuan Wang, Chao Zhang

VenueA*ICML
Year2024
ProceedingsICML

Browse the full ICML paper archive.