Investigating and Enhancing Vision-Audio Capability in Omnimodal Large Language Models.
Rui Hu, Delai Qiu, Shuyu Wei, Jiaming Zhang, Yining Wang, Shengping Liu, Jitao Sang
Browse the full ACL paper archive.
Rui Hu, Delai Qiu, Shuyu Wei, Jiaming Zhang, Yining Wang, Shengping Liu, Jitao Sang
Browse the full ACL paper archive.