Skip to content

Investigating and Enhancing Vision-Audio Capability in Omnimodal Large Language Models.

Rui Hu, Delai Qiu, Shuyu Wei, Jiaming Zhang, Yining Wang, Shengping Liu, Jitao Sang

VenueA*ACL
Year2025
ProceedingsACL (Findings)

Browse the full ACL paper archive.