Skip to content

Probing Audio-Visual Reasoning in Multimodal Language Models through the Lens of Audio.

Kaixiong Gong, Kaituo Feng, Bohao Li, Yibing Wang, Mofan Cheng, Shijia Yang, Jiaming Han, Benyou Wang, Yutong Bai, Zhuoran Yang, Xiangyu Yue

VenueA*ACL
Year2026
ProceedingsACL (1)

Browse the full ACL paper archive.