Skip to content

Audio-Enhanced Vision-Language Modeling with Latent Space Broadening for High Quality Data Expansion.

Yu Sun, Yin Li, Ruixiao Sun, Chunhui Liu, Fangming Zhou, Ze Jin, Linjie Wang, Xiang Shen, Zhuolin Hao, Hongyu Xiong

VenueA*KDD
Year2025
ProceedingsKDD (2)

Browse the full KDD paper archive.