Skip to content

VAPO: End-to-end Slide-Enhanced Speech Recognition with Omni-modal Large Language Models.

Rui Hu, Delai Qiu, Yining Wang, Shengping Liu, Jitao Sang

VenueA*ACL
Year2026
ProceedingsACL (1)

Browse the full ACL paper archive.