VAPO: End-to-end Slide-Enhanced Speech Recognition with Omni-modal Large Language Models.
Rui Hu, Delai Qiu, Yining Wang, Shengping Liu, Jitao Sang
Browse the full ACL paper archive.
Rui Hu, Delai Qiu, Yining Wang, Shengping Liu, Jitao Sang
Browse the full ACL paper archive.