Bridging the Modality Gap: Softly Discretizing Audio Representation for LLM-based Automatic Speech Recognition.
Mu Yang, Szu-Jui Chen, Jiamin Xie, John H. L. Hansen
Browse the full ASRU paper archive.
Mu Yang, Szu-Jui Chen, Jiamin Xie, John H. L. Hansen
Browse the full ASRU paper archive.