| 2025 | EMNLP | LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors. | Rao Ma, Tongzhou Chen, Kartik Audhkhasi, Bhuvana Ramabhadran |
| 2025 | EMNLP | Universal Acoustic Adversarial Attacks for Flexible Control of Speech-LLMs. | Rao Ma, Mengjie Qian, Vyas Raina, Mark J. F. Gales, Kate M. Knill |
| 2025 | Interspeech | Assessment of L2 Oral Proficiency using Speech Large Language Models. | Rao Ma, Mengjie Qian, Siyuan Tang, Stefano Bann, Kate M. Knill, Mark J. F. Gales |
| 2025 | Interspeech | Scaling and Prompting for Improved End-to-End Spoken Grammatical Error Correction. | Mengjie Qian, Rao Ma, Stefano Bann, Kate M. Knill, Mark J. F. Gales |
| 2025 | NAACL | Cross-Lingual Transfer Learning for Speech Translation. | Rao Ma, Mengjie Qian, Yassir Fathullah, Siyuan Tang, Mark J. F. Gales, Kate M. Knill |
| 2024 | EMNLP | Muting Whisper: A Universal Acoustic Adversarial Attack on Speech Foundation Models. | Vyas Raina, Rao Ma, Charles McGhee, Kate M. Knill, Mark J. F. Gales |
| 2024 | ICASSP | Towards End-to-End Spoken Grammatical Error Correction. | Stefano Bann, Rao Ma, Mengjie Qian, Kate M. Knill, Mark J. F. Gales |
| 2024 | Interspeech | Learn and Don't Forget: Adding a New Language to ASR Foundation Models. | Mengjie Qian, Siyuan Tang, Rao Ma, Kate M. Knill, Mark J. F. Gales |
| 2024 | NAACL | Investigating the Emergent Audio Classification Ability of ASR Foundation Models. | Rao Ma, Adian Liusie, Mark J. F. Gales, Kate M. Knill |
| 2023 | ICASSP | Internal Language Model Estimation Based Adaptive Language Model Fusion for Domain Adaptation. | Rao Ma, Xiaobo Wu, Jin Qiu, Yanan Qin, Haihua Xu, Peihao Wu, Zejun Ma |
| 2023 | Interspeech | N-best T5: Robust ASR Error Correction using Multiple Input Hypotheses and Constrained Decoding Space. | Rao Ma, Mark J. F. Gales, Kate M. Knill, Mengjie Qian |
| 2023 | Interspeech | Adapting an Unadaptable ASR System. | Rao Ma, Mengjie Qian, Mark J. F. Gales, Kate M. Knill |
| 2022 | Interspeech | Internal Language Model Estimation Through Explicit Context Vector Learning for Attention-based Encoder-decoder ASR. | Yufei Liu, Rao Ma, Haihua Xu, Yi He, Zejun Ma, Weibin Zhang |
| 2021 | ICASSP | AISpeech-SJTU ASR System for the Accented English Speech Recognition Challenge. | Tian Tan, Yizhou Lu, Rao Ma, Sen Zhu, Jiaqi Guo, Yanmin Qian |
| 2021 | ICASSP | AISpeech-SJTU Accent Identification System for the Accented English Speech Recognition Challenge. | Houjun Huang, Xu Xiang, Yexin Yang, Rao Ma, Yanmin Qian |
| 2020 | ACL | Unsupervised Dual Paraphrasing for Two-stage Semantic Parsing. | Ruisheng Cao, Su Zhu, Chenyu Yang, Chen Liu, Rao Ma, Yanbin Zhao, Lu Chen, Kai Yu |
| 2020 | ICASSP | Addressing the Polysemy Problem in Language Modeling with Attentional Multi-Sense Embeddings. | Rao Ma, Lesheng Jin, Qi Liu, Lu Chen, Kai Yu |
| 2020 | ICASSP | Neural Lattice Search for Speech Recognition. | Rao Ma, Hao Li, Qi Liu, Lu Chen, Kai Yu |
| 2019 | ASRU | Highly Efficient Neural Network Language Model Compression Using Soft Binarization Training. | Rao Ma, Qi Liu, Kai Yu |