OWSM v3.1: Better and Faster Open Whisper-Style Speech Models based on E-Branchformer.
Yifan Peng, Jinchuan Tian, William Chen, Siddhant Arora, Brian Yan, Yui Sudo, Muhammad Shakeel, Kwanghee Choi, Jiatong Shi, Xuankai Chang, Jee-weon Jung, Shinji Watanabe
Browse the full Interspeech paper archive.