Serialized Output Prompting for Large Language Model-based Multi-Talker Speech Recognition.
Hao Shi, Yusuke Fujita, Tomoya Mizumoto, Lianbo Liu, Atsushi Kojima, Yui Sudo
Browse the full ASRU paper archive.
Hao Shi, Yusuke Fujita, Tomoya Mizumoto, Lianbo Liu, Atsushi Kojima, Yui Sudo
Browse the full ASRU paper archive.