SpeakerLM: End-to-End Versatile Speaker Diarization and Recognition with Multimodal Large Language Models.
Han Yin, Yafeng Chen, Chong Deng, Luyao Cheng, Hui Wang, Chao-Hong Tan, Qian Chen, Wen Wang, Xiangang Li
Browse the full AAAI paper archive.
Han Yin, Yafeng Chen, Chong Deng, Luyao Cheng, Hui Wang, Chao-Hong Tan, Qian Chen, Wen Wang, Xiangang Li
Browse the full AAAI paper archive.