Skip to content

SpeakerLM: End-to-End Versatile Speaker Diarization and Recognition with Multimodal Large Language Models.

Han Yin, Yafeng Chen, Chong Deng, Luyao Cheng, Hui Wang, Chao-Hong Tan, Qian Chen, Wen Wang, Xiangang Li

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.