Skip to content

MAViD: A Multimodal Framework for Audio-Visual Dialogue Understanding and Generation.

Youxin Pang, Jiajun Liu, Lingfeng Tan, Yong Zhang, Feng Gao, Xiang Deng, Zhuoliang Kang, Xiaoming Wei, Yebin Liu

Year2026
ProceedingsSIGGRAPH (Conference Paper Track)

Browse the full SIGGRAPH paper archive.