MAViD: A Multimodal Framework for Audio-Visual Dialogue Understanding and Generation.
Youxin Pang, Jiajun Liu, Lingfeng Tan, Yong Zhang, Feng Gao, Xiang Deng, Zhuoliang Kang, Xiaoming Wei, Yebin Liu
VenueA*SIGGRAPH
Year2026
ProceedingsSIGGRAPH (Conference Paper Track)
DBLP recordconf/siggraph/PangLTZGDKWL26 ↗
Browse the full SIGGRAPH paper archive.