Seeing is Believing: Emotion-Aware Audio-Visual Language Modeling for Expressive Speech Generation.
Weiting Tan, Jiachen Lian, Hirofumi Inaguma, Paden Tomasello, Philipp Koehn, Xutai Ma
Browse the full EMNLP paper archive.
Weiting Tan, Jiachen Lian, Hirofumi Inaguma, Paden Tomasello, Philipp Koehn, Xutai Ma
Browse the full EMNLP paper archive.