Skip to content

DiVISe: Direct Visual-Input Speech Synthesis Preserving Speaker Characteristics And Intelligibility.

Yifan Liu, Yu Fang, Zhouhan Lin

VenueANAACL
Year2025
ProceedingsNAACL (Findings)

Browse the full NAACL paper archive.