Skip to content

HALL-E: Hierarchical Neural Codec Language Model for Minute-Long Zero-Shot Text-to-Speech Synthesis.

Yuto Nishimura, Takumi Hirose, Masanari Ohi, Hideki Nakayama, Nakamasa Inoue

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.