Skip to content

Detai Xin

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

11

Venues

4

Active years

2020–2024

Best venue rank

A*

Where they publish

Papers

11 indexed papers, newest first.

YearVenueTitleAuthors
2024ICMLNaturalSpeech 3: Zero-Shot Speech Synthesis with Factorized Codec and Diffusion Models.Zeqian Ju, Yuancheng Wang, Kai Shen, Xu Tan, Detai Xin, Dongchao Yang, Eric Liu, Yichong Leng, Kaitao Song, Siliang Tang, Zhizheng Wu, Tao Qin, Xiangyang Li, Wei Ye, Shikun Zhang, Jiang Bian, Lei He, Jinyu Li, Sheng Zhao
2023ASRUCOCO-NUT: Corpus of Japanese Utterance and Voice Characteristics Description for Prompt-Based Control.Aya Watanabe, Shinnosuke Takamichi, Yuki Saito, Wataru Nakata, Detai Xin, Hiroshi Saruwatari
2023ICASSPMID-Attribute Speaker Generation Using Optimal-Transport-Based Interpolation of Gaussian Mixture Models.Aya Watanabe, Shinnosuke Takamichi, Yuki Saito, Detai Xin, Hiroshi Saruwatari
2023ICASSPImproving Speech Prosody of Audiobook Text-To-Speech Synthesis with Acoustic and Textual Contexts.Detai Xin, Sharath Adavanne, Federico Ang, Ashish Kulkarni, Shinnosuke Takamichi, Hiroshi Saruwatari
2023ICASSPDuration-Aware Pause Insertion Using Pre-Trained Language Model for Multi-Speaker Text-To-Speech.Dong Yang, Tomoki Koriyama, Yuki Saito, Takaaki Saeki, Detai Xin, Hiroshi Saruwatari
2023InterspeechHow Generative Spoken Language Modeling Encodes Noisy Speech: Investigation from Phonetics to Syntactics.Joonyong Park, Shinnosuke Takamichi, Tomohiko Nakamura, Kentaro Seki, Detai Xin, Hiroshi Saruwatari
2023InterspeechLaughter Synthesis using Pseudo Phonetic Tokens with a Large-scale In-the-wild Laughter Corpus.Detai Xin, Shinnosuke Takamichi, Ai Morimatsu, Hiroshi Saruwatari
2022InterspeechUTMOS: UTokyo-SaruLab System for VoiceMOS Challenge 2022.Takaaki Saeki, Detai Xin, Wataru Nakata, Tomoki Koriyama, Shinnosuke Takamichi, Hiroshi Saruwatari
2021ICASSPDisentangled Speaker and Language Representations Using Mutual Information Minimization and Domain Adaptation for Cross-Lingual TTS.Detai Xin, Tatsuya Komatsu, Shinnosuke Takamichi, Hiroshi Saruwatari
2021InterspeechCross-Lingual Speaker Adaptation Using Domain Adaptation and Speaker Consistency Loss for Text-To-Speech Synthesis.Detai Xin, Yuki Saito, Shinnosuke Takamichi, Tomoki Koriyama, Hiroshi Saruwatari
2020InterspeechCross-Lingual Text-To-Speech Synthesis via Domain Adaptation and Perceptual Similarity Regression in Speaker Space.Detai Xin, Yuki Saito, Shinnosuke Takamichi, Tomoki Koriyama, Hiroshi Saruwatari