Skip to content

Takaaki Saeki

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

18

Venues

5

Active years

2020–2025

Best venue rank

A*

Where they publish

Papers

18 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPSpeech Re-Painting for Robust ASR.Kyle Kastner, Gary Wang, Isaac Elias, Takaaki Saeki, Pedro Moreno Mengibar, Franoise Beaufays, Andrew Rosenberg, Bhuvana Ramabhadran
2024ICASSPExtending Multilingual Speech Synthesis to 100+ Languages without Transcribed Data.Takaaki Saeki, Gary Wang, Nobuyuki Morioka, Isaac Elias, Kyle Kastner, Andrew Rosenberg, Bhuvana Ramabhadran, Heiga Zen, Franoise Beaufays, Hadar Shemtov
2024ICASSPDiversity-Based Core-Set Selection for Text-to-Speech with Linguistic and Acoustic Features.Kentaro Seki, Shinnosuke Takamichi, Takaaki Saeki, Hiroshi Saruwatari
2024InterspeechSpeechBERTScore: Reference-Aware Automatic Evaluation of Speech Generation Leveraging NLP Evaluation Metrics.Takaaki Saeki, Soumi Maiti, Shinnosuke Takamichi, Shinji Watanabe, Hiroshi Saruwatari
2023ASRUYodas: Youtube-Oriented Dataset for Audio and Speech.Xinjian Li, Shinnosuke Takamichi, Takaaki Saeki, William Chen, Sayaka Shiota, Shinji Watanabe
2023ICASSPSpeechlmscore: Evaluating Speech Generation Using Speech Language Model.Soumi Maiti, Yifan Peng, Takaaki Saeki, Shinji Watanabe
2023ICASSPVirtuoso: Massive Multilingual Speech-Text Joint Semi-Supervised Learning for Text-to-Speech.Takaaki Saeki, Heiga Zen, Zhehuai Chen, Nobuyuki Morioka, Gary Wang, Yu Zhang, Ankur Bapna, Andrew Rosenberg, Bhuvana Ramabhadran
2023ICASSPDuration-Aware Pause Insertion Using Pre-Trained Language Model for Multi-Speaker Text-To-Speech.Dong Yang, Tomoki Koriyama, Yuki Saito, Takaaki Saeki, Detai Xin, Hiroshi Saruwatari
2023IJCAILearning to Speak from Text: Zero-Shot Multilingual Text-to-Speech with Unsupervised Text Pretraining.Takaaki Saeki, Soumi Maiti, Xinjian Li, Shinji Watanabe, Shinnosuke Takamichi, Hiroshi Saruwatari
2022InterspeechSelfRemaster: Self-Supervised Speech Restoration with Analysis-by-Synthesis Approach Using Channel Modeling.Takaaki Saeki, Shinnosuke Takamichi, Tomohiko Nakamura, Naoko Tanji, Hiroshi Saruwatari
2022InterspeechDRSpeech: Degradation-Robust Text-to-Speech Synthesis with Frame-Level and Utterance-Level Acoustic Representation Learning.Takaaki Saeki, Kentaro Tachibana, Ryuichi Yamamoto
2022InterspeechUTMOS: UTokyo-SaruLab System for VoiceMOS Challenge 2022.Takaaki Saeki, Detai Xin, Wataru Nakata, Tomoki Koriyama, Shinnosuke Takamichi, Hiroshi Saruwatari
2022LRECSSR7000: A Synchronized Corpus of Ultrasound Tongue Imaging for End-to-End Silent Speech Recognition.Naoki Kimura, Zixiong Su, Takaaki Saeki, Jun Rekimoto
2022LRECPersonalized Filled-pause Generation with Group-wise Prediction Models.Yuta Matsunaga, Takaaki Saeki, Shinnosuke Takamichi, Hiroshi Saruwatari
2021ASRULow-Latency Incremental Text-to-Speech Synthesis with Distilled Context Prediction Network.Takaaki Saeki, Shinnosuke Takamichi, Hiroshi Saruwatari
2020ICASSPLifter Training and Sub-Band Modeling for Computationally Efficient and High-Quality Voice Conversion Using Spectral Differentials.Takaaki Saeki, Yuki Saito, Shinnosuke Takamichi, Hiroshi Saruwatari
2020InterspeechEnd-to-End Deep Learning Speech Recognition Model for Silent Speech Challenge.Naoki Kimura, Zixiong Su, Takaaki Saeki
2020InterspeechReal-Time, Full-Band, Online DNN-Based Voice Conversion System Using a Single CPU.Takaaki Saeki, Yuki Saito, Shinnosuke Takamichi, Hiroshi Saruwatari