Skip to content

Yamato Ohtani

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

28

Venues

3

Active years

2006–2025

Best venue rank

A

Where they publish

Papers

28 indexed papers, newest first.

YearVenueTitleAuthors
2025ASRULayer-wise Analysis for Quality of Multilingual Synthesized Speech.Erica Cooper, Takuma Okamoto, Yamato Ohtani, Tomoki Toda, Hisashi Kawai
2025ASRUVoice Factor Control Using FIR-Based Fast Neural Vocoder for Speech Generation Applications.Yamato Ohtani, Takuma Okamoto, Tomoki Toda, Hisashi Kawai
2025ICASSPMora-Level Prosody Prediction for Text-to-Speech Using Japanese BERT Without Accentual Labels.Tadashi Ogura, Takuma Okamoto, Yamato Ohtani, Erica Cooper, Tomoki Toda, Hisashi Kawai
2025InterspeechGST-BERT-TTS: Prosody Prediction Without Accentual Labels For Multi-Speaker TTS Using BERT With Global Style Tokens.Tadashi Ogura, Takuma Okamoto, Yamato Ohtani, Erica Cooper, Tomoki Toda, Hisashi Kawai
2024ICASSPFIRNet: Fundamental Frequency Controllable Fast Neural Vocoder With Trainable Finite Impulse Response Filter.Yamato Ohtani, Takuma Okamoto, Tomoki Toda, Hisashi Kawai
2024ICASSPConvnext-TTS And Convnext-VC: Convnext-Based Fast End-To-End Sequence-To-Sequence Text-To-Speech And Voice Conversion.Takuma Okamoto, Yamato Ohtani, Tomoki Toda, Hisashi Kawai
2024InterspeechMobile PresenTra: NICT fast neural text-to-speech system on smartphones with incremental inference of MS-FC-HiFi-GAN for law-latency synthesis.Takuma Okamoto, Yamato Ohtani, Hisashi Kawai
2024InterspeechChallenge of Singing Voice Synthesis Using Only Text-To-Speech Corpus With FIRNet Source-Filter Neural Vocoder.Takuma Okamoto, Yamato Ohtani, Sota Shimizu, Tomoki Toda, Hisashi Kawai
2023ASRUWaveNeXt: ConvNeXt-Based Fast Neural Vocoder Without ISTFT layer.Takuma Okamoto, Haruki Yamashita, Yamato Ohtani, Tomoki Toda, Hisashi Kawai
2022InterspeechSpoken-Text-Style Transfer with Conditional Variational Autoencoder and Content Word Storage.Daiki Yoshioka, Yusuke Yasuda, Noriyuki Matsunaga, Yamato Ohtani, Tomoki Toda
2020InterspeechA Cyclical Post-Filtering Approach to Mismatch Refinement of Neural Vocoder for Text-to-Speech Systems.Yi-Chiao Wu, Patrick Lumban Tobing, Kazuki Yasuhara, Noriyuki Matsunaga, Yamato Ohtani, Tomoki Toda
2016InterspeechVoice Quality Control Using Perceptual Expressions for Statistical Parametric Speech Synthesis Based on Cluster Adaptive Training.Yamato Ohtani, Koichiro Mori, Masahiro Morita
2015InterspeechEmotional transplant in statistical speech synthesis based on emotion additive model.Yamato Ohtani, Yu Nasu, Masahiro Morita, Masami Akamine
2014InterspeechGMM-based bandwidth extension using sub-band basis spectrum model.Yamato Ohtani, Masatsune Tamura, Masahiro Morita, Masami Akamine
2012InterspeechHistogram-based spectral equalization for HMM-based speech synthesis using mel-LSP.Yamato Ohtani, Masatsune Tamura, Masahiro Morita, Takehiko Kagoshima, Masami Akamine
2012InterspeechHMM-based speech synthesis using sub-band basis spectrum model.Yamato Ohtani, Masatsune Tamura, Masahiro Morita, Takehiko Kagoshima, Masami Akamine
2011ICASSPContinuous F0 in the source-excitation generation for HMM-based TTS: Do we need voiced/unvoiced classification?Javier Latorre, Mark J. F. Gales, Sabine Buchholz, Kate M. Knill, Masatsune Tamura, Yamato Ohtani, Masami Akamine
2010ICASSPNon-parallel training for many-to-many eigenvoice conversion.Yamato Ohtani, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano
2010InterspeechAdaptive voice-quality control based on one-to-many eigenvoice conversion.Kumi Ohta, Tomoki Toda, Yamato Ohtani, Hiroshi Saruwatari, Kiyohiro Shikano
2009InterspeechCross-language voice conversion based on eigenvoices.Malorie Charlier, Yamato Ohtani, Tomoki Toda, Alexis Moinet, Thierry Dutoit
2009InterspeechMany-to-many eigenvoice conversion with reference voice.Yamato Ohtani, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano
2008InterspeechLow-delay voice conversion based on maximum likelihood estimation of spectral parameter trajectory.Takashi Muramatsu, Yamato Ohtani, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano
2008InterspeechAn improved one-to-many eigenvoice conversion system.Yamato Ohtani, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano
2008InterspeechMaximum a posteriori adaptation for many-to-one eigenvoice conversion.Daisuke Tani, Tomoki Toda, Yamato Ohtani, Hiroshi Saruwatari, Kiyohiro Shikano
2007ICASSPOne-to-Many and Many-to-One Voice Conversion Based on Eigenvoices.Tomoki Toda, Yamato Ohtani, Kiyohiro Shikano
2007InterspeechSpeaker adaptive training for one-to-many eigenvoice conversion based on Gaussian mixture model.Yamato Ohtani, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano
2006InterspeechMaximum likelihood voice conversion based on GMM with STRAIGHT mixed excitation.Yamato Ohtani, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano
2006InterspeechEigenvoice conversion based on Gaussian mixture model.Tomoki Toda, Yamato Ohtani, Kiyohiro Shikano