Skip to content

Takuma Okamoto

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

29

Venues

3

Active years

2014–2025

Best venue rank

Multiconference

Where they publish

Papers

29 indexed papers, newest first.

YearVenueTitleAuthors
2025ASRULayer-wise Analysis for Quality of Multilingual Synthesized Speech.Erica Cooper, Takuma Okamoto, Yamato Ohtani, Tomoki Toda, Hisashi Kawai
2025ASRUVoice Factor Control Using FIR-Based Fast Neural Vocoder for Speech Generation Applications.Yamato Ohtani, Takuma Okamoto, Tomoki Toda, Hisashi Kawai
2025ASRUSpeech Masking System Based on Spatially Separated Multiple TTS Maskers With A Compact Circular Loudspeaker Array.Takuma Okamoto
2025ICASSPMora-Level Prosody Prediction for Text-to-Speech Using Japanese BERT Without Accentual Labels.Tadashi Ogura, Takuma Okamoto, Yamato Ohtani, Erica Cooper, Tomoki Toda, Hisashi Kawai
2025InterspeechGST-BERT-TTS: Prosody Prediction Without Accentual Labels For Multi-Speaker TTS Using BERT With Global Style Tokens.Tadashi Ogura, Takuma Okamoto, Yamato Ohtani, Erica Cooper, Tomoki Toda, Hisashi Kawai
2025InterspeechSimultaneous Speech Translation Integrated Compact Multiple Sound Spot Synthesis System On A Laptop Carried Out With A Backpack.Takuma Okamoto, Michiyo Kono
2024ICASSPFIRNet: Fundamental Frequency Controllable Fast Neural Vocoder With Trainable Finite Impulse Response Filter.Yamato Ohtani, Takuma Okamoto, Tomoki Toda, Hisashi Kawai
2024ICASSPConvnext-TTS And Convnext-VC: Convnext-Based Fast End-To-End Sequence-To-Sequence Text-To-Speech And Voice Conversion.Takuma Okamoto, Yamato Ohtani, Tomoki Toda, Hisashi Kawai
2024InterspeechMobile PresenTra: NICT fast neural text-to-speech system on smartphones with incremental inference of MS-FC-HiFi-GAN for law-latency synthesis.Takuma Okamoto, Yamato Ohtani, Hisashi Kawai
2024InterspeechChallenge of Singing Voice Synthesis Using Only Text-To-Speech Corpus With FIRNet Source-Filter Neural Vocoder.Takuma Okamoto, Yamato Ohtani, Sota Shimizu, Tomoki Toda, Hisashi Kawai
2023ASRUWaveNeXt: ConvNeXt-Based Fast Neural Vocoder Without ISTFT layer.Takuma Okamoto, Haruki Yamashita, Yamato Ohtani, Tomoki Toda, Hisashi Kawai
2023ICASSPContinuous Action Space-Based Spoken Language Acquisition Agent Using Residual Sentence Embedding and Transformer Decoder.Ryota Komatsu, Yusuke Kimura, Takuma Okamoto, Takahiro Shinozaki
2023InterspeechE2E-S2S-VC: End-To-End Sequence-To-Sequence Voice Conversion.Takuma Okamoto, Tomoki Toda, Hisashi Kawai
2021ASRUMulti-Stream HiFi-GAN with Data-Driven Waveform Decomposition.Takuma Okamoto, Tomoki Toda, Hisashi Kawai
2021ICASSPHigh-Intelligibility Speech Synthesis for Dysarthric Speakers with LPCNet-Based TTS and CycleVAE-Based VC.Keisuke Matsubara, Takuma Okamoto, Ryoichi Takashima, Tetsuya Takiguchi, Tomoki Toda, Yoshinori Shiga, Hisashi Kawai
2021ICASSPClose-Talking Recording with Planarly Distributed Microphones.Takuma Okamoto
2021ICASSPNoise Level Limited Sub-Modeling for Diffusion Probabilistic Vocoders.Takuma Okamoto, Tomoki Toda, Yoshinori Shiga, Hisashi Kawai
2020ICASSPTransformer-Based Text-to-Speech with Weighted Forced Attention.Takuma Okamoto, Tomoki Toda, Yoshinori Shiga, Hisashi Kawai
2020InterspeechQuasi-Periodic Parallel WaveGAN Vocoder: A Non-Autoregressive Pitch-Dependent Dilated Convolution Model for Parametric Speech Generation.Yi-Chiao Wu, Tomoki Hayashi, Takuma Okamoto, Hisashi Kawai, Tomoki Toda
2019ASRUTacotron-Based Acoustic Model Using Phoneme Alignment for Practical Neural Text-to-Speech Systems.Takuma Okamoto, Tomoki Toda, Yoshinori Shiga, Hisashi Kawai
2019ICASSPHorizontal 3D Sound Field Recording and 2.5D Synthesis with Omni-directional Circular Arrays.Takuma Okamoto
2019ICASSPInvestigations of Real-time Gaussian Fftnet and Parallel Wavenet Neural Vocoders with Simple Acoustic Features.Takuma Okamoto, Tomoki Toda, Yoshinori Shiga, Hisashi Kawai
2019InterspeechReal-Time Neural Text-to-Speech with Sequence-to-Sequence Acoustic Model and WaveGlow or Single Gaussian WaveRNN Vocoders.Takuma Okamoto, Tomoki Toda, Yoshinori Shiga, Hisashi Kawai
2018ICASSPAn Investigation of Subband Wavenet Vocoder Covering Entire Audible Frequency Range with Limited Acoustic Features.Takuma Okamoto, Kentaro Tachibana, Tomoki Toda, Yoshinori Shiga, Hisashi Kawai
2017ASRUSubband wavenet with overlapped single-sideband filterbanks.Takuma Okamoto, Kentaro Tachibana, Tomoki Toda, Yoshinori Shiga, Hisashi Kawai
2017ICASSPAnalytical approach to 2.5D sound field control using a circular double-layer array of fixed-directivity loudspeakers.Takuma Okamoto
2016ICASSP2.5D higher order ambisonics for a sound field described by angular spectrum coefficients.Takuma Okamoto
2015ICASSPNear-field sound propagation based on a circular and linear array combination.Takuma Okamoto
2014ICASSPGeneration of multiple sound zones by spatial filtering in wavenumber domain using a linear array of loudspeakers.Takuma Okamoto