Skip to content

Kou Tanaka

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

29

Venues

4

Active years

2013–2025

Best venue rank

A

Where they publish

Papers

29 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPRethinking Mean Opinion Scores in Speech Quality Assessment: Score Aggregation through Quantized Distribution Fitting.Yuto Kondo, Hirokazu Kameoka, Kou Tanaka, Takuhiro Kaneko
2025InterspeechFasterVoiceGrad: Faster One-step Diffusion-Based Voice Conversion with Adversarial Diffusion Conversion Distillation.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Yuto Kondo
2025InterspeechVocoder-Projected Feature Discriminator.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Yuto Kondo
2025InterspeechJIS: A Speech Corpus of Japanese Idol Speakers with Various Speaking Styles.Yuto Kondo, Hirokazu Kameoka, Kou Tanaka, Takuhiro Kaneko
2024ICASSPTraining Generative Adversarial Network-Based Vocoder with Limited Data Using Augmentation-Conditional Discriminator.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka
2024ICASSPSelecting N-Lowest Scores for Training MOS Prediction Models.Yuto Kondo, Hirokazu Kameoka, Kou Tanaka, Takuhiro Kaneko
2024InterspeechFastVoiceGrad: One-step Diffusion-Based Voice Conversion with Adversarial Conditional Diffusion Distillation.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Yuto Kondo
2024InterspeechPRVAE-VC2: Non-Parallel Voice Conversion by Distillation of Speech Representations.Kou Tanaka, Hirokazu Kameoka, Takuhiro Kaneko, Yuto Kondo
2023ICASSPWave-U-Net Discriminator: Fast and Lightweight Discriminator for Generative Adversarial Network-Based Speech Synthesis.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Shogo Seki
2023ICASSPJSV-VC: Jointly Trained Speaker Verification and Voice Conversion Models.Shogo Seki, Hirokazu Kameoka, Kou Tanaka, Takuhiro Kaneko
2023InterspeechiSTFTNet2: Faster and More Lightweight iSTFT-Based Neural Vocoder Using 1D-2D CNN.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Shogo Seki
2023InterspeechCFVC: Conditional Filtering for Controllable Voice Conversion.Kou Tanaka, Takuhiro Kaneko, Hirokazu Kameoka, Shogo Seki
2022ICASSPISTFTNET: Fast and Lightweight Mel-Spectrogram Vocoder Incorporating Inverse Short-Time Fourier Transform.Takuhiro Kaneko, Kou Tanaka, Hirokazu Kameoka, Shogo Seki
2022InterspeechCAUSE: Crossmodal Action Unit Sequence Estimation from Speech.Hirokazu Kameoka, Takuhiro Kaneko, Shogo Seki, Kou Tanaka
2022InterspeechMISRNet: Lightweight Neural Vocoder Using Multi-Input Single Shared Residual Blocks.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Shogo Seki
2021ICASSPMaskcyclegan-VC: Learning Non-Parallel Voice Conversion with Filling in Frames.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Nobukatsu Hojo
2020InterspeechCycleGAN-VC3: Examining and Improving CycleGAN-VCs for Mel-Spectrogram Conversion.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Nobukatsu Hojo
2020SIGdialCollection and Analysis of Dialogues Provided by Two Speakers Acting as One.Tsunehiro Arimoto, Ryuichiro Higashinaka, Kou Tanaka, Takahito Kawanishi, Hiroaki Sugiyama, Hiroshi Sawada, Hiroshi Ishiguro
2019ICASSPCyclegan-VC2: Improved Cyclegan-based Non-parallel Voice Conversion.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Nobukatsu Hojo
2019ICASSPATTS2S-VC: Sequence-to-sequence Voice Conversion with Attention and Context Preservation Mechanisms.Kou Tanaka, Hirokazu Kameoka, Takuhiro Kaneko, Nobukatsu Hojo
2019InterspeechStarGAN-VC2: Rethinking Conditional Methods for StarGAN-Based Voice Conversion.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Nobukatsu Hojo
2018ICASSPVae-Space: Deep Generative Model of Voice Fundamental Frequency Contours.Kou Tanaka, Hirokazu Kameoka, Kazuho Morikawa
2017InterspeechPhysically Constrained Statistical FKou Tanaka, Hirokazu Kameoka, Tomoki Toda, Satoshi Nakamura
2016ICASSPStatistical F0 prediction for electrolaryngeal speech enhancement considering generative process of F0 contours within product of experts framework.Kou Tanaka, Hirokazu Kameoka, Tomoki Toda, Satoshi Nakamura
2015ASSETSAn Enhanced Electrolarynx with Automatic Fundamental Frequency Control based on Statistical Prediction.Kou Tanaka, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura
2015InterspeechNon-audible murmur enhancement based on statistical conversion using air- and body-conductive microphones in noisy environments.Yusuke Tajiri, Kou Tanaka, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura
2014ICASSPAn evaluation of excitation feature prediction in a hybrid approach to electrolaryngeal speech enhancement.Kou Tanaka, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura
2014InterspeechDirect FKou Tanaka, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura
2013InterspeechA hybrid approach to electrolaryngeal speech enhancement based on spectral subtraction and statistical voice conversion.Kou Tanaka, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura