Skip to content

Hirokazu Kameoka

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

97

Venues

6

Active years

2004–2025

Best venue rank

A*

Where they publish

Papers

97 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPRethinking Mean Opinion Scores in Speech Quality Assessment: Score Aggregation through Quantized Distribution Fitting.Yuto Kondo, Hirokazu Kameoka, Kou Tanaka, Takuhiro Kaneko
2025InterspeechFasterVoiceGrad: Faster One-step Diffusion-Based Voice Conversion with Adversarial Diffusion Conversion Distillation.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Yuto Kondo
2025InterspeechVocoder-Projected Feature Discriminator.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Yuto Kondo
2025InterspeechJIS: A Speech Corpus of Japanese Idol Speakers with Various Speaking Styles.Yuto Kondo, Hirokazu Kameoka, Kou Tanaka, Takuhiro Kaneko
2024ICASSPTraining Generative Adversarial Network-Based Vocoder with Limited Data Using Augmentation-Conditional Discriminator.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka
2024ICASSPSelecting N-Lowest Scores for Training MOS Prediction Models.Yuto Kondo, Hirokazu Kameoka, Kou Tanaka, Takuhiro Kaneko
2024InterspeechFastVoiceGrad: One-step Diffusion-Based Voice Conversion with Adversarial Conditional Diffusion Distillation.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Yuto Kondo
2024InterspeechPRVAE-VC2: Non-Parallel Voice Conversion by Distillation of Speech Representations.Kou Tanaka, Hirokazu Kameoka, Takuhiro Kaneko, Yuto Kondo
2023ICASSPWave-U-Net Discriminator: Fast and Lightweight Discriminator for Generative Adversarial Network-Based Speech Synthesis.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Shogo Seki
2023ICASSPJSV-VC: Jointly Trained Speaker Verification and Voice Conversion Models.Shogo Seki, Hirokazu Kameoka, Kou Tanaka, Takuhiro Kaneko
2023InterspeechiSTFTNet2: Faster and More Lightweight iSTFT-Based Neural Vocoder Using 1D-2D CNN.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Shogo Seki
2023InterspeechCFVC: Conditional Filtering for Controllable Voice Conversion.Kou Tanaka, Takuhiro Kaneko, Hirokazu Kameoka, Shogo Seki
2022ICASSPAttentionpit: Soft Permutation Invariant Training for Audio Source Separation with Attention Mechanism.Hirokazu Kameoka, Shogo Seki, Li Li, Chihiro Watanabe
2022ICASSPISTFTNET: Fast and Lightweight Mel-Spectrogram Vocoder Incorporating Inverse Short-Time Fourier Transform.Takuhiro Kaneko, Kou Tanaka, Hirokazu Kameoka, Shogo Seki
2022ICASSPHBP: An Efficient Block Permutation Solver Using Hungarian Algorithm and Spectrogram Inpainting for Multichannel Audio Source Separation.Li Li, Hirokazu Kameoka, Shogo Seki
2022ICASSPInvestigation And Comparison of Optimization Methods for Variational Autoencoder-Based Underdetermined Multichannel Source Separation.Shogo Seki, Hirokazu Kameoka, Li Li
2022InterspeechCAUSE: Crossmodal Action Unit Sequence Estimation from Speech.Hirokazu Kameoka, Takuhiro Kaneko, Shogo Seki, Kou Tanaka
2022InterspeechMISRNet: Lightweight Neural Vocoder Using Multi-Input Single Shared Residual Blocks.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Shogo Seki
2021ICASSPSepNet: A Deep Separation Matrix Prediction Network for Multichannel Audio Source Separation.Shota Inoue, Hirokazu Kameoka, Li Li, Shoji Makino
2021ICASSPMaskcyclegan-VC: Learning Non-Parallel Voice Conversion with Filling in Frames.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Nobukatsu Hojo
2021InterspeechStarGAN-VC+ASR: StarGAN-Based Non-Parallel Voice Conversion Regularized by Automatic Speech Recognition.Shoki Sakamoto, Akira Taniguchi, Tadahiro Taniguchi, Hirokazu Kameoka
2020InterspeechVoice Transformer Network: Sequence-to-Sequence Voice Conversion Using Transformer with Text-to-Speech Pretraining.Wen-Chin Huang, Tomoki Hayashi, Yi-Chiao Wu, Hirokazu Kameoka, Tomoki Toda
2020InterspeechCycleGAN-VC3: Examining and Improving CycleGAN-VCs for Mel-Spectrogram Conversion.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Nobukatsu Hojo
2019ICASSPJoint Separation and Dereverberation of Reverberant Mixtures with Multichannel Variational Autoencoder.Shota Inoue, Hirokazu Kameoka, Li Li, Shogo Seki, Shoji Makino
2019ICASSPSeeing through Sounds: Predicting Visual Semantic Segmentation Results from Multichannel Audio Signals.Go Irie, Mirela Ostrek, Haochen Wang, Hirokazu Kameoka, Akisato Kimura, Takahito Kawanishi, Kunio Kashino
2019ICASSPCyclegan-VC2: Improved Cyclegan-based Non-parallel Voice Conversion.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Nobukatsu Hojo
2019ICASSPFast MVAE: Joint Separation and Classification of Mixed Sources Based on Multichannel Variational Autoencoder with Auxiliary Classifier.Li Li, Hirokazu Kameoka, Shoji Makino
2019ICASSPATTS2S-VC: Sequence-to-sequence Voice Conversion with Attention and Context Preservation Mechanisms.Kou Tanaka, Hirokazu Kameoka, Takuhiro Kaneko, Nobukatsu Hojo
2019InterspeechStarGAN-VC2: Rethinking Conditional Methods for StarGAN-Based Voice Conversion.Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Nobukatsu Hojo
2019InterspeechA Modified Algorithm for Multiple Input Spectrogram Inversion.Dongxiao Wang, Hirokazu Kameoka, Koichi Shinoda
2018ICASSPSpeech Waveform Synthesis from MFCC Sequences with Generative Adversarial Networks.Lauri Juvela, Bajibabu Bollepalli, Xin Wang, Hirokazu Kameoka, Manu Airaksinen, Junichi Yamagishi, Paavo Alku
2018ICASSPJoint Separation and Dereverberation of Reverberant Mixtures with Determined Multichannel Non-Negative Matrix Factorization.Hideaki Kagami, Hirokazu Kameoka, Masahiro Yukawa
2018ICASSPDeep Clustering with Gated Convolutional Networks.Li Li, Hirokazu Kameoka
2018ICASSPVae-Space: Deep Generative Model of Voice Fundamental Frequency Contours.Kou Tanaka, Hirokazu Kameoka, Kazuho Morikawa
2017ICASSPA majorization-minimization algorithm with projected gradient updates for time-domain spectrogram factorization.Hideaki Kagami, Hirokazu Kameoka, Masahiro Yukawa
2017ICASSPComplex NMF with the generalized Kullback-Leibler divergence.Hirokazu Kameoka, Hideaki Kagami, Masahiro Yukawa
2017ICASSPGenerative adversarial network-based postfilter for statistical parametric speech synthesis.Takuhiro Kaneko, Hirokazu Kameoka, Nobukatsu Hojo, Yusuke Ijima, Kaoru Hiramatsu, Kunio Kashino
2017ICASSPFast algorithm for statistical phrase/accent command estimation based on generative model incorporating spectral features.Ryotaro Sato, Hirokazu Kameoka, Kunio Kashino
2017ICASSPA noise suppression method for body-conducted soft speech based on non-negative tensor factorization of air- and body-conducted signals.Yusuke Tajiri, Hirokazu Kameoka, Tomoki Toda
2017InterspeechDNN-SPACE: DNN-HMM-Based Generative Model of Voice FNobukatsu Hojo, Yasuhito Ohsugi, Yusuke Ijima, Hirokazu Kameoka
2017InterspeechSequence-to-Sequence Voice Conversion with Similarity Metric Learned Using Generative Adversarial Networks.Takuhiro Kaneko, Hirokazu Kameoka, Kaoru Hiramatsu, Kunio Kashino
2017InterspeechGenerative Adversarial Network-Based Postfilter for STFT Spectrograms.Takuhiro Kaneko, Shinji Takaki, Hirokazu Kameoka, Junichi Yamagishi
2017InterspeechSpeech Enhancement Using Non-Negative Spectrogram Models with Mel-Generalized Cepstral Regularization.Li Li, Hirokazu Kameoka, Tomoki Toda, Shoji Makino
2017InterspeechDirect Modeling of Frequency Spectra and Waveform Generation Based on Phase Recovery for DNN-Based Speech Synthesis.Shinji Takaki, Hirokazu Kameoka, Junichi Yamagishi
2017InterspeechPhysically Constrained Statistical FKou Tanaka, Hirokazu Kameoka, Tomoki Toda, Satoshi Nakamura
2016ICASSPSparse sound field decomposition with multichannel extension of complex NMF.Naoki Murata, Shoichi Koyama, Hirokazu Kameoka, Norihiro Takamune, Hiroshi Saruwatari
2016ICASSPShifted and convolutive source-filter non-negative matrix factorization for monaural audio source separation.Tomohiko Nakamura, Hirokazu Kameoka
2016ICASSPStatistical F0 prediction for electrolaryngeal speech enhancement considering generative process of F0 contours within product of experts framework.Kou Tanaka, Hirokazu Kameoka, Tomoki Toda, Satoshi Nakamura
2016InterspeechMajorisation-Minimisation Based Optimisation of the Composite Autoregressive System with Application to Glottal Inverse Filtering.Lauri Juvela, Hirokazu Kameoka, Manu Airaksinen, Junichi Yamagishi, Paavo Alku
2016InterspeechSemi-Supervised Joint Enhancement of Spectral and Cepstral Sequences of Noisy Speech.Li Li, Hirokazu Kameoka, Takuya Higuchi, Hiroshi Saruwatari
2016InterspeechAcoustic-to-Articulatory Inversion Mapping Based on Latent Trajectory Gaussian Mixture Model.Patrick Lumban Tobing, Tomoki Toda, Hirokazu Kameoka, Satoshi Nakamura
2015ICASSPMulti-resolution signal decomposition with time-domain spectrogram factorization.Hirokazu Kameoka
2015ICASSPEfficient multichannel nonnegative matrix factorization exploiting rank-1 spatial model.Daichi Kitamura, Nobutaka Ono, Hiroshi Sawada, Hirokazu Kameoka, Hiroshi Saruwatari
2015ICASSPLTomohiko Nakamura, Hirokazu Kameoka
2014DAFXFast Signal Reconstruction from Magnitude Spectrogram of Continuous Wavelet Transform Based on Spectrogram Consistency.Tomohiko Nakamura, Hirokazu Kameoka
2014ICASSPUnderdetermined blind separation and tracking of moving sources based ONDOA-HMM.Takuya Higuchi, Norihiro Takamune, Tomohiko Nakamura, Hirokazu Kameoka
2014ICASSPTimbre replacement of harmonic and drum components for music audio signals.Tomohiko Nakamura, Hirokazu Kameoka, Kazuyoshi Yoshii, Masataka Goto
2014ICASSPMondrian hidden Markov model for music signal processing.Masahiro Nakano, Yasunori Ohishi, Hirokazu Kameoka, Ryo Mukai, Kunio Kashino
2014ICASSPMixture of Gaussian process experts for predicting sung melodic contour with expressive dynamic fluctuations.Yasunori Ohishi, Daichi Mochihashi, Hirokazu Kameoka, Kunio Kashino
2014InterspeechA unified approach for underdetermined blind signal separation and source activity detection by multichannel factorial hidden Markov models.Takuya Higuchi, Hirofumi Takeda, Tomohiko Nakamura, Hirokazu Kameoka
2014InterspeechSpeech prosody generation for text-to-speech synthesis based on generative model of FKento Kadowaki, Tatsuma Ishihara, Nobukatsu Hojo, Hirokazu Kameoka
2013ICASSPBayesian semi-supervised audio event transcription based on Markov indian buffet process.Yasunori Ohishi, Daichi Mochihashi, Tomoko Matsui, Masahiro Nakano, Hirokazu Kameoka, Tomonori Izumitani, Kunio Kashino
2013InterspeechProbabilistic speech FTatsuma Ishihara, Hirokazu Kameoka, Kota Yoshizato, Daisuke Saito, Shigeki Sagayama
2013InterspeechGenerative modeling of speech FHirokazu Kameoka, Kota Yoshizato, Tatsuma Ishihara, Yasunori Ohishi, Kunio Kashino, Shigeki Sagayama
2012ICASSPConstrained and regularized variants of non-negative matrix factorization incorporating music-specific constraints.Hirokazu Kameoka, Masahiro Nakano, Kazuki Ochiai, Yutaka Imoto, Kunio Kashino, Shigeki Sagayama
2012ICASSPBayesian nonparametric music parser.Masahiro Nakano, Yasunori Ohishi, Hirokazu Kameoka, Ryo Mukai, Kunio Kashino
2012ICASSPExplicit beat structure modeling for non-negative matrix factorization-based multipitch analysis.Kazuki Ochiai, Hirokazu Kameoka, Shigeki Sagayama
2012ICASSPEfficient algorithms for multichannel extensions of Itakura-Saito nonnegative matrix factorization.Hiroshi Sawada, Hirokazu Kameoka, Shoko Araki, Naonori Ueda
2012ICASSPComparative evaluations of various harmonic/percussive sound separation algorithms based on anisotropic continuity of spectrogram.Hideyuki Tachibana, Hirokazu Kameoka, Nobutaka Ono, Shigeki Sagayama
2012ICPRDesigning various component analysis at will.Akisato Kimura, Hitoshi Sakano, Hirokazu Kameoka, Masashi Sugiyama
2012InterspeechA Stochastic Model of Singing Voice F0 Contours for Characterizing Expressive Dynamic Components.Yasunori Ohishi, Hirokazu Kameoka, Daichi Mochihashi, Kunio Kashino
2012InterspeechHidden Markov Convolutive Mixture Model for Pitch Contour Analysis of Speech.Kota Yoshizato, Hirokazu Kameoka, Daisuke Saito, Shigeki Sagayama
2011ICASSPAutomatic video annotation via Hierarchical Topic Trajectory Model considering cross-modal correlations.Takuho Nakano, Akisato Kimura, Hirokazu Kameoka, Shigeki Miyabe, Shigeki Sagayama, Nobutaka Ono, Kunio Kashino, Takuya Nishimoto
2011ICASSPInfinite-state spectrum model for music signal analysis.Masahiro Nakano, Jonathan Le Roux, Hirokazu Kameoka, Nobutaka Ono, Shigeki Sagayama
2011ICASSPFormulations and algorithms for multichannel complex NMF.Hiroshi Sawada, Hirokazu Kameoka, Shoko Araki, Naonori Ueda
2011ICASSPAutomatic audio tag classification via semi-supervised canonical density estimation.Jun Takagi, Yasunori Ohishi, Akisato Kimura, Masashi Sugiyama, Makoto Yamada, Hirokazu Kameoka
2011ICASSPI-Divergence-based dereverberation method with auxiliary function approach.Naoki Yasuraoka, Hirokazu Kameoka, Takuya Yoshioka, Hiroshi G. Okuno
2010ICASSPA sparse component model of source signals and its application to blind source separation.Yu Kitano, Hirokazu Kameoka, Yosuke Izumi, Nobutaka Ono, Shigeki Sagayama
2010ICPRSemiCCA: Efficient Semi-supervised Learning of Canonical Correlations.Akisato Kimura, Hirokazu Kameoka, Masashi Sugiyama, Takuho Nakano, Eisaku Maeda, Hitoshi Sakano, Katsuhiko Ishiguro
2010InterspeechA statistical model of speech F0 contours.Hirokazu Kameoka, Jonathan Le Roux, Yasunori Ohishi
2010InterspeechStatistical modeling of F0 dynamics in singing voices based on Gaussian processes with multiple oscillation bases.Yasunori Ohishi, Hirokazu Kameoka, Daichi Mochihashi, Hidehisa Nagano, Kunio Kashino
2009ICASSPRobust speech dereverberation based on non-negativity and sparse nature of speech spectrograms.Hirokazu Kameoka, Tomohiro Nakatani, Takuya Yoshioka
2009ICASSPComplex NMF: A new sparse representation for acoustic signals.Hirokazu Kameoka, Nobutaka Ono, Kunio Kashino, Shigeki Sagayama
2009ISCASComposite Autoregressive System for Sparse Source-filter Representation of speech.Hirokazu Kameoka, Kunio Kashino
2008ICASSPAuxiliary function approach to parameter estimation of constrained sinusoidal model for monaural speech separation.Hirokazu Kameoka, Nobutaka Ono, Shigeki Sagayama
2008ICASSPHarmonic-Temporal-Timbral Clustering (HTTC) for the analysis of multi-instrument polyphonic music signals.Kenichi Miyamoto, Hirokazu Kameoka, Takuya Nishimoto, Nobutaka Ono, Shigeki Sagayama
2008ICASSPModulation analysis of speech through orthogonal FIR filterbank optimization.Jonathan Le Roux, Hirokazu Kameoka, Nobutaka Ono, Shigeki Sagayama, Alain de Cheveign
2008InterspeechParameter estimation method of F0 control model for singing voices.Yasunori Ohishi, Hirokazu Kameoka, Kunio Kashino, Kazuya Takeda
2008InterspeechComputational auditory induction by missing-data non-negative matrix factorization.Jonathan Le Roux, Hirokazu Kameoka, Nobutaka Ono, Alain de Cheveign, Shigeki Sagayama
2007ICASSPProbabilistic Approach to Automatic Music Transcription from Audio Signals.Kenichi Miyamoto, Hirokazu Kameoka, Haruto Takeda, Takuya Nishimoto, Shigeki Sagayama
2007ICASSPHarmonic-Temporal Clustering of Speech for Single and Multiple F0 Contour Estimation in Noisy Environments.Jonathan Le Roux, Hirokazu Kameoka, Nobutaka Ono, Alain de Cheveign, Shigeki Sagayama
2007IJCAIAutomatic Decision of Piano Fingering Based on a Hidden Markov Models.Yuichiro Yonebayashi, Hirokazu Kameoka, Shigeki Sagayama
2006InterspeechSpeech analyzer using a joint estimation model of spectral envelope and fine structure.Hirokazu Kameoka, Jonathan Le Roux, Nobutaka Ono, Shigeki Sagayama
2005ICASSPAudio stream segregation of multi-pitch music signal based on time-space clustering using Gaussian kernel 2-dimensional model.Hirokazu Kameoka, Takuya Nishimoto, Shigeki Sagayama
2004ICASSPSeparation of harmonic structures based on tied Gaussian mixture model and information criterion for concurrent sounds.Hirokazu Kameoka, Takuya Nishimoto, Shigeki Sagayama
2004InterspeechMulti-pitch trajectory estimation of concurrent speech based on harmonic GMM and nonlinear kalman filtering.Takuya Nishimoto, Shigeki Sagayama, Hirokazu Kameoka
2004InterspeechSpecmurt anasylis: a piano-roll-visualization of polyphonic music signal by deconvolution of log-frequency spectrum.Shigeki Sagayama, Keigo Takahashi, Hirokazu Kameoka, Takuya Nishimoto