Skip to content

Yusuke Ijima

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

42

Venues

4

Active years

2008–2025

Best venue rank

A

Where they publish

Papers

42 indexed papers, newest first.

YearVenueTitleAuthors
2025InterspeechVoice Impression Control in Zero-Shot TTS.Kenichi Fujita, Shota Horiguchi, Yusuke Ijima
2024ICASSPWhat Do Self-Supervised Speech and Speaker Models Learn? New Findings from a Cross Model Layer-Wise Analysis.Takanori Ashihara, Marc Delcroix, Takafumi Moriya, Kohei Matsuura, Taichi Asami, Yusuke Ijima
2024ICASSPNoise-Robust Zero-Shot Text-to-Speech Synthesis Conditioned on Self-Supervised Speech-Representation Model with Adapters.Kenichi Fujita, Hiroshi Sato, Takanori Ashihara, Hiroki Kanagawa, Marc Delcroix, Takafumi Moriya, Yusuke Ijima
2024ICASSPSTYLECAP: Automatic Speaking-Style Captioning from Speech Based on Speech and Language Self-Supervised Learning Models.Kazuki Yamauchi, Yusuke Ijima, Yuki Saito
2024InterspeechLightweight Zero-shot Text-to-Speech with Mixture of Adapters.Kenichi Fujita, Takanori Ashihara, Marc Delcroix, Yusuke Ijima
2024InterspeechKnowledge Distillation from Self-Supervised Representation Learning Model with Discrete Speech Units for Any-to-Any Streaming Voice Conversion.Hiroki Kanagawa, Yusuke Ijima
2024InterspeechPre-training Neural Transducer-based Streaming Voice Conversion for Faster Convergence and Alignment-free Training.Hiroki Kanagawa, Takafumi Moriya, Yusuke Ijima
2023ICASSPZero-Shot Text-to-Speech Synthesis Conditioned Using Self-Supervised Speech Representation Model.Kenichi Fujita, Takanori Ashihara, Hiroki Kanagawa, Takafumi Moriya, Yusuke Ijima
2023ICASSPEnhancement of Text-Predicting Style Token With Generative Adversarial Network for Expressive Speech Synthesis.Hiroki Kanagawa, Yusuke Ijima
2023InterspeechSpeechGLUE: How Well Can Self-Supervised Speech Models Capture Linguistic Knowledge?Takanori Ashihara, Takafumi Moriya, Kohei Matsuura, Tomohiro Tanaka, Yusuke Ijima, Taichi Asami, Marc Delcroix, Yukinori Honma
2023InterspeechVC-T: Streaming Voice Conversion Based on Neural Transducer.Hiroki Kanagawa, Takafumi Moriya, Yusuke Ijima
2023InterspeechA stimulus-organism-response model of willingness to buy from advertising speech using voice quality.Mizuki Nagano, Yusuke Ijima, Sadao Hiroya
2023InterspeechInfluence of Personal Traits on Impressions of One's Own Voice.Hikaru Yanagida, Yusuke Ijima, Naohiro Tawara
2022ICASSPMulti-Sample Subband Wavernn Via Multivariate Gaussian.Hiroki Kanagawa, Yusuke Ijima
2022InterspeechJoint Modeling of Multi-Sample and Subband Signals for Fast Neural Vocoding on CPU.Hiroki Kanagawa, Yusuke Ijima, Hiroyuki Toda
2022InterspeechPredicting VQVAE-based Character Acting Style from Quotation-Annotated Text for Audiobook Speech Synthesis.Wataru Nakata, Tomoki Koriyama, Shinnosuke Takamichi, Yuki Saito, Yusuke Ijima, Ryo Masumura, Hiroshi Saruwatari
2021ASRURobust Speech-Age Estimation Using Local Maximum Mean Discrepancy Under Mismatched Recording Conditions.Naohiro Tawara, Atsunori Ogawa, Yuki Kitagishi, Hosana Kamiyama, Yusuke Ijima
2021ICASSPSpeech Emotion Recognition Based on Listener Adaptive Models.Atsushi Ando, Ryo Masumura, Hiroshi Sato, Takafumi Moriya, Takanori Ashihara, Yusuke Ijima, Tomoki Toda
2021ICASSPSimpleflat: A Simple Whole-Network Pre-Training Approach for RNN Transducer-Based End-to-End Speech Recognition.Takafumi Moriya, Takanori Ashihara, Tomohiro Tanaka, Tsubasa Ochiai, Hiroshi Sato, Atsushi Ando, Yusuke Ijima, Ryo Masumura, Yusuke Shinohara
2021InterspeechPhoneme Duration Modeling Using Speech Rhythm-Based Speaker Embeddings for Multi-Speaker Speech Synthesis.Kenichi Fujita, Atsushi Ando, Yusuke Ijima
2021InterspeechPhonetic and Prosodic Information Estimation from Texts for Genuine Japanese End-to-End Text-to-Speech.Naoto Kakegawa, Sunao Hara, Masanobu Abe, Yusuke Ijima
2021InterspeechImpact of Emotional State on Estimation of Willingness to Buy from Advertising Speech.Mizuki Nagano, Yusuke Ijima, Sadao Hiroya
2020InterspeechLightweight LPCNet-Based Neural Vocoder with Tensor Decomposition.Hiroki Kanagawa, Yusuke Ijima
2020InterspeechInvestigating Effective Additional Contextual Factors in DNN-Based Spontaneous Speech Synthesis.Yuki Yamashita, Tomoki Koriyama, Yuki Saito, Shinnosuke Takamichi, Yusuke Ijima, Ryo Masumura, Hiroshi Saruwatari
2020LRECDNN-based Speech Synthesis Using Abundant Tags of Spontaneous Speech Corpus.Yuki Yamashita, Tomoki Koriyama, Yuki Saito, Shinnosuke Takamichi, Yusuke Ijima, Ryo Masumura, Hiroshi Saruwatari
2019InterspeechEnd-to-End Automatic Speech Recognition with a Reconstruction Criterion Using Speech-to-Text and Text-to-Speech Encoder-Decoders.Ryo Masumura, Hiroshi Sato, Tomohiro Tanaka, Takafumi Moriya, Yusuke Ijima, Takanobu Oba
2018ICASSPSoft-Target Training with Ambiguous Emotional Utterances for DNN-Based Speech Emotion Classification.Atsushi Ando, Satoshi Kobashikawa, Hosana Kamiyama, Ryo Masumura, Yusuke Ijima, Yushi Aono
2018ICASSPNeural Confnet Classification: Fully Neural Network Based Spoken Utterance Classification Using Word Confusion Networks.Ryo Masumura, Yusuke Ijima, Taichi Asami, Hirokazu Masataki, Ryuichiro Higashinaka
2018ICASSPNon-Parallel Voice Conversion Using Variational Autoencoders Conditioned by Phonetic Posteriorgrams and D-Vectors.Yuki Saito, Yusuke Ijima, Kyosuke Nishida, Shinnosuke Takamichi
2017ICASSPGenerative adversarial network-based postfilter for statistical parametric speech synthesis.Takuhiro Kaneko, Hirokazu Kameoka, Nobukatsu Hojo, Yusuke Ijima, Kaoru Hiramatsu, Kunio Kashino
2017InterspeechDNN-SPACE: DNN-HMM-Based Generative Model of Voice FNobukatsu Hojo, Yasuhito Ohsugi, Yusuke Ijima, Hirokazu Kameoka
2017InterspeechProsody Aware Word-Level Encoder Based on BLSTM-RNNs for DNN-Based Speech Synthesis.Yusuke Ijima, Nobukatsu Hojo, Ryo Masumura, Taichi Asami
2016InterspeechAn Investigation of DNN-Based Speech Synthesis Using Speaker Codes.Nobukatsu Hojo, Yusuke Ijima, Hideyuki Mizuno
2016InterspeechObjective Evaluation Using Association Between Dimensions Within Spectral Features for Statistical Parametric Speech Synthesis.Yusuke Ijima, Taichi Asami, Hideyuki Mizuno
2015InterspeechSub-band text-to-speech combining sample-based spectrum with statistically generated spectrum.Tadashi Inai, Sunao Hara, Masanobu Abe, Yusuke Ijima, Noboru Miyazaki, Hideyuki Mizuno
2013ICASSPHMM-based expressive speech synthesis based on phrase-level F0 context labeling.Yu Maeno, Takashi Nose, Takao Kobayashi, Tomoki Koriyama, Yusuke Ijima, Hideharu Nakajima, Hideyuki Mizuno, Osamu Yoshioka
2012InterspeechSimilar Speaker Selection Technique Based on Distance Metric Learning with Perceptual Voice Quality Similarity.Yusuke Ijima, Mitsuaki Isogai, Hideyuki Mizuno
2011InterspeechCorrelation Analysis of Acoustic Features with Perceptual Voice Quality Similarity for Similar Speaker Selection.Yusuke Ijima, Mitsuaki Isogai, Hideyuki Mizuno
2011InterspeechHMM-Based Emphatic Speech Synthesis Using Unsupervised Context Labeling.Yu Maeno, Takashi Nose, Takao Kobayashi, Yusuke Ijima, Hideharu Nakajima, Hideyuki Mizuno, Osamu Yoshioka
2009ICASSPEmotional speech recognition based on style estimation and adaptation with multiple-regression HMM.Yusuke Ijima, Makoto Tachibana, Takashi Nose, Takao Kobayashi
2009InterspeechSpeaking style adaptation for spontaneous speech recognition using multiple-regression HMM.Yusuke Ijima, Takeshi Matsubara, Takashi Nose, Takao Kobayashi
2008InterspeechAn on-line adaptation technique for emotional speech recognition using style estimation with multiple-regression HMM.Yusuke Ijima, Makoto Tachibana, Takashi Nose, Takao Kobayashi