| 2026 | ACL | When Bigger Isn't Better: A Comprehensive Fairness Evaluation of Political Bias in Multi-News Summarisation. | Nannan Huang, Iffat Maab, Junichi Yamagishi |
| 2026 | EACL | Prompt-driven Detection of Offensive Urdu Language using Large Language Models. | Iffat Maab, Usman Haider, Junichi Yamagishi |
| 2026 | EACL | Pushing the Frontiers of Scientific Fact-Checking: The SCINLP Dataset. | Iffat Maab, Junichi Yamagishi |
| 2026 | LREC | From Articles to Premises: Building PrimeFacts, an Extraction Methodology and Resource for Fact-Checking Evidence. | Premtim Sahitaj, Jawan Kolanowski, Ariana Sahitaj, Veronika Solopova, Max Upravitelev, Daniel Rder, Iffat Maab, Junichi Yamagishi, Sebastian Mller, Vera Schmitt |
| 2025 | ACL | QualiSpeech: A Speech Quality Assessment Dataset with Natural Language Reasoning and Descriptions. | Siyin Wang, Wenyi Yu, Xianzhao Chen, Xiaohai Tian, Jun Zhang, Lu Lu, Yu Tsao, Junichi Yamagishi, Yuxuan Wang, Chao Zhang |
| 2025 | ASRU | Post-training for Deepfake Speech Detection. | Wanying Ge, Xin Wang, Xuechen Liu, Junichi Yamagishi |
| 2025 | ICASSP | Explaining Speaker and Spoof Embeddings via Probing. | Xuechen Liu, Junichi Yamagishi, Md. Sahidullah, Tomi Kinnunen |
| 2025 | ICASSP | Towards An Integrated Approach for Expressive Piano Performance Synthesis from Music Scores. | Jingjing Tang, Erica Cooper, Xin Wang, Junichi Yamagishi, Gyrgy Fazekas |
| 2025 | ICASSP | The First VoicePrivacy Attacker Challenge. | Natalia A. Tomashenko, Xiaoxiao Miao, Emmanuel Vincent, Junichi Yamagishi |
| 2025 | Interspeech | AfriHuBERT: A self-supervised speech representation model for African languages. | Jesujoba O. Alabi, Xuechen Liu, Dietrich Klakow, Junichi Yamagishi |
| 2025 | Interspeech | From Sharpness to Better Generalization for Speech Deepfake Detection. | Wen Huang, Xuechen Liu, Xin Wang, Junichi Yamagishi, Yanmin Qian |
| 2025 | Interspeech | A Comparative Study on Proactive and Passive Detection of Deepfake Speech. | Chia-Hua Wu, Wanying Ge, Xin Wang, Junichi Yamagishi, Yu Tsao, Hsin-Min Wang |
| 2025 | Interspeech | Mitigating Language Mismatch in SSL-Based Speaker Anonymization. | Zhe Zhang, Wen-Chin Huang, Xin Wang, Xiaoxiao Miao, Junichi Yamagishi |
| 2024 | COLING | Bridging Textual and Tabular Worlds for Fact Verification: A Lightweight, Attention-Based Model. | Shirin Dabbaghi Varnosfaderani, Canasai Kruengkrai, Ramin Yahyapour, Junichi Yamagishi |
| 2024 | ICASSP | Can Large-Scale Vocoded Spoofed Data Improve Speech Spoofing Countermeasure with a Self-Supervised Front End? | Xin Wang, Junichi Yamagishi |
| 2024 | ICASSP | Spoofing Attack Augmentation: Can Differently-Trained Attack Models Improve Generalisation? | Wanying Ge, Xin Wang, Junichi Yamagishi, Massimiliano Todisco, Nicholas W. D. Evans |
| 2024 | ICASSP | Synvox2: Towards A Privacy-Friendly Voxceleb2 Dataset. | Xiaoxiao Miao, Xin Wang, Erica Cooper, Junichi Yamagishi, Nicholas W. D. Evans, Massimiliano Todisco, Jean-Franois Bonastre, Mickael Rouvier |
| 2024 | ICASSP | Uncertainty as a Predictor: Leveraging Self-Supervised Learning for Zero-Shot MOS Prediction. | Aditya Ravuri, Erica Cooper, Junichi Yamagishi |
| 2024 | Interspeech | Revisiting and Improving Scoring Fusion for Spoofing-aware Speaker Verification Using Compositional Data Analysis. | Xin Wang, Tomi Kinnunen, Kong Aik Lee, Paul-Gauthier No, Junichi Yamagishi |
| 2024 | Interspeech | Generating Speakers by Prompting Listener Impressions for Pre-trained Multi-Speaker Text-to-Speech Systems. | Zhengyang Chen, Xuechen Liu, Erica Cooper, Junichi Yamagishi, Yanmin Qian |
| 2024 | Interspeech | An Initial Investigation of Language Adaptation for TTS Systems under Low-resource Scenarios. | Cheng Gong, Erica Cooper, Xin Wang, Chunyu Qiang, Mengzhe Geng, Dan Wells, Longbiao Wang, Jianwu Dang, Marc Tessier, Aidan Pine, Korin Richmond, Junichi Yamagishi |
| 2024 | Interspeech | To what extent can ASV systems naturally defend against spoofing attacks? | Jee-weon Jung, Xin Wang, Nicholas W. D. Evans, Shinji Watanabe, Hye-jin Shim, Hemlata Tak, Siddhant Arora, Junichi Yamagishi, Joon Son Chung |
| 2024 | Interspeech | Speaker Detection by the Individual Listener and the Crowd: Parametric Models Applicable to Bonafide and Deepfake Speech. | Tomi H. Kinnunen, Rosa Gonzlez Hautamki, Xin Wang, Junichi Yamagishi |
| 2024 | Interspeech | Target Speaker Extraction with Curriculum Learning. | Yun Liu, Xuechen Liu, Xiaoxiao Miao, Junichi Yamagishi |
| 2024 | Interspeech | Experimental evaluation of MOS, AB and BWS listening test designs. | Dan Wells, Andrea Lorena Aldana Blanco, Cassia Valentini-Botinhao, Erica Cooper, Aidan Pine, Junichi Yamagishi, Korin Richmond |
| 2024 | Interspeech | Spoof Diarization: "What Spoofed When" in Partially Spoofed Audio. | Lin Zhang, Xin Wang, Erica Cooper, Mireia Dez, Federico Landini, Nicholas W. D. Evans, Junichi Yamagishi |
| 2023 | ACL | Revisiting Pathologies of Neural Models under Input Reduction. | Canasai Kruengkrai, Junichi Yamagishi |
| 2023 | ASRU | The Voicemos Challenge 2023: Zero-Shot Subjective Speech Quality Prediction for Multiple Domains. | Erica Cooper, Wen-Chin Huang, Yu Tsao, Hsin-Min Wang, Tomoki Toda, Junichi Yamagishi |
| 2023 | ASRU | Partial Rank Similarity Minimization Method for Quality MOS Prediction of Unseen Speech Synthesis Systems in Zero-Shot and Semi-Supervised Setting. | Hemant Yadav, Erica Cooper, Junichi Yamagishi, Sunayana Sitaram, Rajiv Ratn Shah |
| 2023 | ICASSP | Joint Noise Reduction and Listening Enhancement for Full-End Speech Enhancement. | Haoyu Li, Yun Liu, Junichi Yamagishi |
| 2023 | ICASSP | Hiding Speaker's Sex in Speech Using Zero-Evidence Speaker Representation in an Analysis/Synthesis Pipeline. | Paul-Gauthier No, Xiaoxiao Miao, Xin Wang, Junichi Yamagishi, Jean-Franois Bonastre, Driss Matrouf |
| 2023 | ICASSP | Can Knowledge of End-to-End Text-to-Speech Models Improve Neural Midi-to-Audio Synthesis Systems? | Xuan Shi, Erica Cooper, Xin Wang, Junichi Yamagishi, Shrikanth Narayanan |
| 2023 | ICASSP | Spoofed Training Data for Speech Spoofing Countermeasure Can Be Efficiently Created Using Neural Vocoders. | Xin Wang, Junichi Yamagishi |
| 2023 | Interspeech | Investigating Range-Equalizing Bias in Mean Opinion Score Ratings of Synthesized Speech. | Erica Cooper, Junichi Yamagishi |
| 2023 | Interspeech | Controlling Multi-Class Human Vocalization Generation via a Simple Segment-based Labeling Scheme. | Hieu-Thi Luong, Junichi Yamagishi |
| 2023 | Interspeech | Towards Single Integrated Spoofing-aware Speaker Verification Embeddings. | Sung Hwan Mun, Hye-jin Shim, Hemlata Tak, Xin Wang, Xuechen Liu, Md. Sahidullah, Myeonghun Jeong, Min Hyun Han, Massimiliano Todisco, Kong Aik Lee, Junichi Yamagishi, Nicholas W. D. Evans, Tomi Kinnunen, Nam Soo Kim, Jee-weon Jung |
| 2023 | Interspeech | Improving Generalization Ability of Countermeasures for New Mismatch Scenario by Combining Multiple Advanced Regularization Terms. | Chang Zeng, Xin Wang, Xiaoxiao Miao, Erica Cooper, Junichi Yamagishi |
| 2023 | Interspeech | Range-Based Equal Error Rate for Spoof Localization. | Lin Zhang, Xin Wang, Erica Cooper, Nicholas W. D. Evans, Junichi Yamagishi |
| 2023 | WACV | Analysis of Master Vein Attacks on Finger Vein Recognition Systems. | Huy H. Nguyen, Trung-Nghia Le, Junichi Yamagishi, Isao Echizen |
| 2022 | COLING | Mitigating the Diminishing Effect of Elastic Weight Consolidation. | Canasai Kruengkrai, Junichi Yamagishi |
| 2022 | ICASSP | Generalization Ability of MOS Prediction Networks. | Erica Cooper, Wen-Chin Huang, Tomoki Toda, Junichi Yamagishi |
| 2022 | ICASSP | LDNet: Unified Listener Dependent Modeling in MOS Prediction for Synthetic Speech. | Wen-Chin Huang, Erica Cooper, Junichi Yamagishi, Tomoki Toda |
| 2022 | ICASSP | On the Interplay between Sparsity, Naturalness, Intelligibility, and Prosody in Speech Synthesis. | Cheng-I Jeff Lai, Erica Cooper, Yang Zhang, Shiyu Chang, Kaizhi Qian, Yi-Lun Liao, Yung-Sung Chuang, Alexander H. Liu, Junichi Yamagishi, David D. Cox, James R. Glass |
| 2022 | ICASSP | Estimating the Confidence of Speech Spoofing Countermeasure. | Xin Wang, Junichi Yamagishi |
| 2022 | ICASSP | Attention Back-End for Automatic Speaker Verification with Multiple Enrollment Utterances. | Chang Zeng, Xin Wang, Erica Cooper, Xiaoxiao Miao, Junichi Yamagishi |
| 2022 | IJCNLP | Outlier-Aware Training for Improving Group Accuracy Disparities. | Li-Kuang Chen, Canasai Kruengkrai, Junichi Yamagishi |
| 2022 | Interspeech | The VoiceMOS Challenge 2022. | Wen-Chin Huang, Erica Cooper, Yu Tsao, Hsin-Min Wang, Tomoki Toda, Junichi Yamagishi |
| 2022 | Interspeech | DDS: A new device-degraded speech dataset for speech enhancement. | Haoyu Li, Junichi Yamagishi |
| 2022 | Interspeech | Analyzing Language-Independent Speaker Anonymization Framework under Unseen Conditions. | Xiaoxiao Miao, Xin Wang, Erica Cooper, Junichi Yamagishi, Natalia A. Tomashenko |
| 2022 | Interspeech | Spoofing-Aware Attention based ASV Back-end with Multiple Enrollment Utterances and a Sampling Strategy for the SASV Challenge 2022. | Chang Zeng, Lin Zhang, Meng Liu, Junichi Yamagishi |
| 2021 | ACL | A Multi-Level Attention Model for Evidence-Based Fact Checking. | Canasai Kruengkrai, Junichi Yamagishi, Xin Wang |
| 2021 | CVPR | Fashion-Guided Adversarial Attack on Person Segmentation. | Marc Treu, Trung-Nghia Le, Huy H. Nguyen, Junichi Yamagishi, Isao Echizen |
| 2021 | ICASSP | How Similar or Different is Rakugo Speech Synthesizer to Professional Performers? | Shuhei Kato, Yusuke Yasuda, Xin Wang, Erica Cooper, Junichi Yamagishi |
| 2021 | ICASSP | Learning Disentangled Phone and Speaker Representations in a Semi-Supervised VQ-VAE Paradigm. | Jennifer Williams, Yi Zhao, Erica Cooper, Junichi Yamagishi |
| 2021 | ICASSP | End-to-End Text-to-Speech Using Latent Duration Based on VQ-VAE. | Yusuke Yasuda, Xin Wang, Junichi Yamagishi |
| 2021 | ICCV | OpenForensics: Large-Scale Challenging Dataset For Multi-Face Forgery Detection And Segmentation In-The-Wild. | Trung-Nghia Le, Huy H. Nguyen, Junichi Yamagishi, Isao Echizen |
| 2021 | Interspeech | Visualizing Classifier Adjacency Relations: A Case Study in Speaker Verification and Voice Anti-Spoofing. | Tomi Kinnunen, Andreas Nautsch, Md. Sahidullah, Nicholas W. D. Evans, Xin Wang, Massimiliano Todisco, Hctor Delgado, Junichi Yamagishi, Kong Aik Lee |
| 2021 | Interspeech | A Comparative Study on Recent Neural Spoofing Countermeasures for Synthetic Speech Detection. | Xin Wang, Junichi Yamagishi |
| 2021 | Interspeech | An Initial Investigation for Detecting Partially Spoofed Audio. | Lin Zhang, Xin Wang, Erica Cooper, Junichi Yamagishi, Jose Patino, Nicholas W. D. Evans |
| 2020 | AINA | Generating Sentiment-Preserving Fake Online Reviews Using Neural Language Models and Their Human- and Machine-Based Detection. | David Ifeoluwa Adelani, Haotian Mai, Fuming Fang, Huy H. Nguyen, Junichi Yamagishi, Isao Echizen |
| 2020 | ICASSP | Zero-Shot Multi-Speaker Text-To-Speech with State-Of-The-Art Neural Speaker Embeddings. | Erica Cooper, Cheng-I Lai, Yusuke Yasuda, Fuming Fang, Xin Wang, Nanxin Chen, Junichi Yamagishi |
| 2020 | ICASSP | Effect of Choice of Probability Distribution, Randomness, and Search Methods for Alignment Modeling in Sequence-to-Sequence Text-to-Speech Synthesis Using Hard Alignment. | Yusuke Yasuda, Xin Wang, Junichi Yamagishi |
| 2020 | ICASSP | Transferring Neural Speech Waveform Synthesizers to Musical Instrument Sounds Generation. | Yi Zhao, Xin Wang, Lauri Juvela, Junichi Yamagishi |
| 2020 | ICIP | Security of Facial Forensics Models Against Adversarial Attacks. | Rong Huang, Fuming Fang, Huy H. Nguyen, Junichi Yamagishi, Isao Echizen |
| 2020 | Interspeech | Improved Prosody from Learned F0 Codebook Representations for VQ-VAE Speech Waveform Reconstruction. | Yi Zhao, Haoyu Li, Cheng-I Lai, Jennifer Williams, Erica Cooper, Junichi Yamagishi |
| 2020 | Interspeech | Reverberation Modeling for Source-Filter-Based Neural Vocoder. | Yang Ai, Xin Wang, Junichi Yamagishi, Zhen-Hua Ling |
| 2020 | Interspeech | Can Speaker Augmentation Improve Multi-Speaker End-to-End TTS? | Erica Cooper, Cheng-I Lai, Yusuke Yasuda, Junichi Yamagishi |
| 2020 | Interspeech | iMetricGAN: Intelligibility Enhancement for Speech-in-Noise Using Generative Adversarial Network-Based Metric Learning. | Haoyu Li, Szu-Wei Fu, Yu Tsao, Junichi Yamagishi |
| 2020 | Interspeech | Noise Tokens: Learning Neural Noise Templates for Environment-Aware Speech Enhancement. | Haoyu Li, Junichi Yamagishi |
| 2020 | Interspeech | The Privacy ZEBRA: Zero Evidence Biometric Recognition Assessment. | Andreas Nautsch, Jose Patino, Natalia A. Tomashenko, Junichi Yamagishi, Paul-Gauthier No, Jean-Franois Bonastre, Massimiliano Todisco, Nicholas W. D. Evans |
| 2020 | Interspeech | Design Choices for X-Vector Based Speaker Anonymization. | Brij Mohan Lal Srivastava, Natalia A. Tomashenko, Xin Wang, Emmanuel Vincent, Junichi Yamagishi, Mohamed Maouche, Aurlien Bellet, Marc Tommasi |
| 2020 | Interspeech | Introducing the VoicePrivacy Initiative. | Natalia A. Tomashenko, Brij Mohan Lal Srivastava, Xin Wang, Emmanuel Vincent, Andreas Nautsch, Junichi Yamagishi, Nicholas W. D. Evans, Jose Patino, Jean-Franois Bonastre, Paul-Gauthier No, Massimiliano Todisco |
| 2020 | Interspeech | Using Cyclic Noise as the Source Signal for Neural Source-Filter-Based Speech Waveform Model. | Xin Wang, Junichi Yamagishi |
| 2019 | ASRU | Bootstrapping Non-Parallel Voice Conversion from Speaker-Adaptive Text-to-Speech. | Hieu-Thi Luong, Junichi Yamagishi |
| 2019 | ICASSP | Audiovisual Speaker Conversion: Jointly and Simultaneously Transforming Facial Expression and Acoustic Characteristics. | Fuming Fang, Xin Wang, Junichi Yamagishi, Isao Echizen |
| 2019 | ICASSP | Waveform Generation for Text-to-speech Synthesis Using Pitch-synchronous Multi-scale Generative Adversarial Networks. | Lauri Juvela, Bajibabu Bollepalli, Junichi Yamagishi, Paavo Alku |
| 2019 | ICASSP | Attentive Filtering Networks for Audio Replay Attack Detection. | Cheng-I Lai, Alberto Abad, Korin Richmond, Junichi Yamagishi, Najim Dehak, Simon King |
| 2019 | ICASSP | Capsule-forensics: Using Capsule Networks to Detect Forged Images and Videos. | Huy H. Nguyen, Junichi Yamagishi, Isao Echizen |
| 2019 | ICASSP | Cycle-consistent Adversarial Networks for Non-parallel Vocal Effort Based Speaking Style Conversion. | Shreyas Seshadri, Lauri Juvela, Junichi Yamagishi, Okko Rsnen, Paavo Alku |
| 2019 | ICASSP | STFT Spectral Loss for Training a Neural Speech Waveform Model. | Shinji Takaki, Toru Nakashika, Xin Wang, Junichi Yamagishi |
| 2019 | ICASSP | Neural Source-filter-based Waveform Model for Statistical Parametric Speech Synthesis. | Xin Wang, Shinji Takaki, Junichi Yamagishi |
| 2019 | ICASSP | Investigation of Enhanced Tacotron Text-to-speech Synthesis Systems with Self-attention for Pitch Accent Language. | Yusuke Yasuda, Xin Wang, Shinji Takaki, Junichi Yamagishi |
| 2019 | Interspeech | Joint Training Framework for Text-to-Speech and Voice Conversion Using Multi-Source Tacotron and WaveNet. | Mingyang Zhang, Xin Wang, Fuming Fang, Haizhou Li, Junichi Yamagishi |
| 2019 | Interspeech | Does the Lombard Effect Improve Emotional Communication in Noise? - Analysis of Emotional Speech Acted in Noise. | Yi Zhao, Atsushi Ando, Shinji Takaki, Junichi Yamagishi, Satoshi Kobashikawa |
| 2019 | Interspeech | GELP: GAN-Excited Linear Prediction for Speech Synthesis from Mel-Spectrogram. | Lauri Juvela, Bajibabu Bollepalli, Junichi Yamagishi, Paavo Alku |
| 2019 | Interspeech | MOSNet: Deep Learning-Based Objective Assessment for Voice Conversion. | Chen-Chou Lo, Szu-Wei Fu, Wen-Chin Huang, Xin Wang, Junichi Yamagishi, Yu Tsao, Hsin-Min Wang |
| 2019 | Interspeech | Training Multi-Speaker Neural Text-to-Speech Systems Using Speaker-Imbalanced Speech Corpora. | Hieu-Thi Luong, Xin Wang, Junichi Yamagishi, Nobuyuki Nishizawa |
| 2019 | Interspeech | ASVspoof 2019: Future Horizons in Spoofed and Fake Audio Detection. | Massimiliano Todisco, Xin Wang, Ville Vestman, Md. Sahidullah, Hctor Delgado, Andreas Nautsch, Junichi Yamagishi, Nicholas W. D. Evans, Tomi H. Kinnunen, Kong Aik Lee |
| 2018 | ICASSP | High-Quality Nonparallel Voice Conversion Based on Cycle-Consistent Adversarial Network. | Fuming Fang, Junichi Yamagishi, Isao Echizen, Jaime Lorenzo-Trueba |
| 2018 | ICASSP | Cyborg Speech: Deep Multilingual Speech Synthesis for Generating Segmental Foreign Accent with Natural Prosody. | Gustav Eje Henter, Jaime Lorenzo-Trueba, Xin Wang, Mariko Kondo, Junichi Yamagishi |
| 2018 | ICASSP | Speech Waveform Synthesis from MFCC Sequences with Generative Adversarial Networks. | Lauri Juvela, Bajibabu Bollepalli, Xin Wang, Hirokazu Kameoka, Manu Airaksinen, Junichi Yamagishi, Paavo Alku |
| 2018 | ICASSP | A Comparison of Recent Waveform Generation and Acoustic Modeling Methods for Neural-Network-Based Speech Synthesis. | Xin Wang, Jaime Lorenzo-Trueba, Shinji Takaki, Lauri Juvela, Junichi Yamagishi |
| 2018 | Interspeech | Expressive Speech Synthesis Using Sentiment Embeddings. | Igor Jauk, Jaime Lorenzo-Trueba, Junichi Yamagishi, Antonio Bonafonte |
| 2018 | Interspeech | Speaker-independent Raw Waveform Model for Glottal Excitation. | Lauri Juvela, Vassilis Tsiaras, Bajibabu Bollepalli, Manu Airaksinen, Junichi Yamagishi, Paavo Alku |
| 2018 | Interspeech | Investigating Accuracy of Pitch-accent Annotations in Neural Network-based Speech Synthesis and Denoising Effects. | Hieu-Thi Luong, Xin Wang, Junichi Yamagishi, Nobuyuki Nishizawa |
| 2018 | Interspeech | Multimodal Speech Synthesis Architecture for Unsupervised Speaker Adaptation. | Hieu-Thi Luong, Junichi Yamagishi |
| 2018 | Interspeech | Integrated Presentation Attack Detection and Automatic Speaker Verification: Common Features and Gaussian Back-end Fusion. | Massimiliano Todisco, Hctor Delgado, Kong-Aik Lee, Md. Sahidullah, Nicholas W. D. Evans, Tomi Kinnunen, Junichi Yamagishi |
| 2018 | PACLIC | Identifying Computer-Translated Paragraphs using Coherence Features. | Hoang-Quoc Nguyen-Son, Huy H. Nguyen, Ngoc-Dung T. Tieu, Junichi Yamagishi, Isao Echizen |
| 2017 | ICASSP | Non-parallel voice conversion using i-vector PLDA: towards unifying speaker verification and transformation. | Tomi Kinnunen, Lauri Juvela, Paavo Alku, Junichi Yamagishi |
| 2017 | ICASSP | Adapting and controlling DNN-based speech synthesis using input codes. | Hieu-Thi Luong, Shinji Takaki, Gustav Eje Henter, Junichi Yamagishi |
| 2017 | ICASSP | An autoregressive recurrent mixture density network for parametric speech synthesis. | Xin Wang, Shinji Takaki, Junichi Yamagishi |
| 2017 | Interspeech | Principles for Learning Controllable TTS from Annotated and Latent Variation. | Gustav Eje Henter, Jaime Lorenzo-Trueba, Xin Wang, Junichi Yamagishi |
| 2017 | Interspeech | Reducing Mismatch in Training of DNN-Based Glottal Excitation Models in a Statistical Parametric Text-to-Speech System. | Lauri Juvela, Bajibabu Bollepalli, Junichi Yamagishi, Paavo Alku |
| 2017 | Interspeech | Generative Adversarial Network-Based Postfilter for STFT Spectrograms. | Takuhiro Kaneko, Shinji Takaki, Hirokazu Kameoka, Junichi Yamagishi |
| 2017 | Interspeech | The ASVspoof 2017 Challenge: Assessing the Limits of Replay Spoofing Attack Detection. | Tomi Kinnunen, Md. Sahidullah, Hctor Delgado, Massimiliano Todisco, Nicholas W. D. Evans, Junichi Yamagishi, Kong-Aik Lee |
| 2017 | Interspeech | Misperceptions of the Emotional Content of Natural and Vocoded Speech in a Car. | Jaime Lorenzo-Trueba, Cassia Valentini-Botinhao, Gustav Eje Henter, Junichi Yamagishi |
| 2017 | Interspeech | Complex-Valued Restricted Boltzmann Machine for Direct Learning of Frequency Spectra. | Toru Nakashika, Shinji Takaki, Junichi Yamagishi |
| 2017 | Interspeech | Learning Word Vector Representations Based on Acoustic Counts. | Manuel Sam Ribeiro, Oliver Watts, Junichi Yamagishi |
| 2017 | Interspeech | Direct Modeling of Frequency Spectra and Waveform Generation Based on Phase Recovery for DNN-Based Speech Synthesis. | Shinji Takaki, Hirokazu Kameoka, Junichi Yamagishi |
| 2017 | Interspeech | Speech Intelligibility in Cars: The Effect of Speaking Style, Noise and Listener Age. | Cassia Valentini-Botinhao, Junichi Yamagishi |
| 2017 | Interspeech | An RNN-Based Quantized F0 Model with Multi-Tier Feedback Links for Text-to-Speech Synthesis. | Xin Wang, Shinji Takaki, Junichi Yamagishi |
| 2016 | COLING | Continuous Expressive Speaking Styles Synthesis based on CVSM and MR-HMM. | Jaime Lorenzo-Trueba, Roberto Barra-Chicote, Ascensin Gallardo-Antoln, Junichi Yamagishi, Juan Manuel Montero |
| 2016 | ICASSP | Testing the consistency assumption: Pronunciation variant forced alignment in read and spontaneous speech synthesis. | Rasmus Dall, Sandrine Brognaux, Korin Richmond, Cassia Valentini-Botinhao, Gustav Eje Henter, Julia Hirschberg, Junichi Yamagishi, Simon King |
| 2016 | ICASSP | Privacy-preserving sound to degrade automatic speaker verification performance. | Kei Hashimoto, Junichi Yamagishi, Isao Echizen |
| 2016 | ICASSP | Initial investigation of speech synthesis based on complex-valued neural networks. | Qiong Hu, Junichi Yamagishi, Korin Richmond, Kartick Subramanian, Yannis Stylianou |
| 2016 | ICASSP | Deep neural network-guided unit selection synthesis. | Thomas Merritt, Robert A. J. Clark, Zhizheng Wu, Junichi Yamagishi, Simon King |
| 2016 | ICASSP | Wavelet-based decomposition of F0 as a secondary task for DNN-based speech synthesis with multi-task learning. | Manuel Sam Ribeiro, Oliver Watts, Junichi Yamagishi, Robert A. J. Clark |
| 2016 | ICASSP | A deep auto-encoder based low-dimensional feature extraction from FFT spectral envelopes for statistical parametric speech synthesis. | Shinji Takaki, Junichi Yamagishi |
| 2016 | Interspeech | The SIWIS Database: A Multilingual Speech Database with Acted Emphasis. | Jean-Philippe Goldman, Pierre-Edouard Honnet, Robert A. J. Clark, Philip N. Garner, Maria Ivanova, Alexandros Lazaridis, Hui Liang, Tiago Macedo, Beat Pfister, Manuel Sam Ribeiro, Eric Wehrli, Junichi Yamagishi |
| 2016 | Interspeech | Majorisation-Minimisation Based Optimisation of the Composite Autoregressive System with Application to Glottal Inverse Filtering. | Lauri Juvela, Hirokazu Kameoka, Manu Airaksinen, Junichi Yamagishi, Paavo Alku |
| 2016 | Interspeech | Using Text and Acoustic Features in Predicting Glottal Excitation Waveforms for Parametric Speech Synthesis with Recurrent Neural Networks. | Lauri Juvela, Xin Wang, Shinji Takaki, Manu Airaksinen, Junichi Yamagishi, Paavo Alku |
| 2016 | Interspeech | Syllable-Level Representations of Suprasegmental Features for DNN-Based Text-to-Speech Synthesis. | Manuel Sam Ribeiro, Oliver Watts, Junichi Yamagishi |
| 2016 | Interspeech | The Voice Conversion Challenge 2016. | Tomoki Toda, Ling-Hui Chen, Daisuke Saito, Fernando Villavicencio, Mirjam Wester, Zhizheng Wu, Junichi Yamagishi |
| 2016 | Interspeech | Speech Enhancement for a Noise-Robust Text-to-Speech Synthesis System Using Deep Recurrent Neural Networks. | Cassia Valentini-Botinhao, Xin Wang, Shinji Takaki, Junichi Yamagishi |
| 2016 | Interspeech | Applying Spectral Normalisation and Efficient Envelope Estimation and Statistical Transformation for the Voice Conversion Challenge 2016. | Fernando Villavicencio, Junichi Yamagishi, Jordi Bonada, Felipe Espic |
| 2016 | Interspeech | Enhance the Word Vector with Prosodic Information for the Recurrent Neural Network Based TTS System. | Xin Wang, Shinji Takaki, Junichi Yamagishi |
| 2016 | Interspeech | Analysis of the Voice Conversion Challenge 2016 Evaluation Results. | Mirjam Wester, Zhizheng Wu, Junichi Yamagishi |
| 2016 | Interspeech | A Hierarchical Predictor of Synthetic Speech Naturalness Using Neural Networks. | Takenori Yoshimura, Gustav Eje Henter, Oliver Watts, Mirjam Wester, Junichi Yamagishi, Keiichi Tokuda |
| 2015 | ICASSP | Methods for applying dynamic sinusoidal models to statistical parametric speech synthesis. | Qiong Hu, Yannis Stylianou, Ranniery Maia, Korin Richmond, Junichi Yamagishi |
| 2015 | ICASSP | SAS: A speaker verification spoofing database containing diverse attacks. | Zhizheng Wu, Ali Khodabakhsh, Cenk Demiroglu, Junichi Yamagishi, Daisuke Saito, Tomoki Toda, Simon King |
| 2015 | Interspeech | Fusion of multiple parameterisations for DNN-based sinusoidal speech synthesis with multi-task learning. | Qiong Hu, Zhizheng Wu, Korin Richmond, Junichi Yamagishi, Yannis Stylianou, Ranniery Maia |
| 2015 | Interspeech | Reconstructing voices within the multiple-average-voice-model framework. | Pierre Lanchantin, Christophe Veaux, Mark J. F. Gales, Simon King, Junichi Yamagishi |
| 2015 | Interspeech | Deep neural network context embeddings for model selection in rich-context HMM synthesis. | Thomas Merritt, Junichi Yamagishi, Zhizheng Wu, Oliver Watts, Simon King |
| 2015 | Interspeech | Influence of speaker familiarity on blind and visually impaired children's perception of synthetic voices in audio games. | Michael Pucher, Markus Toman, Dietmar Schabus, Cassia Valentini-Botinhao, Junichi Yamagishi, Bettina Zillinger, Erich Schmid |
| 2015 | Interspeech | A perceptual investigation of wavelet-based decomposition of f0 for text-to-speech synthesis. | Manuel Sam Ribeiro, Junichi Yamagishi, Robert A. J. Clark |
| 2015 | Interspeech | Voice liveness detection algorithms based on pop noise caused by human breath for automatic speaker verification. | Sayaka Shiota, Fernando Villavicencio, Junichi Yamagishi, Nobutaka Ono, Isao Echizen, Tomoko Matsui |
| 2015 | Interspeech | Multiple feed-forward deep neural networks for statistical parametric speech synthesis. | Shinji Takaki, Sangjin Kim, Junichi Yamagishi, JongJin Kim |
| 2015 | Interspeech | Human vs machine spoofing detection on wideband and narrowband data. | Mirjam Wester, Zhizheng Wu, Junichi Yamagishi |
| 2015 | Interspeech | ASVspoof 2015: the first automatic speaker verification spoofing and countermeasures challenge. | Zhizheng Wu, Tomi Kinnunen, Nicholas W. D. Evans, Junichi Yamagishi, Cemal Hanili, Md. Sahidullah, Aleksandr Sizov |
| 2015 | Interspeech | Automatic speaker verification spoofing and countermeasures (ASVspoof 2015): open discussion and future plans. | Junichi Yamagishi, Nicholas W. D. Evans |
| 2014 | ICASSP | A fixed dimension and perceptually based dynamic sinusoidal model of speech. | Qiong Hu, Yannis Stylianou, Korin Richmond, Ranniery Maia, Junichi Yamagishi, Javier Latorre |
| 2014 | ICASSP | Multiple-average-voice-based speech synthesis. | Pierre Lanchantin, Mark J. F. Gales, Simon King, Junichi Yamagishi |
| 2014 | ICASSP | Neural net word representations for phrase-break prediction without a part of speech tagger. | Oliver Watts, Siva Reddy Gangireddy, Junichi Yamagishi, Simon King, Steve Renals, Adriana Stan, Mircea Giurgiu |
| 2014 | Interspeech | DNN-based stochastic postfilter for HMM-based speech synthesis. | Ling-Hui Chen, Tuomo Raitio, Cassia Valentini-Botinhao, Junichi Yamagishi, Zhen-Hua Ling |
| 2014 | Interspeech | An investigation of the application of dynamic sinusoidal models to statistical parametric speech synthesis. | Qiong Hu, Yannis Stylianou, Ranniery Maia, Korin Richmond, Junichi Yamagishi, Javier Latorre |
| 2014 | Interspeech | Generating segmental foreign accent. | Mara Luisa Garca Lecumberri, Roberto Barra-Chicote, Rubn Prez Ramn, Junichi Yamagishi, Martin Cooke |
| 2014 | Interspeech | Development of a genre-dependent TTS system with cross-speaker speaking-style transplantation. | Jaime Lorenzo-Trueba, Julin D. Echeverry-Correa, Roberto Barra-Chicote, Rubn San-Segundo-Hernndez, Javier Ferreiros, Ascensin Gallardo-Antoln, Junichi Yamagishi, Simon King, Juan Manuel Montero-Martnez |
| 2014 | Interspeech | Intelligibility analysis of fast synthesized speech. | Cassia Valentini-Botinhao, Markus Toman, Michael Pucher, Dietmar Schabus, Junichi Yamagishi |
| 2013 | ICASSP | Lightly supervised GMM VAD to use audiobook for speech synthesiser. | Yoshitaka Mamiya, Junichi Yamagishi, Oliver Watts, Robert A. J. Clark, Simon King, Adriana Stan |
| 2013 | ICASSP | Improving intelligibility in noise of HMM-generated speech via noise-dependent and -independent methods. | Cassia Valentini-Botinhao, Elizabeth Godoy, Yannis Stylianou, Bastian Sauert, Simon King, Junichi Yamagishi |
| 2013 | Interspeech | Reactive accent interpolation through an interactive map application. | Maria Astrinaki, Junichi Yamagishi, Simon King, Nicolas D'Alessandro, Thierry Dutoit |
| 2013 | Interspeech | Spoofing and countermeasures for automatic speaker verification. | Nicholas W. D. Evans, Tomi Kinnunen, Junichi Yamagishi |
| 2013 | Interspeech | On the evaluation of inversion mapping performance in the acoustic domain. | Korin Richmond, Zhen-Hua Ling, Junichi Yamagishi, Benigno Uria |
| 2013 | Interspeech | Lightly supervised discriminative training of grapheme models for improved sentence-level alignment of speech and text data. | Adriana Stan, Peter Bell, Junichi Yamagishi, Simon King |
| 2013 | Interspeech | TUNDRA: a multilingual corpus of found data for TTS research created with light supervision. | Adriana Stan, Oliver Watts, Yoshitaka Mamiya, Mircea Giurgiu, Robert A. J. Clark, Junichi Yamagishi, Simon King |
| 2013 | Interspeech | Combining perceptually-motivated spectral shaping with loudness and duration modification for intelligibility enhancement of HMM-based synthetic speech in noise. | Cassia Valentini-Botinhao, Junichi Yamagishi, Simon King, Yannis Stylianou |
| 2012 | ICASSP | Combining vocal tract length normalization with hierarchial linear transformations. | Lakshmi Babu Saheer, Junichi Yamagishi, Philip N. Garner, John Dines |
| 2012 | ICASSP | Cepstral analysis based on the glimpse proportion measure for improving the intelligibility of HMM-based synthetic speech in noise. | Cassia Valentini-Botinhao, Ranniery Maia, Junichi Yamagishi, Simon King, Heiga Zen |
| 2012 | Interspeech | Analysis of speaker clustering strategies for HMM-based speech synthesis. | Rasmus Dall, Christophe Veaux, Junichi Yamagishi, Simon King |
| 2012 | Interspeech | Synthetic Speech Discrimination using Pitch Pattern Statistics Derived from Image Analysis. | Phillip L. De Leon, Bryan Stewart, Junichi Yamagishi |
| 2012 | Interspeech | Vowel Creation by Articulatory Control in HMM-based Parametric Speech Synthesis. | Zhen-Hua Ling, Korin Richmond, Junichi Yamagishi |
| 2012 | Interspeech | Towards Glottal Source Controllability in Expressive Speech Synthesis. | Jaime Lorenzo-Trueba, Roberto Barra-Chicote, Tuomo Raitio, Nicolas Obin, Paavo Alku, Junichi Yamagishi, Juan Manuel Montero |
| 2012 | Interspeech | Towards an Unsupervised Speaking Style Voice Building Framework: Multi-Style Speaker Diarization. | Jaime Lorenzo-Trueba, Beatriz Martnez-Gonzlez, Roberto Barra-Chicote, Vernica Lpez-Ludea, Javier Ferreiros, Junichi Yamagishi, Juan Manuel Montero |
| 2012 | Interspeech | Evaluating speech intelligibility enhancement for HMM-based synthetic speech in noise. | Cassia Valentini-Botinhao, Junichi Yamagishi, Simon King |
| 2012 | Interspeech | Mel cepstral coefficient modification based on the Glimpse Proportion measure for improving the intelligibility of HMM-generated synthetic speech in noise. | Cassia Valentini-Botinhao, Junichi Yamagishi, Simon King |
| 2012 | Interspeech | Using HMM-based Speech Synthesis to Reconstruct the Voice of Individuals with Degenerative Speech Disorders. | Christophe Veaux, Junichi Yamagishi, Simon King |
| 2011 | ASSETS | Voice banking and voice reconstruction for MND patients. | Christophe Veaux, Junichi Yamagishi, Simon King |
| 2011 | ICASSP | Vocal attractiveness of statistical speech synthesisers. | Sandra Andraszewicz, Junichi Yamagishi, Simon King |
| 2011 | ICASSP | HMM-based speech synthesiser using the LF-model of the glottal source. | Joo P. Cabral, Steve Renals, Junichi Yamagishi, Korin Richmond |
| 2011 | ICASSP | An analysis of machine translation and speech synthesis in speech-to-speech translation system. | Kei Hashimoto, Junichi Yamagishi, William J. Byrne, Simon King, Keiichi Tokuda |
| 2011 | ICASSP | Detection of synthetic speech for the problem of imposture. | Phillip L. De Leon, Inma Hernez, Ibon Saratxaga, Michael Pucher, Junichi Yamagishi |
| 2011 | ICASSP | Evaluation of objective measures for intelligibility prediction of HMM-based synthetic speech in noise. | Cassia Valentini-Botinhao, Junichi Yamagishi, Simon King |
| 2011 | Interspeech | Formant-Controlled HMM-Based Speech Synthesis. | Ming Lei, Junichi Yamagishi, Korin Richmond, Zhen-Hua Ling, Simon King, Li-Rong Dai |
| 2011 | Interspeech | Feature-Space Transform Tying in Unified Acoustic-Articulatory Modelling for Articulatory Control of HMM-Based Speech Synthesis. | Zhen-Hua Ling, Korin Richmond, Junichi Yamagishi |
| 2011 | Interspeech | Can Objective Measures Predict the Intelligibility of Modified HMM-Based Synthetic Speech in Noise? | Cassia Valentini-Botinhao, Junichi Yamagishi, Simon King |
| 2011 | Interspeech | Unsupervised Continuous-Valued Word Features for Phrase-Break Prediction without a Part-of-Speech Tagger. | Oliver Watts, Junichi Yamagishi, Simon King |
| 2010 | ICASSP | Revisiting the security of speaker verification systems against imposture using synthetic speech. | Phillip L. De Leon, Vijendra Raj Apsingekar, Michael Pucher, Junichi Yamagishi |
| 2010 | ICASSP | Unsupervised cross-lingual speaker adaptation for HMM-based speech synthesis. | Keiichiro Oura, Keiichi Tokuda, Junichi Yamagishi, Simon King, Mirjam Wester |
| 2010 | ICASSP | Simple methods for improving speaker-similarity of HMM-based speech synthesis. | Junichi Yamagishi, Simon King |
| 2010 | Interspeech | HMM-based text-to-articulatory-movement prediction and analysis of critical articulators. | Zhen-Hua Ling, Korin Richmond, Junichi Yamagishi |
| 2010 | Interspeech | Synthesis of fast speech with interpolation of adapted HSMMs and its evaluation by blind and sighted listeners. | Michael Pucher, Dietmar Schabus, Junichi Yamagishi |
| 2010 | Interspeech | The role of higher-level linguistic features in HMM-based speech synthesis. | Oliver Watts, Junichi Yamagishi, Simon King |
| 2010 | Interspeech | Roles of the average voice in speaker-adaptive HMM-based speech synthesis. | Junichi Yamagishi, Oliver Watts, Simon King, Bela Usabaev |
| 2009 | Interspeech | Speech synthesis without a phone inventory. | Matthew P. Aylett, Simon King, Junichi Yamagishi |
| 2009 | Interspeech | Identification of contrast and its emphatic realization in HMM based speech synthesis. | Leonardo Badino, J. Sebastian Andersson, Junichi Yamagishi, Robert A. J. Clark |
| 2009 | Interspeech | Measuring the gap between HMM-based ASR and TTS. | John Dines, Junichi Yamagishi, Simon King |
| 2009 | Interspeech | HMM adaptation and voice conversion for the synthesis of child speech: a comparison. | Oliver Watts, Junichi Yamagishi, Simon King, Kay Berkling |
| 2009 | Interspeech | Thousands of voices for HMM-based speech synthesis. | Junichi Yamagishi, Bela Usabaev, Simon King, Oliver Watts, John Dines, Jilei Tian, Rile Hu, Yong Guan, Keiichiro Oura, Keiichi Tokuda, Reima Karhila, Mikko Kurimo |
| 2008 | ICASSP | Performance evaluation of the speaker-independent HMM-based speech synthesis system "HTS 2007" for the Blizzard Challenge 2007. | Junichi Yamagishi, Takashi Nose, Heiga Zen, Tomoki Toda, Keiichi Tokuda |
| 2008 | Interspeech | Glottal spectral separation for parametric speech synthesis. | Joo P. Cabral, Steve Renals, Korin Richmond, Junichi Yamagishi |
| 2008 | Interspeech | Speech-driven lip motion generation with a trajectory HMM. | Gregor Hofer, Junichi Yamagishi, Hiroshi Shimodaira |
| 2008 | Interspeech | Unsupervised adaptation for HMM-based speech synthesis. | Simon King, Keiichi Tokuda, Heiga Zen, Junichi Yamagishi |
| 2008 | Interspeech | Articulatory control of HMM-based parametric speech synthesis driven by phonetic knowledge. | Zhen-Hua Ling, Korin Richmond, Junichi Yamagishi, Ren-Hua Wang |
| 2008 | Interspeech | Robustness of HMM-based speech synthesis. | Junichi Yamagishi, Zhen-Hua Ling, Simon King |
| 2007 | ICASSP | Model Adaptation Approach to Speech Synthesis with Diverse Voices and Styles. | Junichi Yamagishi, Takao Kobayashi, Makoto Tachibana, Katsumi Ogata, Yuji Nakano |
| 2007 | Interspeech | Performance evaluation of HMM-based style classification with a small amount of training data. | Makoto Tachibana, Keigo Kawashima, Junichi Yamagishi, Takao Kobayashi |
| 2007 | SIGGRAPH | Speech driven head motion synthesis based on a trajectory model. | Gregor Hofer, Hiroshi Shimodaira, Junichi Yamagishi |
| 2006 | ICASSP | HSMM-Based Model Adaptation Algorithms for Average-Voice-Based Speech Synthesis. | Junichi Yamagishi, Katsumi Ogata, Yuji Nakano, Juri Isogai, Takao Kobayashi |
| 2006 | Interspeech | Constrained structural maximum a posteriori linear regression for average-voice-based speech synthesis. | Yuji Nakano, Makoto Tachibana, Junichi Yamagishi, Takao Kobayashi |
| 2006 | Interspeech | A style control technique for speech synthesis using multiple regression HSMM. | Takashi Nose, Junichi Yamagishi, Takao Kobayashi |
| 2006 | Interspeech | Acoustic model training based on linear transformation and MAP modification for HSMM-based speech synthesis. | Katsumi Ogata, Makoto Tachibana, Junichi Yamagishi, Takao Kobayashi |
| 2006 | Interspeech | A technique for controlling voice quality of synthetic speech using multiple regression HSMM. | Makoto Tachibana, Takashi Nose, Junichi Yamagishi, Takao Kobayashi |
| 2005 | CW | HumanWalking Motion Synthesis Based on Multiple Regression Hidden Semi-Markov Model. | Takashi Yamazaki, Naotake Niwase, Junichi Yamagishi, Takao Kobayashi |
| 2005 | ICASSP | Adaptive Training for Hidden Semi-Markov Model. | Junichi Yamagishi, Takao Kobayashi |
| 2005 | Interspeech | Model adaptation and adaptive training using ESAT algorithm for HMM-based speech synthesis. | Juri Isogai, Junichi Yamagishi, Takao Kobayashi |
| 2005 | Interspeech | Performance evaluation of style adaptation for hidden semi-Markov model based speech synthesis. | Makoto Tachibana, Junichi Yamagishi, Takashi Masuko, Takao Kobayashi |
| 2004 | ICASSP | Speaking style adaptation using context clustering decision tree for HMM-based speech synthesis. | Junichi Yamagishi, Makoto Tachibana, Takashi Masuko, Takao Kobayashi |
| 2004 | Interspeech | MLLR adaptation for hidden semi-Markov model based speech synthesis. | Junichi Yamagishi, Takashi Masuko, Takao Kobayashi |
| 2003 | ICASSP | A training method for average voice model based on shared decision tree context clustering and speaker adaptive training. | Junichi Yamagishi, Takashi Masuko, Keiichi Tokuda, Takao Kobayashi |
| 2003 | Interspeech | Modeling of various speaking styles and emotions for HMM-based speech synthesis. | Junichi Yamagishi, Koji Onishi, Takashi Masuko, Takao Kobayashi |
| 2002 | Interspeech | A context clustering technique for average voice model in HMM-based speech synthesis. | Junichi Yamagishi, Masatsune Tamura, Takashi Masuko, Keiichi Tokuda, Takao Kobayashi |