Skip to content

Takafumi Moriya

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

53

Venues

3

Active years

2015–2025

Best venue rank

A

Where they publish

Papers

53 indexed papers, newest first.

YearVenueTitleAuthors
2025ASRUPhoneme Overlapping-Aware Pre-Training with External Text Resources for Multi-Talker ASR.Ryo Masumura, Tomohiro Tanaka, Naoki Makishima, Mana Ihori, Shota Orihashi, Naotaka Kawata, Taiga Yamane, Satoshi Suzuki, Takafumi Moriya
2025ASRUAll-in-One ASR: Unifying Encoder-Decoder Models of CTC, Attention, and Transducer in Dual-Mode ASR.Takafumi Moriya, Masato Mimura, Tomohiro Tanaka, Hiroshi Sato, Ryo Masumura, Atsunori Ogawa
2025ICASSPGuided Speaker Embedding.Shota Horiguchi, Takafumi Moriya, Atsushi Ando, Takanori Ashihara, Hiroshi Sato, Naohiro Tawara, Marc Delcroix
2025ICASSPAdvancing Streaming ASR with Chunk-wise Attention and Trans-chunk Selective State Spaces.Masato Mimura, Takafumi Moriya, Kohei Matsuura
2025ICASSPAlignment-Free Training for Transducer-based Multi-Talker ASR.Takafumi Moriya, Shota Horiguchi, Marc Delcroix, Ryo Masumura, Takanori Ashihara, Hiroshi Sato, Kohei Matsuura, Masato Mimura
2025InterspeechAttention-Free Dual-Mode ASR with Latency-Controlled Selective State Spaces.Takafumi Moriya, Masato Mimura, Kiyoaki Matsui, Hiroshi Sato, Kohei Matsuura
2025InterspeechReal-time TSE demonstration via SoundBeam with KD.Keigo Wakayama, Tomoko Kawase, Takafumi Moriya, Marc Delcroix, Hiroshi Sato, Tsubasa Ochiai, Masahiro Yasuda, Shoko Araki
2024ICASSPWhat Do Self-Supervised Speech and Speaker Models Learn? New Findings from a Cross Model Layer-Wise Analysis.Takanori Ashihara, Marc Delcroix, Takafumi Moriya, Kohei Matsuura, Taichi Asami, Yusuke Ijima
2024ICASSPNoise-Robust Zero-Shot Text-to-Speech Synthesis Conditioned on Self-Supervised Speech-Representation Model with Adapters.Kenichi Fujita, Hiroshi Sato, Takanori Ashihara, Hiroki Kanagawa, Marc Delcroix, Takafumi Moriya, Yusuke Ijima
2024InterspeechFactor-Conditioned Speaking-Style Captioning.Atsushi Ando, Takafumi Moriya, Shota Horiguchi, Ryo Masumura
2024InterspeechPre-training Neural Transducer-based Streaming Voice Conversion for Faster Convergence and Alignment-free Training.Hiroki Kanagawa, Takafumi Moriya, Yusuke Ijima
2024InterspeechUnified Multi-Talker ASR with and without Target-speaker Enrollment.Ryo Masumura, Naoki Makishima, Tomohiro Tanaka, Mana Ihori, Naotaka Kawata, Shota Orihashi, Kazutoshi Shinoda, Taiga Yamane, Saki Mizuno, Keita Suzuki, Satoshi Suzuki, Nobukatsu Hojo, Takafumi Moriya, Atsushi Ando
2024InterspeechSentence-wise Speech Summarization: Task, Datasets, and End-to-End Modeling with LM Knowledge Distillation.Kohei Matsuura, Takanori Ashihara, Takafumi Moriya, Masato Mimura, Takatomo Kano, Atsunori Ogawa, Marc Delcroix
2024InterspeechBoosting Hybrid Autoregressive Transducer-based ASR with Internal Acoustic Model Training and Dual Blank Thresholding.Takafumi Moriya, Takanori Ashihara, Masato Mimura, Hiroshi Sato, Kohei Matsuura, Ryo Masumura, Taichi Asami
2024InterspeechSpeakerBeam-SS: Real-time Target Speaker Extraction with Lightweight Conv-TasNet and State Space Modeling.Hiroshi Sato, Takafumi Moriya, Masato Mimura, Shota Horiguchi, Tsubasa Ochiai, Takanori Ashihara, Atsushi Ando, Kentaro Shinayama, Marc Delcroix
2023ICASSPExploration of Language Dependency for Japanese Self-Supervised Speech Representation Models.Takanori Ashihara, Takafumi Moriya, Kohei Matsuura, Tomohiro Tanaka
2023ICASSPZero-Shot Text-to-Speech Synthesis Conditioned Using Self-Supervised Speech Representation Model.Kenichi Fujita, Takanori Ashihara, Hiroki Kanagawa, Takafumi Moriya, Yusuke Ijima
2023ICASSPLeveraging Large Text Corpora For End-To-End Speech Summarization.Kohei Matsuura, Takanori Ashihara, Takafumi Moriya, Tomohiro Tanaka, Atsunori Ogawa, Marc Delcroix, Ryo Masumura
2023ICASSPImproving Scheduled Sampling for Neural Transducer-Based ASR.Takafumi Moriya, Takanori Ashihara, Hiroshi Sato, Kohei Matsuura, Tomohiro Tanaka, Ryo Masumura
2023ICASSPIterative Shallow Fusion of Backward Language Model for End-To-End Speech Recognition.Atsunori Ogawa, Takafumi Moriya, Naoyuki Kamo, Naohiro Tawara, Marc Delcroix
2023ICASSPLeveraging Language Embeddings for Cross-Lingual Self-Supervised Speech Representation Learning.Tomohiro Tanaka, Ryo Masumura, Mana Ihori, Hiroshi Sato, Taiga Yamane, Takanori Ashihara, Kohei Matsuura, Takafumi Moriya
2023InterspeechSpeechGLUE: How Well Can Self-Supervised Speech Models Capture Linguistic Knowledge?Takanori Ashihara, Takafumi Moriya, Kohei Matsuura, Tomohiro Tanaka, Yusuke Ijima, Taichi Asami, Marc Delcroix, Yukinori Honma
2023InterspeechVC-T: Streaming Voice Conversion Based on Neural Transducer.Hiroki Kanagawa, Takafumi Moriya, Yusuke Ijima
2023InterspeechEnd-to-End Joint Target and Non-Target Speakers ASR.Ryo Masumura, Naoki Makishima, Taiga Yamane, Yoshihiko Yamazaki, Saki Mizuno, Mana Ihori, Mihiro Uchida, Keita Suzuki, Hiroshi Sato, Tomohiro Tanaka, Akihiko Takashima, Satoshi Suzuki, Takafumi Moriya, Nobukatsu Hojo, Atsushi Ando
2023InterspeechTransfer Learning from Pre-trained Language Models Improves End-to-End Speech Summarization.Kohei Matsuura, Takanori Ashihara, Takafumi Moriya, Tomohiro Tanaka, Takatomo Kano, Atsunori Ogawa, Marc Delcroix
2023InterspeechKnowledge Distillation for Neural Transducer-based Target-Speaker ASR: Exploiting Parallel Mixture/Single-Talker Speech Data.Takafumi Moriya, Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Takanori Ashihara, Kohei Matsuura, Tomohiro Tanaka, Ryo Masumura, Atsunori Ogawa, Taichi Asami
2023InterspeechDownstream Task Agnostic Speech Enhancement with Self-Supervised Representation Loss.Hiroshi Sato, Ryo Masumura, Tsubasa Ochiai, Marc Delcroix, Takafumi Moriya, Takanori Ashihara, Kentaro Shinayama, Saki Mizuno, Mana Ihori, Tomohiro Tanaka, Nobukatsu Hojo
2022ICASSPCustomer Satisfaction Estimation Using Unsupervised Representation Learning with Multi-Format Prediction Loss.Atsushi Ando, Yumiko Murata, Ryo Masumura, Satoshi Suzuki, Naoki Makishima, Takafumi Moriya, Takanori Ashihara, Hiroshi Sato
2022ICASSPHybrid RNN-T/Attention-Based Streaming ASR with Triggered Chunkwise Attention and Dual Internal Language Model Integration.Takafumi Moriya, Takanori Ashihara, Atsushi Ando, Hiroshi Sato, Tomohiro Tanaka, Kohei Matsuura, Ryo Masumura, Marc Delcroix, Takahiro Shinozaki
2022ICASSPLearning to Enhance or Not: Neural Network-Based Switching of Enhanced and Observed Signals for Overlapping Speech Recognition.Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Naoyuki Kamo, Takafumi Moriya
2022InterspeechDeep versus Wide: An Analysis of Student Architectures for Task-Agnostic Knowledge Distillation of Self-Supervised Speech Models.Takanori Ashihara, Takafumi Moriya, Kohei Matsuura, Tomohiro Tanaka
2022InterspeechEnd-to-End Joint Modeling of Conversation History-Dependent and Independent ASR Systems with Multi-History Training.Ryo Masumura, Yoshihiro Yamazaki, Saki Mizuno, Naoki Makishima, Mana Ihori, Mihiro Uchida, Hiroshi Sato, Tomohiro Tanaka, Akihiko Takashima, Satoshi Suzuki, Shota Orihashi, Takafumi Moriya, Nobukatsu Hojo, Atsushi Ando
2022InterspeechStreaming Target-Speaker ASR with Neural Transducer.Takafumi Moriya, Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Takahiro Shinozaki
2022InterspeechStrategies to Improve Robustness of Target Speech Extraction to Enrollment Variations.Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Takafumi Moriya, Naoki Makishima, Mana Ihori, Tomohiro Tanaka, Ryo Masumura
2022InterspeechDomain Adversarial Self-Supervised Speech Representation Learning for Improving Unknown Domain Downstream Tasks.Tomohiro Tanaka, Ryo Masumura, Hiroshi Sato, Mana Ihori, Kohei Matsuura, Takanori Ashihara, Takafumi Moriya
2021ICASSPSpeech Emotion Recognition Based on Listener Adaptive Models.Atsushi Ando, Ryo Masumura, Hiroshi Sato, Takafumi Moriya, Takanori Ashihara, Yusuke Ijima, Tomoki Toda
2021ICASSPSimpleflat: A Simple Whole-Network Pre-Training Approach for RNN Transducer-Based End-to-End Speech Recognition.Takafumi Moriya, Takanori Ashihara, Tomohiro Tanaka, Tsubasa Ochiai, Hiroshi Sato, Atsushi Ando, Yusuke Ijima, Ryo Masumura, Yusuke Shinohara
2021InterspeechInvestigating the Impact of Spectral and Temporal Degradation on End-to-End Automatic Speech Recognition Performance.Takanori Ashihara, Takafumi Moriya, Makio Kashino
2021InterspeechStreaming End-to-End Speech Recognition for Hybrid RNN-T/Attention Architecture.Takafumi Moriya, Tomohiro Tanaka, Takanori Ashihara, Tsubasa Ochiai, Hiroshi Sato, Atsushi Ando, Ryo Masumura, Marc Delcroix, Taichi Asami
2021InterspeechShould We Always Separate?: Switching Between Enhanced and Observed Signals for Overlapping Speech Recognition.Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Takafumi Moriya, Naoyuki Kamo
2021InterspeechCross-Modal Transformer-Based Neural Correction Models for Automatic Speech Recognition.Tomohiro Tanaka, Ryo Masumura, Mana Ihori, Akihiko Takashima, Takafumi Moriya, Takanori Ashihara, Shota Orihashi, Naoki Makishima
2020ICASSPSequence-Level Consistency Training for Semi-Supervised End-to-End Automatic Speech Recognition.Ryo Masumura, Mana Ihori, Akihiko Takashima, Takafumi Moriya, Atsushi Ando, Yusuke Shinohara
2020ICASSPDistilling Attention Weights for CTC-Based ASR Systems.Takafumi Moriya, Hiroshi Sato, Tomohiro Tanaka, Takanori Ashihara, Ryo Masumura, Yusuke Shinohara
2020InterspeechSelf-Distillation for Improving CTC-Transformer-Based ASR Systems.Takafumi Moriya, Tsubasa Ochiai, Shigeki Karita, Hiroshi Sato, Tomohiro Tanaka, Takanori Ashihara, Ryo Masumura, Yusuke Shinohara, Marc Delcroix
2019ICASSPLarge Context End-to-end Automatic Speech Recognition via Extension of Hierarchical Recurrent Encoder-decoder Models.Ryo Masumura, Tomohiro Tanaka, Takafumi Moriya, Yusuke Shinohara, Takanobu Oba, Yushi Aono
2019InterspeechNeural Whispered Speech Detection with Imbalanced Learning.Takanori Ashihara, Yusuke Shinohara, Hiroshi Sato, Takafumi Moriya, Kiyoaki Matsui, Takaaki Fukutomi, Yoshikazu Yamaguchi, Yushi Aono
2019InterspeechEnd-to-End Automatic Speech Recognition with a Reconstruction Criterion Using Speech-to-Text and Text-to-Speech Encoder-Decoders.Ryo Masumura, Hiroshi Sato, Tomohiro Tanaka, Takafumi Moriya, Yusuke Ijima, Takanobu Oba
2019InterspeechJoint Maximization Decoder with Neural Converters for Fully Neural Network-Based Japanese Speech Recognition.Takafumi Moriya, Jian Wang, Tomohiro Tanaka, Ryo Masumura, Yusuke Shinohara, Yoshikazu Yamaguchi, Yushi Aono
2019InterspeechA Joint End-to-End and DNN-HMM Hybrid Automatic Speech Recognition System with Transferring Sharable Knowledge.Tomohiro Tanaka, Ryo Masumura, Takafumi Moriya, Takanobu Oba, Yushi Aono
2018InterspeechMulti-task Learning with Augmentation Strategy for Acoustic-to-word Attention-based Encoder-decoder Speech Recognition.Takafumi Moriya, Sei Ueno, Yusuke Shinohara, Marc Delcroix, Yoshikazu Yamaguchi, Yushi Aono
2018InterspeechEncoder Transfer for Attention-based Acoustic-to-word Speech Recognition.Sei Ueno, Takafumi Moriya, Masato Mimura, Shinsuke Sakai, Yusuke Shinohara, Yoshikazu Yamaguchi, Yushi Aono, Tatsuya Kawahara
2018InterspeechAutomatic DNN Node Pruning Using Mixture Distribution-based Group Regularization.Tsukasa Yoshida, Takafumi Moriya, Kazuho Watanabe, Yusuke Shinohara, Yoshikazu Yamaguchi, Yushi Aono
2015ASRUAutomation of system building for state-of-the-art large vocabulary speech recognition using evolution strategy.Takafumi Moriya, Tomohiro Tanaka, Takahiro Shinozaki, Shinji Watanabe, Kevin Duh