Skip to content

Tsubasa Ochiai

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

50

Venues

3

Active years

2014–2025

Best venue rank

A*

Where they publish

Papers

50 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPSoundBeam meets M2D: Target Sound Extraction with Audio Foundation Model.Carlos Hernandez-Olivan, Marc Delcroix, Tsubasa Ochiai, Daisuke Niizumi, Naohiro Tawara, Tomohiro Nakatani, Shoko Araki
2025ICASSPTS-SUPERB: A Target Speech Processing Benchmark for Speech Self-Supervised Learning Models.Junyi Peng, Takanori Ashihara, Marc Delcroix, Tsubasa Ochiai, Oldrich Plchot, Shoko Araki, Jan Cernock
2025InterspeechAnalysis of Semantic and Acoustic Token Variability Across Speech, Music, and Audio Domains.Takanori Ashihara, Marc Delcroix, Tsubasa Ochiai, Kohei Matsuura, Shota Horiguchi
2025InterspeechMOVER: Combining Multiple Meeting Recognition Systems.Naoyuki Kamo, Tsubasa Ochiai, Marc Delcroix, Tomohiro Nakatani
2025InterspeechReal-time TSE demonstration via SoundBeam with KD.Keigo Wakayama, Tomoko Kawase, Takafumi Moriya, Marc Delcroix, Hiroshi Sato, Tsubasa Ochiai, Masahiro Yasuda, Shoko Araki
2024ICASSPHow Does End-To-End Speech Recognition Training Impact Speech Enhancement Artifacts?Kazuma Iwamoto, Tsubasa Ochiai, Marc Delcroix, Rintaro Ikeshita, Hiroshi Sato, Shoko Araki, Shigeru Katagiri
2024ICASSPProbing Self-Supervised Learning Models With Target Speech Extraction.Junyi Peng, Marc Delcroix, Tsubasa Ochiai, Oldrich Plchot, Takanori Ashihara, Shoko Araki, Jan Cernock
2024ICASSPTarget Speech Extraction with Pre-Trained Self-Supervised Learning Models.Junyi Peng, Marc Delcroix, Tsubasa Ochiai, Oldrich Plchot, Shoko Araki, Jan Cernock
2024ICASSPNeural Network-Based Virtual Microphone Estimation with Virtual Microphone and Beamformer-Level Multi-Task Loss.Hanako Segawa, Tsubasa Ochiai, Marc Delcroix, Tomohiro Nakatani, Rintaro Ikeshita, Shoko Araki, Takeshi Yamada, Shoji Makino
2024ICASSPOnline Target Sound Extraction with Knowledge Distillation from Partially Non-Causal Teacher.Keigo Wakayama, Tsubasa Ochiai, Marc Delcroix, Masahiro Yasuda, Shoichiro Saito, Shoko Araki, Akira Nakayama
2024InterspeechSpeakerBeam-SS: Real-time Target Speaker Extraction with Lightweight Conv-TasNet and State Space Modeling.Hiroshi Sato, Takafumi Moriya, Masato Mimura, Shota Horiguchi, Tsubasa Ochiai, Takanori Ashihara, Atsushi Ando, Kentaro Shinayama, Marc Delcroix
2024InterspeechArray Geometry-Robust Attention-Based Neural Beamformer for Moving Speakers.Marvin Tammen, Tsubasa Ochiai, Marc Delcroix, Tomohiro Nakatani, Shoko Araki, Simon Doclo
2023InterspeechImpact of Residual Noise and Artifacts in Speech Enhancement Errors on Intelligibility of Human and Machine.Shoko Araki, Ayako Yamamoto, Tsubasa Ochiai, Kenichi Arai, Atsunori Ogawa, Tomohiro Nakatani, Toshio Irino
2023InterspeechKnowledge Distillation for Neural Transducer-based Target-Speaker ASR: Exploiting Parallel Mixture/Single-Talker Speech Data.Takafumi Moriya, Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Takanori Ashihara, Kohei Matsuura, Tomohiro Tanaka, Ryo Masumura, Atsunori Ogawa, Taichi Asami
2023InterspeechDownstream Task Agnostic Speech Enhancement with Self-Supervised Representation Loss.Hiroshi Sato, Ryo Masumura, Tsubasa Ochiai, Marc Delcroix, Takafumi Moriya, Takanori Ashihara, Kentaro Shinayama, Saki Mizuno, Mana Ihori, Tomohiro Tanaka, Nobukatsu Hojo
2022ICASSPLearning to Enhance or Not: Neural Network-Based Switching of Enhanced and Observed Signals for Overlapping Speech Recognition.Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Naoyuki Kamo, Takafumi Moriya
2022InterspeechListen only to me! How well can target speech extraction handle false alarms?Marc Delcroix, Keisuke Kinoshita, Tsubasa Ochiai, Katerina Zmolkov, Hiroshi Sato, Tomohiro Nakatani
2022InterspeechHow bad are artifacts?: Analyzing the impact of speech enhancement errors on ASR.Kazuma Iwamoto, Tsubasa Ochiai, Marc Delcroix, Rintaro Ikeshita, Hiroshi Sato, Shoko Araki, Shigeru Katagiri
2022InterspeechRevisiting joint decoding based multi-talker speech recognition with DNN acoustic model.Martin Kocour, Katerina Zmolkov, Lucas Ondel, Jan Svec, Marc Delcroix, Tsubasa Ochiai, Luks Burget, Jan Cernock
2022InterspeechStreaming Target-Speaker ASR with Neural Transducer.Takafumi Moriya, Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Takahiro Shinozaki
2022InterspeechStrategies to Improve Robustness of Target Speech Extraction to Enrollment Variations.Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Takafumi Moriya, Naoki Makishima, Mana Ihori, Tomohiro Tanaka, Ryo Masumura
2021ICASSPConvolutive Transfer Function Invariant SDR Training Criteria for Multi-Channel Reverberant Speech Separation.Christoph Bddeker, Wangyou Zhang, Tomohiro Nakatani, Keisuke Kinoshita, Tsubasa Ochiai, Marc Delcroix, Naoyuki Kamo, Yanmin Qian, Reinhold Haeb-Umbach
2021ICASSPSpeaker Activity Driven Neural Speech Extraction.Marc Delcroix, Katerina Zmolkov, Tsubasa Ochiai, Keisuke Kinoshita, Tomohiro Nakatani
2021ICASSPSimpleflat: A Simple Whole-Network Pre-Training Approach for RNN Transducer-Based End-to-End Speech Recognition.Takafumi Moriya, Takanori Ashihara, Tomohiro Tanaka, Tsubasa Ochiai, Hiroshi Sato, Atsushi Ando, Yusuke Ijima, Ryo Masumura, Yusuke Shinohara
2021ICASSPNeural Network-Based Virtual Microphone Estimator.Tsubasa Ochiai, Marc Delcroix, Tomohiro Nakatani, Rintaro Ikeshita, Keisuke Kinoshita, Shoko Araki
2021ICASSPData Fusion for Audiovisual Speaker Localization: Extending Dynamic Stream Weights to the Spatial Domain.Julio Wissing, Benedikt T. Boenninghoff, Dorothea Kolossa, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Tomohiro Nakatani, Shoko Araki, Christopher Schymura
2021ICASSPEnd-to-End Dereverberation, Beamforming, and Speech Recognition with Improved Numerical Stability and Advanced Frontend.Wangyou Zhang, Christoph Bddeker, Shinji Watanabe, Tomohiro Nakatani, Marc Delcroix, Keisuke Kinoshita, Tsubasa Ochiai, Naoyuki Kamo, Reinhold Haeb-Umbach, Yanmin Qian
2021InterspeechFew-Shot Learning of New Sound Classes for Target Sound Extraction.Marc Delcroix, Jorge Bennasar Vzquez, Tsubasa Ochiai, Keisuke Kinoshita, Shoko Araki
2021InterspeechStreaming End-to-End Speech Recognition for Hybrid RNN-T/Attention Architecture.Takafumi Moriya, Tomohiro Tanaka, Takanori Ashihara, Tsubasa Ochiai, Hiroshi Sato, Atsushi Ando, Ryo Masumura, Marc Delcroix, Taichi Asami
2021InterspeechShould We Always Separate?: Switching Between Enhanced and Observed Signals for Overlapping Speech Recognition.Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Takafumi Moriya, Naoyuki Kamo
2021InterspeechPILOT: Introducing Transformers for Probabilistic Sound Event Localization.Christopher Schymura, Benedikt T. Bnninghoff, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Tomohiro Nakatani, Shoko Araki, Dorothea Kolossa
2020ICASSPImproving Speaker Discrimination of Target Speech Extraction With Time-Domain Speakerbeam.Marc Delcroix, Tsubasa Ochiai, Katerina Zmolkov, Keisuke Kinoshita, Naohiro Tawara, Tomohiro Nakatani, Shoko Araki
2020ICASSPImproving Noise Robust Automatic Speech Recognition with Single-Channel Time-Domain Enhancement Network.Keisuke Kinoshita, Tsubasa Ochiai, Marc Delcroix, Tomohiro Nakatani
2020ICASSPDNN-supported Mask-based Convolutional Beamforming for Simultaneous Denoising, Dereverberation, and Source Separation.Tomohiro Nakatani, Riki Takahashi, Tsubasa Ochiai, Keisuke Kinoshita, Rintaro Ikeshita, Marc Delcroix, Shoko Araki
2020ICASSPBeam-TasNet: Time-domain Audio Separation Network Meets Frequency-domain Beamformer.Tsubasa Ochiai, Marc Delcroix, Rintaro Ikeshita, Keisuke Kinoshita, Tomohiro Nakatani, Shoko Araki
2020ICASSPA Dynamic Stream Weight Backprop Kalman Filter for Audiovisual Speaker Tracking.Christopher Schymura, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Tomohiro Nakatani, Shoko Araki, Dorothea Kolossa
2020InterspeechSelf-Distillation for Improving CTC-Transformer-Based ASR Systems.Takafumi Moriya, Tsubasa Ochiai, Shigeki Karita, Hiroshi Sato, Tomohiro Tanaka, Takanori Ashihara, Ryo Masumura, Yusuke Shinohara, Marc Delcroix
2020InterspeechListen to What You Want: Neural Network-Based Universal Sound Selector.Tsubasa Ochiai, Marc Delcroix, Yuma Koizumi, Hiroaki Ito, Keisuke Kinoshita, Shoko Araki
2019ICASSPCompact Network for Speakerbeam Target Speaker Extraction.Marc Delcroix, Katerina Zmolkov, Tsubasa Ochiai, Keisuke Kinoshita, Shoko Araki, Tomohiro Nakatani
2019ICASSPA Unified Framework for Neural Speech Separation and Extraction.Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Atsunori Ogawa, Tomohiro Nakatani
2019InterspeechEnd-to-End SpeakerBeam for Single Channel Target Speech Recognition.Marc Delcroix, Shinji Watanabe, Tsubasa Ochiai, Keisuke Kinoshita, Shigeki Karita, Atsunori Ogawa, Tomohiro Nakatani
2019InterspeechMultimodal SpeakerBeam: Single Channel Target Speech Extraction with Audio-Visual Speaker Clues.Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Atsunori Ogawa, Tomohiro Nakatani
2018ICASSPSpeaker Adaptation for Multichannel End-to-End Speech Recognition.Tsubasa Ochiai, Shinji Watanabe, Shigeru Katagiri, Takaaki Hori, John R. Hershey
2018InterspeechESPnet: End-to-End Speech Processing Toolkit.Shinji Watanabe, Takaaki Hori, Shigeki Karita, Tomoki Hayashi, Jiro Nishitoba, Yuya Unno, Nelson Enrique Yalta Soplin, Jahn Heymann, Matthew Wiesner, Nanxin Chen, Adithya Renduchintala, Tsubasa Ochiai
2017ICASSPCumulative moving averaged bottleneck speaker vectors for online speaker adaptation of CNN-based acoustic models.Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Atsunori Ogawa, Taichi Asami, Shigeru Katagiri, Tomohiro Nakatani
2017ICASSPAutomatic node selection for Deep Neural Networks using Group Lasso regularization.Tsubasa Ochiai, Shigeki Matsuda, Hideyuki Watanabe, Shigeru Katagiri
2017ICMLMultichannel End-to-end Speech Recognition.Tsubasa Ochiai, Shinji Watanabe, Takaaki Hori, John R. Hershey
2016ICASSPBottleneck linear transformation network adaptation for speaker adaptive training-based hybrid DNN-HMM speech recognizer.Tsubasa Ochiai, Shigeki Matsuda, Hideyuki Watanabe, Xugang Lu, Hisashi Kawai, Shigeru Katagiri
2015ICASSPSpeaker adaptive training for deep neural networks embedding linear transformation networks.Tsubasa Ochiai, Shigeki Matsuda, Hideyuki Watanabe, Xugang Lu, Chiori Hori, Shigeru Katagiri
2014ICASSPSpeaker Adaptive Training using Deep Neural Networks.Tsubasa Ochiai, Shigeki Matsuda, Xugang Lu, Chiori Hori, Shigeru Katagiri