Tsubasa Ochiai
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
50
Venues
3
Active years
2014–2025
Best venue rank
A*
Where they publish
Papers
50 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICASSP | SoundBeam meets M2D: Target Sound Extraction with Audio Foundation Model. | Carlos Hernandez-Olivan, Marc Delcroix, Tsubasa Ochiai, Daisuke Niizumi, Naohiro Tawara, Tomohiro Nakatani, Shoko Araki |
| 2025 | ICASSP | TS-SUPERB: A Target Speech Processing Benchmark for Speech Self-Supervised Learning Models. | Junyi Peng, Takanori Ashihara, Marc Delcroix, Tsubasa Ochiai, Oldrich Plchot, Shoko Araki, Jan Cernock |
| 2025 | Interspeech | Analysis of Semantic and Acoustic Token Variability Across Speech, Music, and Audio Domains. | Takanori Ashihara, Marc Delcroix, Tsubasa Ochiai, Kohei Matsuura, Shota Horiguchi |
| 2025 | Interspeech | MOVER: Combining Multiple Meeting Recognition Systems. | Naoyuki Kamo, Tsubasa Ochiai, Marc Delcroix, Tomohiro Nakatani |
| 2025 | Interspeech | Real-time TSE demonstration via SoundBeam with KD. | Keigo Wakayama, Tomoko Kawase, Takafumi Moriya, Marc Delcroix, Hiroshi Sato, Tsubasa Ochiai, Masahiro Yasuda, Shoko Araki |
| 2024 | ICASSP | How Does End-To-End Speech Recognition Training Impact Speech Enhancement Artifacts? | Kazuma Iwamoto, Tsubasa Ochiai, Marc Delcroix, Rintaro Ikeshita, Hiroshi Sato, Shoko Araki, Shigeru Katagiri |
| 2024 | ICASSP | Probing Self-Supervised Learning Models With Target Speech Extraction. | Junyi Peng, Marc Delcroix, Tsubasa Ochiai, Oldrich Plchot, Takanori Ashihara, Shoko Araki, Jan Cernock |
| 2024 | ICASSP | Target Speech Extraction with Pre-Trained Self-Supervised Learning Models. | Junyi Peng, Marc Delcroix, Tsubasa Ochiai, Oldrich Plchot, Shoko Araki, Jan Cernock |
| 2024 | ICASSP | Neural Network-Based Virtual Microphone Estimation with Virtual Microphone and Beamformer-Level Multi-Task Loss. | Hanako Segawa, Tsubasa Ochiai, Marc Delcroix, Tomohiro Nakatani, Rintaro Ikeshita, Shoko Araki, Takeshi Yamada, Shoji Makino |
| 2024 | ICASSP | Online Target Sound Extraction with Knowledge Distillation from Partially Non-Causal Teacher. | Keigo Wakayama, Tsubasa Ochiai, Marc Delcroix, Masahiro Yasuda, Shoichiro Saito, Shoko Araki, Akira Nakayama |
| 2024 | Interspeech | SpeakerBeam-SS: Real-time Target Speaker Extraction with Lightweight Conv-TasNet and State Space Modeling. | Hiroshi Sato, Takafumi Moriya, Masato Mimura, Shota Horiguchi, Tsubasa Ochiai, Takanori Ashihara, Atsushi Ando, Kentaro Shinayama, Marc Delcroix |
| 2024 | Interspeech | Array Geometry-Robust Attention-Based Neural Beamformer for Moving Speakers. | Marvin Tammen, Tsubasa Ochiai, Marc Delcroix, Tomohiro Nakatani, Shoko Araki, Simon Doclo |
| 2023 | Interspeech | Impact of Residual Noise and Artifacts in Speech Enhancement Errors on Intelligibility of Human and Machine. | Shoko Araki, Ayako Yamamoto, Tsubasa Ochiai, Kenichi Arai, Atsunori Ogawa, Tomohiro Nakatani, Toshio Irino |
| 2023 | Interspeech | Knowledge Distillation for Neural Transducer-based Target-Speaker ASR: Exploiting Parallel Mixture/Single-Talker Speech Data. | Takafumi Moriya, Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Takanori Ashihara, Kohei Matsuura, Tomohiro Tanaka, Ryo Masumura, Atsunori Ogawa, Taichi Asami |
| 2023 | Interspeech | Downstream Task Agnostic Speech Enhancement with Self-Supervised Representation Loss. | Hiroshi Sato, Ryo Masumura, Tsubasa Ochiai, Marc Delcroix, Takafumi Moriya, Takanori Ashihara, Kentaro Shinayama, Saki Mizuno, Mana Ihori, Tomohiro Tanaka, Nobukatsu Hojo |
| 2022 | ICASSP | Learning to Enhance or Not: Neural Network-Based Switching of Enhanced and Observed Signals for Overlapping Speech Recognition. | Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Naoyuki Kamo, Takafumi Moriya |
| 2022 | Interspeech | Listen only to me! How well can target speech extraction handle false alarms? | Marc Delcroix, Keisuke Kinoshita, Tsubasa Ochiai, Katerina Zmolkov, Hiroshi Sato, Tomohiro Nakatani |
| 2022 | Interspeech | How bad are artifacts?: Analyzing the impact of speech enhancement errors on ASR. | Kazuma Iwamoto, Tsubasa Ochiai, Marc Delcroix, Rintaro Ikeshita, Hiroshi Sato, Shoko Araki, Shigeru Katagiri |
| 2022 | Interspeech | Revisiting joint decoding based multi-talker speech recognition with DNN acoustic model. | Martin Kocour, Katerina Zmolkov, Lucas Ondel, Jan Svec, Marc Delcroix, Tsubasa Ochiai, Luks Burget, Jan Cernock |
| 2022 | Interspeech | Streaming Target-Speaker ASR with Neural Transducer. | Takafumi Moriya, Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Takahiro Shinozaki |
| 2022 | Interspeech | Strategies to Improve Robustness of Target Speech Extraction to Enrollment Variations. | Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Takafumi Moriya, Naoki Makishima, Mana Ihori, Tomohiro Tanaka, Ryo Masumura |
| 2021 | ICASSP | Convolutive Transfer Function Invariant SDR Training Criteria for Multi-Channel Reverberant Speech Separation. | Christoph Bddeker, Wangyou Zhang, Tomohiro Nakatani, Keisuke Kinoshita, Tsubasa Ochiai, Marc Delcroix, Naoyuki Kamo, Yanmin Qian, Reinhold Haeb-Umbach |
| 2021 | ICASSP | Speaker Activity Driven Neural Speech Extraction. | Marc Delcroix, Katerina Zmolkov, Tsubasa Ochiai, Keisuke Kinoshita, Tomohiro Nakatani |
| 2021 | ICASSP | Simpleflat: A Simple Whole-Network Pre-Training Approach for RNN Transducer-Based End-to-End Speech Recognition. | Takafumi Moriya, Takanori Ashihara, Tomohiro Tanaka, Tsubasa Ochiai, Hiroshi Sato, Atsushi Ando, Yusuke Ijima, Ryo Masumura, Yusuke Shinohara |
| 2021 | ICASSP | Neural Network-Based Virtual Microphone Estimator. | Tsubasa Ochiai, Marc Delcroix, Tomohiro Nakatani, Rintaro Ikeshita, Keisuke Kinoshita, Shoko Araki |
| 2021 | ICASSP | Data Fusion for Audiovisual Speaker Localization: Extending Dynamic Stream Weights to the Spatial Domain. | Julio Wissing, Benedikt T. Boenninghoff, Dorothea Kolossa, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Tomohiro Nakatani, Shoko Araki, Christopher Schymura |
| 2021 | ICASSP | End-to-End Dereverberation, Beamforming, and Speech Recognition with Improved Numerical Stability and Advanced Frontend. | Wangyou Zhang, Christoph Bddeker, Shinji Watanabe, Tomohiro Nakatani, Marc Delcroix, Keisuke Kinoshita, Tsubasa Ochiai, Naoyuki Kamo, Reinhold Haeb-Umbach, Yanmin Qian |
| 2021 | Interspeech | Few-Shot Learning of New Sound Classes for Target Sound Extraction. | Marc Delcroix, Jorge Bennasar Vzquez, Tsubasa Ochiai, Keisuke Kinoshita, Shoko Araki |
| 2021 | Interspeech | Streaming End-to-End Speech Recognition for Hybrid RNN-T/Attention Architecture. | Takafumi Moriya, Tomohiro Tanaka, Takanori Ashihara, Tsubasa Ochiai, Hiroshi Sato, Atsushi Ando, Ryo Masumura, Marc Delcroix, Taichi Asami |
| 2021 | Interspeech | Should We Always Separate?: Switching Between Enhanced and Observed Signals for Overlapping Speech Recognition. | Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Takafumi Moriya, Naoyuki Kamo |
| 2021 | Interspeech | PILOT: Introducing Transformers for Probabilistic Sound Event Localization. | Christopher Schymura, Benedikt T. Bnninghoff, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Tomohiro Nakatani, Shoko Araki, Dorothea Kolossa |
| 2020 | ICASSP | Improving Speaker Discrimination of Target Speech Extraction With Time-Domain Speakerbeam. | Marc Delcroix, Tsubasa Ochiai, Katerina Zmolkov, Keisuke Kinoshita, Naohiro Tawara, Tomohiro Nakatani, Shoko Araki |
| 2020 | ICASSP | Improving Noise Robust Automatic Speech Recognition with Single-Channel Time-Domain Enhancement Network. | Keisuke Kinoshita, Tsubasa Ochiai, Marc Delcroix, Tomohiro Nakatani |
| 2020 | ICASSP | DNN-supported Mask-based Convolutional Beamforming for Simultaneous Denoising, Dereverberation, and Source Separation. | Tomohiro Nakatani, Riki Takahashi, Tsubasa Ochiai, Keisuke Kinoshita, Rintaro Ikeshita, Marc Delcroix, Shoko Araki |
| 2020 | ICASSP | Beam-TasNet: Time-domain Audio Separation Network Meets Frequency-domain Beamformer. | Tsubasa Ochiai, Marc Delcroix, Rintaro Ikeshita, Keisuke Kinoshita, Tomohiro Nakatani, Shoko Araki |
| 2020 | ICASSP | A Dynamic Stream Weight Backprop Kalman Filter for Audiovisual Speaker Tracking. | Christopher Schymura, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Tomohiro Nakatani, Shoko Araki, Dorothea Kolossa |
| 2020 | Interspeech | Self-Distillation for Improving CTC-Transformer-Based ASR Systems. | Takafumi Moriya, Tsubasa Ochiai, Shigeki Karita, Hiroshi Sato, Tomohiro Tanaka, Takanori Ashihara, Ryo Masumura, Yusuke Shinohara, Marc Delcroix |
| 2020 | Interspeech | Listen to What You Want: Neural Network-Based Universal Sound Selector. | Tsubasa Ochiai, Marc Delcroix, Yuma Koizumi, Hiroaki Ito, Keisuke Kinoshita, Shoko Araki |
| 2019 | ICASSP | Compact Network for Speakerbeam Target Speaker Extraction. | Marc Delcroix, Katerina Zmolkov, Tsubasa Ochiai, Keisuke Kinoshita, Shoko Araki, Tomohiro Nakatani |
| 2019 | ICASSP | A Unified Framework for Neural Speech Separation and Extraction. | Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Atsunori Ogawa, Tomohiro Nakatani |
| 2019 | Interspeech | End-to-End SpeakerBeam for Single Channel Target Speech Recognition. | Marc Delcroix, Shinji Watanabe, Tsubasa Ochiai, Keisuke Kinoshita, Shigeki Karita, Atsunori Ogawa, Tomohiro Nakatani |
| 2019 | Interspeech | Multimodal SpeakerBeam: Single Channel Target Speech Extraction with Audio-Visual Speaker Clues. | Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Atsunori Ogawa, Tomohiro Nakatani |
| 2018 | ICASSP | Speaker Adaptation for Multichannel End-to-End Speech Recognition. | Tsubasa Ochiai, Shinji Watanabe, Shigeru Katagiri, Takaaki Hori, John R. Hershey |
| 2018 | Interspeech | ESPnet: End-to-End Speech Processing Toolkit. | Shinji Watanabe, Takaaki Hori, Shigeki Karita, Tomoki Hayashi, Jiro Nishitoba, Yuya Unno, Nelson Enrique Yalta Soplin, Jahn Heymann, Matthew Wiesner, Nanxin Chen, Adithya Renduchintala, Tsubasa Ochiai |
| 2017 | ICASSP | Cumulative moving averaged bottleneck speaker vectors for online speaker adaptation of CNN-based acoustic models. | Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Atsunori Ogawa, Taichi Asami, Shigeru Katagiri, Tomohiro Nakatani |
| 2017 | ICASSP | Automatic node selection for Deep Neural Networks using Group Lasso regularization. | Tsubasa Ochiai, Shigeki Matsuda, Hideyuki Watanabe, Shigeru Katagiri |
| 2017 | ICML | Multichannel End-to-end Speech Recognition. | Tsubasa Ochiai, Shinji Watanabe, Takaaki Hori, John R. Hershey |
| 2016 | ICASSP | Bottleneck linear transformation network adaptation for speaker adaptive training-based hybrid DNN-HMM speech recognizer. | Tsubasa Ochiai, Shigeki Matsuda, Hideyuki Watanabe, Xugang Lu, Hisashi Kawai, Shigeru Katagiri |
| 2015 | ICASSP | Speaker adaptive training for deep neural networks embedding linear transformation networks. | Tsubasa Ochiai, Shigeki Matsuda, Hideyuki Watanabe, Xugang Lu, Chiori Hori, Shigeru Katagiri |
| 2014 | ICASSP | Speaker Adaptive Training using Deep Neural Networks. | Tsubasa Ochiai, Shigeki Matsuda, Xugang Lu, Chiori Hori, Shigeru Katagiri |