Skip to content

Marc Delcroix

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

155

Venues

4

Active years

2004–2025

Best venue rank

Multiconference

Where they publish

Papers

155 indexed papers, newest first.

YearVenueTitleAuthors
2025ASRUPredictive ASR and Turn-taking Prediction at Once: Towards More Responsive Spoken Dialog System.Ryo Fukuda, Takatomo Kano, Naohiro Tawara, Marc Delcroix, Atsunori Ogawa, Yuya Chiba, Atsushi Ando
2025ASRUCan We Really Repurpose Multi-Speaker ASR Corpus for Speaker Diarization?Shota Horiguchi, Naohiro Tawara, Takanori Ashihara, Atsushi Ando, Marc Delcroix
2025ICASSPSoundBeam meets M2D: Target Sound Extraction with Audio Foundation Model.Carlos Hernandez-Olivan, Marc Delcroix, Tsubasa Ochiai, Daisuke Niizumi, Naohiro Tawara, Tomohiro Nakatani, Shoko Araki
2025ICASSPGuided Speaker Embedding.Shota Horiguchi, Takafumi Moriya, Atsushi Ando, Takanori Ashihara, Hiroshi Sato, Naohiro Tawara, Marc Delcroix
2025ICASSPBridging Speech and Text Foundation Models with ReShape Attention.Takatomo Kano, Atsunori Ogawa, Marc Delcroix, William Chen, Ryo Fukuda, Kohei Matsuura, Takanori Ashihara, Shinji Watanabe
2025ICASSPAlignment-Free Training for Transducer-based Multi-Talker ASR.Takafumi Moriya, Shota Horiguchi, Marc Delcroix, Ryo Masumura, Takanori Ashihara, Hiroshi Sato, Kohei Matsuura, Masato Mimura
2025ICASSPA Hybrid Probabilistic-Deterministic Model Recursively Enhancing Speech.Tomohiro Nakatani, Naoyuki Kamo, Marc Delcroix, Shoko Araki
2025ICASSPTS-SUPERB: A Target Speech Processing Benchmark for Speech Self-Supervised Learning Models.Junyi Peng, Takanori Ashihara, Marc Delcroix, Tsubasa Ochiai, Oldrich Plchot, Shoko Araki, Jan Cernock
2025ICASSPMamba-based Segmentation Model for Speaker Diarization.Alexis Plaquet, Naohiro Tawara, Marc Delcroix, Shota Horiguchi, Atsushi Ando, Shoko Araki
2025ICASSPMulti-channel Speaker Counting for EEND-VC-based Speaker Diarization on Multi-domain Conversation.Naohiro Tawara, Atsushi Ando, Shota Horiguchi, Marc Delcroix
2025InterspeechAnalysis of Semantic and Acoustic Token Variability Across Speech, Music, and Audio Domains.Takanori Ashihara, Marc Delcroix, Tsubasa Ochiai, Kohei Matsuura, Shota Horiguchi
2025InterspeechMitigating Non-Target Speaker Bias in Guided Speaker Embedding.Shota Horiguchi, Takanori Ashihara, Marc Delcroix, Atsushi Ando, Naohiro Tawara
2025InterspeechPretraining Multi-Speaker Identification for Neural Speaker Diarization.Shota Horiguchi, Atsushi Ando, Naohiro Tawara, Marc Delcroix
2025InterspeechMOVER: Combining Multiple Meeting Recognition Systems.Naoyuki Kamo, Tsubasa Ochiai, Marc Delcroix, Tomohiro Nakatani
2025InterspeechPick and Summarize: Integrating Extractive and Abstractive Speech Summarization.Takatomo Kano, Atsunori Ogawa, Marc Delcroix, Ryo Fukuda, William Chen, Shinji Watanabe
2025InterspeechReal-time TSE demonstration via SoundBeam with KD.Keigo Wakayama, Tomoko Kawase, Takafumi Moriya, Marc Delcroix, Hiroshi Sato, Tsubasa Ochiai, Masahiro Yasuda, Shoko Araki
2024ICASSPWhat Do Self-Supervised Speech and Speaker Models Learn? New Findings from a Cross Model Layer-Wise Analysis.Takanori Ashihara, Marc Delcroix, Takafumi Moriya, Kohei Matsuura, Taichi Asami, Yusuke Ijima
2024ICASSPTrain Long and Test Long: Leveraging Full Document Contexts in Speech Processing.William Chen, Takatomo Kano, Atsunori Ogawa, Marc Delcroix, Shinji Watanabe
2024ICASSPNoise-Robust Zero-Shot Text-to-Speech Synthesis Conditioned on Self-Supervised Speech-Representation Model with Adapters.Kenichi Fujita, Hiroshi Sato, Takanori Ashihara, Hiroki Kanagawa, Marc Delcroix, Takafumi Moriya, Yusuke Ijima
2024ICASSPHow Does End-To-End Speech Recognition Training Impact Speech Enhancement Artifacts?Kazuma Iwamoto, Tsubasa Ochiai, Marc Delcroix, Rintaro Ikeshita, Hiroshi Sato, Shoko Araki, Shigeru Katagiri
2024ICASSPDiffusion Model-Based MIMO Speech Denoising and Dereverberation.Rino Kimura, Tomohiro Nakatani, Naoyuki Kamo, Marc Delcroix, Shoko Araki, Tetsuya Ueda, Shoji Makino
2024ICASSPDiscriminative Training of VBx Diarization.Dominik Klement, Mireia Dez, Federico Landini, Luks Burget, Anna Silnova, Marc Delcroix, Naohiro Tawara
2024ICASSPMeeting Recognition with Continuous Speech Separation and Transcription-Supported Diarization.Thilo von Neumann, Christoph Bddeker, Tobias Cord-Landwehr, Marc Delcroix, Reinhold Haeb-Umbach
2024ICASSPProbing Self-Supervised Learning Models With Target Speech Extraction.Junyi Peng, Marc Delcroix, Tsubasa Ochiai, Oldrich Plchot, Takanori Ashihara, Shoko Araki, Jan Cernock
2024ICASSPTarget Speech Extraction with Pre-Trained Self-Supervised Learning Models.Junyi Peng, Marc Delcroix, Tsubasa Ochiai, Oldrich Plchot, Shoko Araki, Jan Cernock
2024ICASSPNeural Network-Based Virtual Microphone Estimation with Virtual Microphone and Beamformer-Level Multi-Task Loss.Hanako Segawa, Tsubasa Ochiai, Marc Delcroix, Tomohiro Nakatani, Rintaro Ikeshita, Shoko Araki, Takeshi Yamada, Shoji Makino
2024ICASSPEnsemble Inference for Diffusion Model-Based Speech Enhancement.Hao Shi, Naoyuki Kamo, Marc Delcroix, Tomohiro Nakatani, Shoko Araki
2024ICASSPNTT Speaker Diarization System for Chime-7: Multi-Domain, Multi-Microphone end-to-end and Vector Clustering Diarization.Naohiro Tawara, Marc Delcroix, Atsushi Ando, Atsunori Ogawa
2024ICASSPOnline Target Sound Extraction with Knowledge Distillation from Partially Non-Causal Teacher.Keigo Wakayama, Tsubasa Ochiai, Marc Delcroix, Masahiro Yasuda, Shoichiro Saito, Shoko Araki, Akira Nakayama
2024InterspeechLightweight Zero-shot Text-to-Speech with Mixture of Adapters.Kenichi Fujita, Takanori Ashihara, Marc Delcroix, Yusuke Ijima
2024InterspeechSentence-wise Speech Summarization: Task, Datasets, and End-to-End Modeling with LM Knowledge Distillation.Kohei Matsuura, Takanori Ashihara, Takafumi Moriya, Masato Mimura, Takatomo Kano, Atsunori Ogawa, Marc Delcroix
2024InterspeechSpeakerBeam-SS: Real-time Target Speaker Extraction with Lightweight Conv-TasNet and State Space Modeling.Hiroshi Sato, Takafumi Moriya, Masato Mimura, Shota Horiguchi, Tsubasa Ochiai, Takanori Ashihara, Atsushi Ando, Kentaro Shinayama, Marc Delcroix
2024InterspeechArray Geometry-Robust Attention-Based Neural Beamformer for Moving Speakers.Marvin Tammen, Tsubasa Ochiai, Marc Delcroix, Tomohiro Nakatani, Shoko Araki, Simon Doclo
2023ASRUSummarize While Translating: Universal Model With Parallel Decoding for Summarization and Translation.Takatomo Kano, Atsunori Ogawa, Marc Delcroix, Kohei Matsuura, Takanori Ashihara, William Chen, Shinji Watanabe
2023ASRUEspnet-Summ: Introducing a Novel Large Dataset, Toolkit, and a Cross-Corpora Evaluation of Speech Summarization Systems.Roshan S. Sharma, William Chen, Takatomo Kano, Ruchira Sharma, Siddhant Arora, Shinji Watanabe, Atsunori Ogawa, Marc Delcroix, Rita Singh, Bhiksha Raj
2023ICASSPSpeech Summarization of Long Spoken Document: Improving Memory Efficiency of Speech/Text Encoders.Takatomo Kano, Atsunori Ogawa, Marc Delcroix, Roshan S. Sharma, Kohei Matsuura, Shinji Watanabe
2023ICASSPLeveraging Large Text Corpora For End-To-End Speech Summarization.Kohei Matsuura, Takanori Ashihara, Takafumi Moriya, Tomohiro Tanaka, Atsunori Ogawa, Marc Delcroix, Ryo Masumura
2023ICASSPOn Word Error Rate Definitions and Their Efficient Computation for Multi-Speaker Speech Recognition Systems.Thilo von Neumann, Christoph Bddeker, Keisuke Kinoshita, Marc Delcroix, Reinhold Haeb-Umbach
2023ICASSPIterative Shallow Fusion of Backward Language Model for End-To-End Speech Recognition.Atsunori Ogawa, Takafumi Moriya, Naoyuki Kamo, Naohiro Tawara, Marc Delcroix
2023InterspeechSpeechGLUE: How Well Can Self-Supervised Speech Models Capture Linguistic Knowledge?Takanori Ashihara, Takafumi Moriya, Kohei Matsuura, Tomohiro Tanaka, Yusuke Ijima, Taichi Asami, Marc Delcroix, Yukinori Honma
2023InterspeechMulti-Stream Extension of Variational Bayesian HMM Clustering (MS-VBx) for Combined End-to-End and Vector Clustering-based Diarization.Marc Delcroix, Naohiro Tawara, Mireia Dez, Federico Landini, Anna Silnova, Atsunori Ogawa, Tomohiro Nakatani, Luks Burget, Shoko Araki
2023InterspeechTarget Speech Extraction with Conditional Diffusion Model.Naoyuki Kamo, Marc Delcroix, Tomohiro Nakatani
2023InterspeechTransfer Learning from Pre-trained Language Models Improves End-to-End Speech Summarization.Kohei Matsuura, Takanori Ashihara, Takafumi Moriya, Tomohiro Tanaka, Takatomo Kano, Atsunori Ogawa, Marc Delcroix
2023InterspeechKnowledge Distillation for Neural Transducer-based Target-Speaker ASR: Exploiting Parallel Mixture/Single-Talker Speech Data.Takafumi Moriya, Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Takanori Ashihara, Kohei Matsuura, Tomohiro Tanaka, Ryo Masumura, Atsunori Ogawa, Taichi Asami
2023InterspeechDownstream Task Agnostic Speech Enhancement with Self-Supervised Representation Loss.Hiroshi Sato, Ryo Masumura, Tsubasa Ochiai, Marc Delcroix, Takafumi Moriya, Takanori Ashihara, Kentaro Shinayama, Saki Mizuno, Mana Ihori, Tomohiro Tanaka, Nobukatsu Hojo
2022ICASSPIntegrating Multiple ASR Systems into NLP Backend with Attention Fusion.Takatomo Kano, Atsunori Ogawa, Marc Delcroix, Shinji Watanabe
2022ICASSPTight Integration Of Neural- And Clustering-Based Diarization Through Deep Unfolding Of Infinite Gaussian Mixture Model.Keisuke Kinoshita, Marc Delcroix, Tomoharu Iwata
2022ICASSPHybrid RNN-T/Attention-Based Streaming ASR with Triggered Chunkwise Attention and Dual Internal Language Model Integration.Takafumi Moriya, Takanori Ashihara, Atsushi Ando, Hiroshi Sato, Tomohiro Tanaka, Kohei Matsuura, Ryo Masumura, Marc Delcroix, Takahiro Shinozaki
2022ICASSPSA-SDR: A Novel Loss Function for Separation of Meeting Style Data.Thilo von Neumann, Keisuke Kinoshita, Christoph Bddeker, Marc Delcroix, Reinhold Haeb-Umbach
2022ICASSPLattice Rescoring Based on Large Ensemble of Complementary Neural Language Models.Atsunori Ogawa, Naohiro Tawara, Marc Delcroix, Shoko Araki
2022ICASSPLearning to Enhance or Not: Neural Network-Based Switching of Enhanced and Observed Signals for Overlapping Speech Recognition.Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Naoyuki Kamo, Takafumi Moriya
2022InterspeechListen only to me! How well can target speech extraction handle false alarms?Marc Delcroix, Keisuke Kinoshita, Tsubasa Ochiai, Katerina Zmolkov, Hiroshi Sato, Tomohiro Nakatani
2022InterspeechHow bad are artifacts?: Analyzing the impact of speech enhancement errors on ASR.Kazuma Iwamoto, Tsubasa Ochiai, Marc Delcroix, Rintaro Ikeshita, Hiroshi Sato, Shoko Araki, Shigeru Katagiri
2022InterspeechUtterance-by-utterance overlap-aware neural diarization with Graph-PIT.Keisuke Kinoshita, Thilo von Neumann, Marc Delcroix, Christoph Bddeker, Reinhold Haeb-Umbach
2022InterspeechRevisiting joint decoding based multi-talker speech recognition with DNN acoustic model.Martin Kocour, Katerina Zmolkov, Lucas Ondel, Jan Svec, Marc Delcroix, Tsubasa Ochiai, Luks Burget, Jan Cernock
2022InterspeechStreaming Target-Speaker ASR with Neural Transducer.Takafumi Moriya, Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Takahiro Shinozaki
2022InterspeechStrategies to Improve Robustness of Target Speech Extraction to Enrollment Variations.Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Takafumi Moriya, Naoki Makishima, Mana Ihori, Tomohiro Tanaka, Ryo Masumura
2021ASRUAttention-Based Multi-Hypothesis Fusion for Speech Summarization.Takatomo Kano, Atsunori Ogawa, Marc Delcroix, Shinji Watanabe
2021ICASSPConvolutive Transfer Function Invariant SDR Training Criteria for Multi-Channel Reverberant Speech Separation.Christoph Bddeker, Wangyou Zhang, Tomohiro Nakatani, Keisuke Kinoshita, Tsubasa Ochiai, Marc Delcroix, Naoyuki Kamo, Yanmin Qian, Reinhold Haeb-Umbach
2021ICASSPSpeaker Activity Driven Neural Speech Extraction.Marc Delcroix, Katerina Zmolkov, Tsubasa Ochiai, Keisuke Kinoshita, Tomohiro Nakatani
2021ICASSPIntegrating End-to-End Neural and Clustering-Based Diarization: Getting the Best of Both Worlds.Keisuke Kinoshita, Marc Delcroix, Naohiro Tawara
2021ICASSPDual-Path Modeling for Long Recording Speech Separation in Meetings.Chenda Li, Zhuo Chen, Yi Luo, Cong Han, Tianyan Zhou, Keisuke Kinoshita, Marc Delcroix, Shinji Watanabe, Yanmin Qian
2021ICASSPNeural Network-Based Virtual Microphone Estimator.Tsubasa Ochiai, Marc Delcroix, Tomohiro Nakatani, Rintaro Ikeshita, Keisuke Kinoshita, Shoko Araki
2021ICASSPBLSTM-Based Confidence Estimation for End-to-End Speech Recognition.Atsunori Ogawa, Naohiro Tawara, Takatomo Kano, Marc Delcroix
2021ICASSPData Fusion for Audiovisual Speaker Localization: Extending Dynamic Stream Weights to the Spatial Domain.Julio Wissing, Benedikt T. Boenninghoff, Dorothea Kolossa, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Tomohiro Nakatani, Shoko Araki, Christopher Schymura
2021ICASSPEnd-to-End Dereverberation, Beamforming, and Speech Recognition with Improved Numerical Stability and Advanced Frontend.Wangyou Zhang, Christoph Bddeker, Shinji Watanabe, Tomohiro Nakatani, Marc Delcroix, Keisuke Kinoshita, Tsubasa Ochiai, Naoyuki Kamo, Reinhold Haeb-Umbach, Yanmin Qian
2021InterspeechFew-Shot Learning of New Sound Classes for Target Sound Extraction.Marc Delcroix, Jorge Bennasar Vzquez, Tsubasa Ochiai, Keisuke Kinoshita, Shoko Araki
2021InterspeechContinuous Speech Separation Using Speaker Inventory for Long Recording.Cong Han, Yi Luo, Chenda Li, Tianyan Zhou, Keisuke Kinoshita, Shinji Watanabe, Marc Delcroix, Hakan Erdogan, John R. Hershey, Nima Mesgarani, Zhuo Chen
2021InterspeechAdvances in Integration of End-to-End Neural and Clustering-Based Diarization for Real Conversational Speech.Keisuke Kinoshita, Marc Delcroix, Naohiro Tawara
2021InterspeechStreaming End-to-End Speech Recognition for Hybrid RNN-T/Attention Architecture.Takafumi Moriya, Tomohiro Tanaka, Takanori Ashihara, Tsubasa Ochiai, Hiroshi Sato, Atsushi Ando, Ryo Masumura, Marc Delcroix, Taichi Asami
2021InterspeechGraph-PIT: Generalized Permutation Invariant Training for Continuous Separation of Arbitrary Numbers of Speakers.Thilo von Neumann, Keisuke Kinoshita, Christoph Bddeker, Marc Delcroix, Reinhold Haeb-Umbach
2021InterspeechShould We Always Separate?: Switching Between Enhanced and Observed Signals for Overlapping Speech Recognition.Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Takafumi Moriya, Naoyuki Kamo
2021InterspeechPILOT: Introducing Transformers for Probabilistic Sound Event Localization.Christopher Schymura, Benedikt T. Bnninghoff, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Tomohiro Nakatani, Shoko Araki, Dorothea Kolossa
2021InterspeechAuxiliary Loss Function for Target Speech Extraction and Recognition with Weak Supervision Based on Speaker Characteristics.Katerina Zmolkov, Marc Delcroix, Desh Raj, Shinji Watanabe, Jan Cernock
2020ICASSPImproving Speaker Discrimination of Target Speech Extraction With Time-Domain Speakerbeam.Marc Delcroix, Tsubasa Ochiai, Katerina Zmolkov, Keisuke Kinoshita, Naohiro Tawara, Tomohiro Nakatani, Shoko Araki
2020ICASSPTackling Real Noisy Reverberant Meetings with All-Neural Source Separation, Counting, and Diarization System.Keisuke Kinoshita, Marc Delcroix, Shoko Araki, Tomohiro Nakatani
2020ICASSPImproving Noise Robust Automatic Speech Recognition with Single-Channel Time-Domain Enhancement Network.Keisuke Kinoshita, Tsubasa Ochiai, Marc Delcroix, Tomohiro Nakatani
2020ICASSPSpeech Enhancement Using Self-Adaptation and Multi-Head Self-Attention.Yuma Koizumi, Kohei Yatabe, Marc Delcroix, Yoshiki Masuyama, Daiki Takeuchi
2020ICASSPDNN-supported Mask-based Convolutional Beamforming for Simultaneous Denoising, Dereverberation, and Source Separation.Tomohiro Nakatani, Riki Takahashi, Tsubasa Ochiai, Keisuke Kinoshita, Rintaro Ikeshita, Marc Delcroix, Shoko Araki
2020ICASSPEnd-to-End Training of Time Domain Audio Separation and Recognition.Thilo von Neumann, Keisuke Kinoshita, Lukas Drude, Christoph Bddeker, Marc Delcroix, Tomohiro Nakatani, Reinhold Haeb-Umbach
2020ICASSPBeam-TasNet: Time-domain Audio Separation Network Meets Frequency-domain Beamformer.Tsubasa Ochiai, Marc Delcroix, Rintaro Ikeshita, Keisuke Kinoshita, Tomohiro Nakatani, Shoko Araki
2020ICASSPA Dynamic Stream Weight Backprop Kalman Filter for Audiovisual Speaker Tracking.Christopher Schymura, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Tomohiro Nakatani, Shoko Araki, Dorothea Kolossa
2020ICASSPFrame-Level Phoneme-Invariant Speaker Embedding for Text-Independent Speaker Recognition on Extremely Short Utterances.Naohiro Tawara, Atsunori Ogawa, Tomoharu Iwata, Marc Delcroix, Tetsuji Ogawa
2020InterspeechMulti-Path RNN for Hierarchical Modeling of Long Sequential Data and its Application to Speaker Stream Separation.Keisuke Kinoshita, Thilo von Neumann, Marc Delcroix, Tomohiro Nakatani, Reinhold Haeb-Umbach
2020InterspeechSelf-Distillation for Improving CTC-Transformer-Based ASR Systems.Takafumi Moriya, Tsubasa Ochiai, Shigeki Karita, Hiroshi Sato, Tomohiro Tanaka, Takanori Ashihara, Ryo Masumura, Yusuke Shinohara, Marc Delcroix
2020InterspeechMulti-Talker ASR for an Unknown Number of Sources: Joint Training of Source Counting, Separation and ASR.Thilo von Neumann, Christoph Bddeker, Lukas Drude, Keisuke Kinoshita, Marc Delcroix, Tomohiro Nakatani, Reinhold Haeb-Umbach
2020InterspeechListen to What You Want: Neural Network-Based Universal Sound Selector.Tsubasa Ochiai, Marc Delcroix, Yuma Koizumi, Hiroaki Ito, Keisuke Kinoshita, Shoko Araki
2020InterspeechLanguage Model Data Augmentation Based on Text Domain Transfer.Atsunori Ogawa, Naohiro Tawara, Marc Delcroix
2019ICASSPEstimation of Sampling Frequency Mismatch between Distributed Asynchronous Microphones under Existence of Source Movements with Stationary Time Periods Detection.Shoko Araki, Nobutaka Ono, Keisuke Kinoshita, Marc Delcroix
2019ICASSPCompact Network for Speakerbeam Target Speaker Extraction.Marc Delcroix, Katerina Zmolkov, Tsubasa Ochiai, Keisuke Kinoshita, Shoko Araki, Tomohiro Nakatani
2019ICASSPA Unified Framework for Feature-based Domain Adaptation of Neural Network Language Models.Michael Hentschel, Marc Delcroix, Atsunori Ogawa, Tomoharu Iwata, Tomohiro Nakatani
2019ICASSPSemi-supervised End-to-end Speech Recognition Using Text-to-speech and Autoencoders.Shigeki Karita, Shinji Watanabe, Tomoharu Iwata, Marc Delcroix, Atsunori Ogawa, Tomohiro Nakatani
2019ICASSPMask-based MVDR Beamformer for Noisy Multisource Environments: Introduction of Time-varying Spatial Covariance Model.Yuki Kubo, Tomohiro Nakatani, Marc Delcroix, Keisuke Kinoshita, Shoko Araki
2019ICASSPAll-neural Online Source Separation, Counting, and Diarization for Meeting Analysis.Thilo von Neumann, Keisuke Kinoshita, Marc Delcroix, Shoko Araki, Tomohiro Nakatani, Reinhold Haeb-Umbach
2019ICASSPA Unified Framework for Neural Speech Separation and Extraction.Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Atsunori Ogawa, Tomohiro Nakatani
2019InterspeechEnd-to-End SpeakerBeam for Single Channel Target Speech Recognition.Marc Delcroix, Shinji Watanabe, Tsubasa Ochiai, Keisuke Kinoshita, Shigeki Karita, Atsunori Ogawa, Tomohiro Nakatani
2019InterspeechImproving Transformer-Based End-to-End Speech Recognition with Connectionist Temporal Classification and Language Model Integration.Shigeki Karita, Nelson Enrique Yalta Soplin, Shinji Watanabe, Marc Delcroix, Atsunori Ogawa, Tomohiro Nakatani
2019InterspeechMultimodal SpeakerBeam: Single Channel Target Speech Extraction with Audio-Visual Speaker Clues.Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Atsunori Ogawa, Tomohiro Nakatani
2019InterspeechImproved Deep Duel Model for Rescoring N-Best Speech Recognition List Using Backward LSTMLM and Ensemble Encoders.Atsunori Ogawa, Marc Delcroix, Shigeki Karita, Tomohiro Nakatani
2018ICASSPMeeting Recognition with Asynchronous Distributed Microphone Array Using Block-Wise Refinement of Mask-Based MVDR Beamformer.Shoko Araki, Nobutaka Ono, Keisuke Kinoshita, Marc Delcroix
2018ICASSPSingle Channel Target Speaker Extraction and Recognition with Speaker Beam.Marc Delcroix, Katerina Zmolkov, Keisuke Kinoshita, Atsunori Ogawa, Tomohiro Nakatani
2018ICASSPSequence Training of Encoder-Decoder Model Using Policy Gradient for End-to-End Speech Recognition.Shigeki Karita, Atsunori Ogawa, Marc Delcroix, Tomohiro Nakatani
2018ICASSPListening to Each Speaker One by One with Recurrent Selective Hearing Networks.Keisuke Kinoshita, Lukas Drude, Marc Delcroix, Tomohiro Nakatani
2018ICASSPRescoring N-Best Speech Recognition List Based on One-on-One Hypothesis Comparison Using Encoder-Classifier Model.Atsunori Ogawa, Marc Delcroix, Shigeki Karita, Tomohiro Nakatani
2018ICASSPOptimization of Speaker-Aware Multichannel Speech Extraction with ASR Criterion.Katerina Zmolkov, Marc Delcroix, Keisuke Kinoshita, Takuya Higuchi, Tomohiro Nakatani, Jan Cernock
2018InterspeechAuxiliary Feature Based Adaptation of End-to-end ASR Systems.Marc Delcroix, Shinji Watanabe, Atsunori Ogawa, Shigeki Karita, Tomohiro Nakatani
2018InterspeechIntegrating Neural Network Based Beamforming and Weighted Prediction Error Dereverberation.Lukas Drude, Christoph Bddeker, Jahn Heymann, Reinhold Haeb-Umbach, Keisuke Kinoshita, Marc Delcroix, Tomohiro Nakatani
2018InterspeechSemi-Supervised End-to-End Speech Recognition.Shigeki Karita, Shinji Watanabe, Tomoharu Iwata, Atsunori Ogawa, Marc Delcroix
2018InterspeechMulti-task Learning with Augmentation Strategy for Acoustic-to-word Attention-based Encoder-decoder Speech Recognition.Takafumi Moriya, Sei Ueno, Yusuke Shinohara, Marc Delcroix, Yoshikazu Yamaguchi, Yushi Aono
2017ASRUMeeting recognition with asynchronous distributed microphone array.Shoko Araki, Nobutaka Ono, Keisuke Kinoshita, Marc Delcroix
2017ASRUAdversarial training for data-driven speech enhancement without parallel corpus.Takuya Higuchi, Keisuke Kinoshita, Marc Delcroix, Tomohiro Nakatani
2017ASRULearning speaker representation for neural network based multichannel speaker extraction.Katerina Zmolkov, Marc Delcroix, Keisuke Kinoshita, Takuya Higuchi, Atsunori Ogawa, Tomohiro Nakatani
2017ICASSPOnline environmental adaptation of CNN-based acoustic models using spatial diffuseness features.Christian Huemmer, Marc Delcroix, Atsunori Ogawa, Keisuke Kinoshita, Tomohiro Nakatani, Walter Kellermann
2017ICASSPProbabilistic spatial dictionary based online adaptive beamforming for meeting recognition in noisy and reverberant environments.Nobutaka Ito, Shoko Araki, Marc Delcroix, Tomohiro Nakatani
2017ICASSPDeep mixture density network for statistical model-based feature enhancement.Keisuke Kinoshita, Marc Delcroix, Atsunori Ogawa, Takuya Higuchi, Tomohiro Nakatani
2017ICASSPCumulative moving averaged bottleneck speaker vectors for online speaker adaptation of CNN-based acoustic models.Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Atsunori Ogawa, Taichi Asami, Shigeru Katagiri, Tomohiro Nakatani
2017ICASSPFeedback connection for deep neural network-based acoustic modeling.Dung T. Tran, Marc Delcroix, Atsunori Ogawa, Christian Huemmer, Tomohiro Nakatani
2017InterspeechDeep Clustering-Based Beamforming for Separation with Unknown Number of Sources.Takuya Higuchi, Keisuke Kinoshita, Marc Delcroix, Katerina Zmolkov, Tomohiro Nakatani
2017InterspeechForward-Backward Convolutional LSTM for Acoustic Modeling.Shigeki Karita, Atsunori Ogawa, Marc Delcroix, Tomohiro Nakatani
2017InterspeechNeural Network-Based Spectrum Estimation for Online WPE Dereverberation.Keisuke Kinoshita, Marc Delcroix, Haeyong Kwon, Takuma Mori, Tomohiro Nakatani
2017InterspeechImproved Example-Based Speech Enhancement by Using Deep Neural Network Acoustic Model for Noise Robust Example Search.Atsunori Ogawa, Keisuke Kinoshita, Marc Delcroix, Tomohiro Nakatani
2017InterspeechUnfolded Deep Recurrent Convolutional Neural Network with Jump Ahead Connections for Acoustic Modeling.Dung T. Tran, Marc Delcroix, Shigeki Karita, Michael Hentschel, Atsunori Ogawa, Tomohiro Nakatani
2017InterspeechUncertainty Decoding with Adaptive Sampling for Noise Robust DNN-Based Acoustic Modeling.Dung T. Tran, Marc Delcroix, Atsunori Ogawa, Tomohiro Nakatani
2017InterspeechSpeaker-Aware Neural Network Based Beamformer for Speaker Extraction in Speech Mixtures.Katerina Zmolkov, Marc Delcroix, Keisuke Kinoshita, Takuya Higuchi, Atsunori Ogawa, Tomohiro Nakatani
2016ICASSPContext adaptive deep neural networks for fast acoustic model adaptation in noisy conditions.Marc Delcroix, Keisuke Kinoshita, Chengzhu Yu, Atsunori Ogawa, Takuya Yoshioka, Tomohiro Nakatani
2016ICASSPJoint acoustic factor learning for robust deep neural network based automatic speech recognition.Souvik Kundu, Gautam Mantena, Yanmin Qian, Tian Tan, Marc Delcroix, Khe Chai Sim
2016InterspeechContext Adaptive Neural Network for Rapid Adaptation of Deep CNN Based Acoustic Models.Marc Delcroix, Keisuke Kinoshita, Atsunori Ogawa, Takuya Yoshioka, Dung T. Tran, Tomohiro Nakatani
2016InterspeechRobust Example Search Using Bottleneck Features for Example-Based Speech Enhancement.Atsunori Ogawa, Shogo Seki, Keisuke Kinoshita, Marc Delcroix, Takuya Yoshioka, Tomohiro Nakatani, Kazuya Takeda
2016InterspeechFactorized Linear Input Network for Acoustic Model Adaptation in Noisy Conditions.Dung T. Tran, Marc Delcroix, Atsunori Ogawa, Tomohiro Nakatani
2016InterspeechData Selection by Sequence Summarizing Neural Network in Mismatch Condition Training.Katerina Zmolkov, Martin Karafit, Karel Vesel, Marc Delcroix, Shinji Watanabe, Luks Burget, Jan Cernock
2015ASRUThe NTT CHiME-3 system: Advances in speech enhancement and recognition for mobile multi-microphone devices.Takuya Yoshioka, Nobutaka Ito, Marc Delcroix, Atsunori Ogawa, Keisuke Kinoshita, Masakiyo Fujimoto, Chengzhu Yu, Wojciech J. Fabian, Miquel Espi, Takuya Higuchi, Shoko Araki, Tomohiro Nakatani
2015ICASSPExploring multi-channel features for denoising-autoencoder-based speech enhancement.Shoko Araki, Tomoki Hayashi, Marc Delcroix, Masakiyo Fujimoto, Kazuya Takeda, Tomohiro Nakatani
2015ICASSPContext adaptive deep neural networks for fast acoustic model adaptation.Marc Delcroix, Keisuke Kinoshita, Takaaki Hori, Tomohiro Nakatani
2015ICASSPWFST-based structural classification integrating dnn acoustic features and RNN language features for speech recognition.Quoc Truong Do, Satoshi Nakamura, Marc Delcroix, Takaaki Hori
2015InterspeechText-informed speech enhancement with deep neural networks.Keisuke Kinoshita, Marc Delcroix, Atsunori Ogawa, Tomohiro Nakatani
2015InterspeechRobust i-vector extraction for neural network adaptation in noisy environment.Chengzhu Yu, Atsunori Ogawa, Marc Delcroix, Takuya Yoshioka, Tomohiro Nakatani, John H. L. Hansen
2013ICASSPUnsupervised discriminative adaptation using differenced maximum mutual information based linear regression.Marc Delcroix, Atsunori Ogawa, Seong-Jun Hahm, Tomohiro Nakatani, Atsushi Nakamura
2013ICASSPFeature space variational Bayesian linear regression and its combination with model space VBLR.Seong-Jun Hahm, Atsunori Ogawa, Marc Delcroix, Masakiyo Fujimoto, Takaaki Hori, Atsushi Nakamura
2013InterspeechIs speech enhancement pre-processing still relevant when using deep neural networks for acoustic modeling?Marc Delcroix, Yotaro Kubo, Tomohiro Nakatani, Atsushi Nakamura
2013InterspeechConditional emission densities for combining speech enhancement and recognition systems.Armin Sehr, Takuya Yoshioka, Marc Delcroix, Keisuke Kinoshita, Tomohiro Nakatani, Roland Maas, Walter Kellermann
2012ICASSPDiscriminative feature transforms using differenced maximum mutual information.Marc Delcroix, Atsunori Ogawa, Shinji Watanabe, Tomohiro Nakatani, Atsushi Nakamura
2012ICASSPLogMax observation model with MFCC-based spectral prior for reduction of highly nonstationary ambient noise.Tomohiro Nakatani, Takuya Yoshioka, Shoko Araki, Marc Delcroix, Masakiyo Fujimoto
2012InterspeechExample-based speech enhancement with joint utilization of spatial, spectral & temporal cues of speech and noise.Keisuke Kinoshita, Marc Delcroix, Mehrez Souden, Tomohiro Nakatani
2011InterspeechSingle Channel Dereverberation Using Example-Based Speech Enhancement with Uncertainty Decoding Technique.Keisuke Kinoshita, Mehrez Souden, Marc Delcroix, Tomohiro Nakatani
2011InterspeechReduction of Highly Nonstationary Ambient Noise by Integrating Spectral and Locational Characteristics of Speech and Noise for Robust ASR.Tomohiro Nakatani, Shoko Araki, Marc Delcroix, Takuya Yoshioka, Masakiyo Fujimoto
2011InterspeechA Multichannel Feature-Based Processing for Robust Speech Recognition.Mehrez Souden, Keisuke Kinoshita, Marc Delcroix, Tomohiro Nakatani
2008ICASSPCombined static and dynamic variance adaptation for efficient interconnection of speech enhancement pre-processor with speech recognizer.Marc Delcroix, Tomohiro Nakatani, Shinji Watanabe
2008ISCASMissing feature speech recognition in a meeting situation with maximum SNR beamforming.Dorothea Kolossa, Shoko Araki, Marc Delcroix, Tomohiro Nakatani, Reinhold Orglmeister, Shoji Makino
2007ICASSPStudy on Speech Dereverberation with Autocorrelation Codebook.Tomohiro Nakatani, Biing-Hwang Juang, Takafumi Hikichi, Takuya Yoshioka, Keisuke Kinoshita, Marc Delcroix, Masato Miyoshi
2007InterspeechMulti-step linear prediction based speech dereverberation in noisy reverberant environment.Keisuke Kinoshita, Marc Delcroix, Tomohiro Nakatani, Masato Miyoshi
2007ISCASRobust blind dereverberation of speech signals based on characteristics of short-time speech segments.Tomohiro Nakatani, Takafumi Hikichi, Keisuke Kinoshita, Takuya Yoshioka, Marc Delcroix, Masato Miyoshi, Biing-Hwang Juang
2006ICASSPOn the Use of Lime Dereverberation Algorithm in an Acoustic Environment With a Noise Source.Marc Delcroix, Takafumi Hikichi, Masato Miyoshi
2005ICASSPBlind Dereverberation based on Estimates of Signal Transmission Channels without Precise Information of Channel Order.Takafumi Hikichi, Marc Delcroix, Masato Miyoshi
2005InterspeechImproved blind dereverberation performance by using spatial information.Marc Delcroix, Takafumi Hikichi, Masato Miyoshi
2004InterspeechDereverberation of speech signals based on linear prediction.Marc Delcroix, Takafumi Hikichi, Masato Miyoshi