| 2025 | ICASSP | Transducer-Llama: Integrating LLMs into Streamable Transducer-based Speech Recognition. | Keqi Deng, Jinxi Guo, Yingyi Ma, Niko Moritz, Philip C. Woodland, Ozlem Kalinli, Mike Seltzer |
| 2025 | ICASSP | Directional Source Separation for Robust Speech Recognition on Smart Glasses. | Tiantian Feng, Ju Lin, Yiteng Huang, Weipeng He, Kaustubh Kalgaonkar, Niko Moritz, Li Wan, Xin Lei, Ming Sun, Frank Seide |
| 2025 | ICASSP | Transcribing and Translating, Fast and Slow: Joint Speech Translation and Recognition. | Niko Moritz, Ruiming Xie, Yashesh Gaur, Ke Li, Simone Merello, Zeeshan Ahmed, Frank Seide, Christian Fuegen |
| 2025 | ICASSP | M-BEST-RQ: A Multi-Channel Speech Foundation Model for Smart Glasses. | Yufeng Yang, Desh Raj, Ju Lin, Niko Moritz, Junteng Jia, Gil Keren, Egor Lakomkin, Yiteng Huang, Jacob Donley, Jay Mahadeokar, Ozlem Kalinli |
| 2025 | ICASSP | Textless Streaming Speech-to-Speech Translation using Semantic Speech Tokens. | Jinzheng Zhao, Niko Moritz, Egor Lakomkin, Ruiming Xie, Zhiping Xiu, Katerina Zmolkov, Zeeshan Ahmed, Yashesh Gaur, Duc Le, Christian Fuegen |
| 2024 | ICASSP | Effective Internal Language Model Training and Fusion for Factorized Transducer Model. | Jinxi Guo, Niko Moritz, Yingyi Ma, Frank Seide, Chunyang Wu, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer |
| 2024 | ICASSP | AGADIR: Towards Array-Geometry Agnostic Directional Speech Recognition. | Ju Lin, Niko Moritz, Yiteng Huang, Ruiming Xie, Ming Sun, Christian Fuegen, Frank Seide |
| 2023 | CVPR | SynthVSR: Scaling Up Visual Speech RecognitionWith Synthetic Supervision. | Xubo Liu, Egor Lakomkin, Konstantinos Vougioukas, Pingchuan Ma, Honglie Chen, Ruiming Xie, Morrie Doulaty, Niko Moritz, Jchym Kolr, Stavros Petridis, Maja Pantic, Christian Fuegen |
| 2023 | ICASSP | Anchored Speech Recognition with Neural Transducers. | Desh Raj, Junteng Jia, Jay Mahadeokar, Chunyang Wu, Niko Moritz, Xiaohui Zhang, Ozlem Kalinli |
| 2023 | Interspeech | Streaming Audio-Visual Speech Recognition with Alignment Regularization. | Pingchuan Ma, Niko Moritz, Stavros Petridis, Christian Fuegen, Maja Pantic |
| 2023 | Interspeech | Directional Speech Recognition for Speaker Disambiguation and Cross-talk Suppression. | Ju Lin, Niko Moritz, Ruiming Xie, Kaustubh Kalgaonkar, Christian Fuegen, Frank Seide |
| 2022 | ICASSP | Extended Graph Temporal Classification for Multi-Speaker End-to-End ASR. | Xuankai Chang, Niko Moritz, Takaaki Hori, Shinji Watanabe, Jonathan Le Roux |
| 2022 | ICASSP | Advancing Momentum Pseudo-Labeling with Conformer and Initialization Strategy. | Yosuke Higuchi, Niko Moritz, Jonathan Le Roux, Takaaki Hori |
| 2022 | ICASSP | Sequence Transduction with Graph-Based Supervision. | Niko Moritz, Takaaki Hori, Shinji Watanabe, Jonathan Le Roux |
| 2021 | ICASSP | Unsupervised Domain Adaptation for Speech Recognition via Uncertainty Driven Self-Training. | Sameer Khurana, Niko Moritz, Takaaki Hori, Jonathan Le Roux |
| 2021 | ICASSP | Capturing Multi-Resolution Context by Dilated Self-Attention. | Niko Moritz, Takaaki Hori, Jonathan Le Roux |
| 2021 | ICASSP | Semi-Supervised Speech Recognition Via Graph-Based Temporal Classification. | Niko Moritz, Takaaki Hori, Jonathan Le Roux |
| 2021 | Interspeech | Momentum Pseudo-Labeling for Semi-Supervised Speech Recognition. | Yosuke Higuchi, Niko Moritz, Jonathan Le Roux, Takaaki Hori |
| 2021 | Interspeech | Advanced Long-Context End-to-End Speech Recognition Using Context-Expanded Transformers. | Takaaki Hori, Niko Moritz, Chiori Hori, Jonathan Le Roux |
| 2021 | Interspeech | Dual Causal/Non-Causal Self-Attention for Streaming End-to-End Speech Recognition. | Niko Moritz, Takaaki Hori, Jonathan Le Roux |
| 2020 | ICASSP | Streaming Automatic Speech Recognition with the Transformer Model. | Niko Moritz, Takaaki Hori, Jonathan Le Roux |
| 2020 | ICASSP | Unsupervised Speaker Adaptation Using Attention-Based Speaker Memory for End-to-End ASR. | Leda Sari, Niko Moritz, Takaaki Hori, Jonathan Le Roux |
| 2020 | Interspeech | Transformer-Based Long-Context End-to-End Speech Recognition. | Takaaki Hori, Niko Moritz, Chiori Hori, Jonathan Le Roux |
| 2020 | Interspeech | All-in-One Transformer: Unifying Speech Recognition, Audio Tagging, and Event Detection. | Niko Moritz, Gordon Wichern, Takaaki Hori, Jonathan Le Roux |
| 2019 | ASRU | Streaming End-to-End Speech Recognition with Joint CTC-Attention Based Models. | Niko Moritz, Takaaki Hori, Jonathan Le Roux |
| 2019 | ICASSP | Triggered Attention for End-to-end Speech Recognition. | Niko Moritz, Takaaki Hori, Jonathan Le Roux |
| 2019 | Interspeech | Unidirectional Neural Network Architectures for End-to-End Automatic Speech Recognition. | Niko Moritz, Takaaki Hori, Jonathan Le Roux |
| 2019 | Interspeech | Vectorized Beam Search for CTC-Attention-Based Speech Recognition. | Hiroshi Seki, Takaaki Hori, Shinji Watanabe, Niko Moritz, Jonathan Le Roux |
| 2016 | Interspeech | Probabilistic Spatial Filter Estimation for Signal Enhancement in Multi-Channel Automatic Speech Recognition. | Hendrik Kayser, Niko Moritz, Jrn Anemller |
| 2015 | ASRU | A CHiME-3 challenge system: Long-term acoustic features for noise robust automatic speech recognition. | Niko Moritz, Stephan Gerlach, Kamil Adiloglu, Jrn Anemller, Birger Kollmeier, Stefan Goetze |
| 2014 | Interspeech | Should deep neural nets have ears? the role of auditory features in deep learning approaches. | Angel Mario Castro Martinez, Niko Moritz, Bernd T. Meyer |
| 2013 | MICCAI | Analysis of Trabecular Bone Microstructure Using Contour Tree Connectivity. | Dogu Baran Aydogan, Niko Moritz, Hannu T. Aro, Jari A. K. Hyttinen |
| 2012 | ACL | Multimodal Human-Machine Interaction for Service Robots in Home-Care Environments. | Stefan Goetze, Sven Fischer, Niko Moritz, Jens-E. Appell, Frank Wallhoff |
| 2012 | Interspeech | Amplitude Modulation Filters as Feature Sets for Robust ASR: Constant Absolute or Relative Bandwidth? | Niko Moritz, Jrn Anemller, Birger Kollmeier |
| 2011 | ICASSP | Amplitude modulation spectrogram based features for robust speech recognition in noisy and reverberant environments. | Niko Moritz, Jrn Anemller, Birger Kollmeier |