Skip to content

Erik McDermott

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

47

Venues

4

Active years

1989–2025

Best venue rank

A*

Where they publish

Papers

47 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPDelayed Fusion: Integrating Large Language Models into First-Pass Decoding in End-to-end Speech Recognition.Takaaki Hori, Martin Kocour, Adnan Haider, Erik McDermott, Xiaodan Zhuang
2023ICASSPNeural Transducer Training: Reduced Memory Consumption with Sample-Wise Computation.Stefan Braun, Erik McDermott, Roger Hsiao
2023ICASSPVariable Attention Masking for Configurable Transformer Transducer Speech Recognition.Pawel Swietojanski, Stefan Braun, Dogan Can, Thiago Fraga da Silva, Arnab Ghoshal, Takaaki Hori, Roger Hsiao, Henry Mason, Erik McDermott, Honza Silovsky, Ruchir Travadi, Xiaodan Zhuang
2020ICASSPTransformer Transducer: A Streamable Speech Recognition Model with Transformer Encoders and RNN-T Loss.Qian Zhang, Han Lu, Hasim Sak, Anshuman Tripathi, Erik McDermott, Stephen Koo, Shankar Kumar
2019ASRUA Density Ratio Approach to Language Model Fusion in End-to-End Automatic Speech Recognition.Erik McDermott, Hasim Sak, Ehsan Variani
2018ICASSPSampled Connectionist Temporal Classification.Ehsan Variani, Tom Bagby, Kamel Lahouel, Erik McDermott, Michiel Bacchiani
2017InterspeechAcoustic Modeling for Google Home.Bo Li, Tara N. Sainath, Arun Narayanan, Joe Caroselli, Michiel Bacchiani, Ananya Misra, Izhak Shafran, Hasim Sak, Golan Pundak, Kean K. Chin, Khe Chai Sim, Ron J. Weiss, Kevin W. Wilson, Ehsan Variani, Chanwoo Kim, Olivier Siohan, Mitchel Weintraub, Erik McDermott, Richard Rose, Matt Shannon
2017InterspeechEnd-to-End Training of Acoustic Models for Large Vocabulary Continuous Speech Recognition with TensorFlow.Ehsan Variani, Tom Bagby, Erik McDermott, Michiel Bacchiani
2015ICASSPA Gaussian Mixture Model layer jointly optimized with discriminative features within a Deep Neural Network architecture.Ehsan Variani, Erik McDermott, Georg Heigold
2014ICASSPAsynchronous stochastic optimization for sequence training of deep neural networks.Georg Heigold, Erik McDermott, Vincent Vanhoucke, Andrew W. Senior, Michiel Bacchiani
2014ICASSPDeep neural networks for small footprint text-dependent speaker verification.Ehsan Variani, Xin Lei, Erik McDermott, Ignacio Lpez-Moreno, Javier Gonzalez-Dominguez
2014InterspeechAsynchronous stochastic optimization for sequence training of deep neural networks: towards big data.Erik McDermott, Georg Heigold, Pedro J. Moreno, Andrew W. Senior, Michiel Bacchiani
2014InterspeechSequence discriminative distributed training of long short-term memory recurrent neural networks.Hasim Sak, Oriol Vinyals, Georg Heigold, Andrew W. Senior, Erik McDermott, Rajat Monga, Mark Z. Mao
2013ASRULarge scale deep neural network acoustic modeling with semi-supervised training data for YouTube video transcription.Hank Liao, Erik McDermott, Andrew W. Senior
2010ICASSPDiscriminative training based on an integrated view of MPE and MMI in margin and error space.Erik McDermott, Shinji Watanabe, Atsushi Nakamura
2010ICASSPA discriminative model for continuous speech recognition based on Weighted Finite State Transducers.Shinji Watanabe, Takaaki Hori, Erik McDermott, Atsushi Nakamura
2010ICASSPMinimum Error Classification with geometric margin control.Hideyuki Watanabe, Shigeru Katagiri, Kouta Yamada, Erik McDermott, Atsushi Nakamura, Shinji Watanabe, Miho Ohsaki
2009ICASSPA unified view for discriminative objective functions based on negative exponential of difference measure between strings.Atsushi Nakamura, Erik McDermott, Shinji Watanabe, Shigeru Katagiri
2009InterspeechMargin-space integration of MPE loss via differencing of MMI functionals for generalized error-weighted discriminative training.Erik McDermott, Shinji Watanabe, Atsushi Nakamura
2008InterspeechFlexible discriminative training based on equal error group scores obtained from an error-indexed forward-backward algorithm.Erik McDermott, Atsushi Nakamura
2007InterspeechDiscriminative MCE-based speaker adaptation of acoustic models for a spoken lecture processing task.Timothy J. Hazen, Erik McDermott
2007InterspeechString and lattice based discriminative training for the corpus of spontaneous Japanese lecture transcription task.Erik McDermott, Atsushi Nakamura
2006ACLTraining Conditional Random Fields with Multivariate Evaluation Measures.Jun Suzuki, Erik McDermott, Hideki Isozaki
2005ICASSPMinimum Classification Error for Large Scale Speech Recognition Tasks using Weighted Finite State Transducers.Erik McDermott, Shigeru Katagiri
2005InterspeechOptimization methods for discriminative training.Jonathan Le Roux, Erik McDermott
2004ICASSPMinimum classification error training of landmark models for real-time continuous speech recognition.Erik McDermott, Timothy J. Hazen
2004InterspeechA theoretical analysis of speech recognition based on feature trajectory models.Yasuhiro Minami, Erik McDermott, Atsushi Nakamura, Shigeru Katagiri
2003ICASSPA new formalization of minimum classification error using a Parzen estimate of classification chance.Erik McDermott, Shigeru Katagiri
2003ICASSPRecognition method with parametric trajectory generated from mixture distribution HMMs.Yasuhiro Minami, Erik McDermott, Atsushi Nakamura, Shigeru Katagiri
2003ICASSPPervasive unsupervised adaptation for lecture speech transcription.Daniel Willett, Thomas Niesler, Erik McDermott, Yasuhiro Minami, Shigeru Katagiri
2003InterspeechBlind inversion of multidimensional functions for speech enhancement.John Hogden, Patrick Valdez, Shigeru Katagiri, Erik McDermott
2002ICASSPA recognition method with parametric trajectory synthesized using direct relations between static and dynamic feature vector time series.Yasuhiro Minami, Erik McDermott, Atsushi Nakamura, Shigeru Katagiri
2002InterspeechClassification error from the theoretical Bayes classification risk.Erik McDermott, Shigeru Katagiri
2001InterspeechTime and memory efficient viterbi decoding for LVCSR using a precompiled search network.Daniel Willett, Erik McDermott, Yasuhiro Minami, Shigeru Katagiri
2000ICASSPDiscriminative training for large vocabulary telephone-based name recognition.Erik McDermott, Alain Biem, Seiichi Tenpaku, Shigeru Katagiri
1998InterspeechComputer-based second language production training by using spectrographic representation and HMM-based speech recognition scores.Reiko Akahane-Yamada, Erik McDermott, Takahiro Adachi, Hideki Kawahara, John S. Pruitt
1997ICASSPEfficient normalization based upon GPD [generalized probabilistic descent].Eric A. Woudenberg, Alain Biem, Erik McDermott, Shigeru Katagiri
1997InterspeechString-level MCE for continuous phoneme recognition.Erik McDermott, Shigeru Katagiri
1996ICASSPA telephone-based directory assistance system adaptively trained using minimum classification error/generalized probabilistic descent.Erik McDermott, Eric A. Woudenberg, Shigeru Katagiri
1995InterspeechA discriminative filter bank model for speech recognition.Alain Biem, Erik McDermott, Shigeru Katagiri
1993ICASSPPrototype-based MCE/GPD training for word spotting and connected word recognition.Erik McDermott, Shigeru Katagiri
1992ICASSPPrototype-based discriminative training for various speech units.Erik McDermott, Shigeru Katagiri
1991ICASSPSpeaker-independent large vocabulary word recognition using an LVQ/HMM hybrid algorithm.Hitoshi Iwamida, Shigeru Katagiri, Erik McDermott
1990ICASSPA hybrid speech recognition system using HMMs with an LVQ-trained codebook.Hitoshi Iwamida, Shigeru Katagiri, Erik McDermott, Yoh'ichi Tohkura
1990InterspeechOn the robustness of HMM and ANN speech recognition algorithms.Yasuhiro Minami, Toshiyuki Hanazawa, Hitoshi Iwamida, Erik McDermott, Kiyohiro Shikano, Shigeru Katagiri, Masaona Kagawa
1989ICASSPA new algorithm for representing acoustic feature dynamics.Shigeru Katagiri, Erik McDermott, Manami Yokota
1989ICASSPShift-invariant, multi-category phoneme recognition using Kohonen's LVQ2.Erik McDermott, Shigeru Katagiri