Skip to content

Takaaki Hori

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

96

Venues

7

Active years

2001–2025

Best venue rank

A*

Where they publish

Papers

96 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPDelayed Fusion: Integrating Large Language Models into First-Pass Decoding in End-to-end Speech Recognition.Takaaki Hori, Martin Kocour, Adnan Haider, Erik McDermott, Xiaodan Zhuang
2023ICASSPVariable Attention Masking for Configurable Transformer Transducer Speech Recognition.Pawel Swietojanski, Stefan Braun, Dogan Can, Thiago Fraga da Silva, Arnab Ghoshal, Takaaki Hori, Roger Hsiao, Henry Mason, Erik McDermott, Honza Silovsky, Ruchir Travadi, Xiaodan Zhuang
2022ICASSPExtended Graph Temporal Classification for Multi-Speaker End-to-End ASR.Xuankai Chang, Niko Moritz, Takaaki Hori, Shinji Watanabe, Jonathan Le Roux
2022ICASSPAdvancing Momentum Pseudo-Labeling with Conformer and Initialization Strategy.Yosuke Higuchi, Niko Moritz, Jonathan Le Roux, Takaaki Hori
2022ICASSPSequence Transduction with Graph-Based Supervision.Niko Moritz, Takaaki Hori, Shinji Watanabe, Jonathan Le Roux
2022ICASSPAudio-Visual Scene-Aware Dialog and Reasoning Using Audio-Visual Transformers with Joint Student-Teacher Learning.Ankit P. Shah, Shijie Geng, Peng Gao, Anoop Cherian, Takaaki Hori, Tim K. Marks, Jonathan Le Roux, Chiori Hori
2022InterspeechLow-Latency Online Streaming VideoQA Using Audio-Visual Transformers.Chiori Hori, Takaaki Hori, Jonathan Le Roux
2021ICASSPUnsupervised Domain Adaptation for Speech Recognition via Uncertainty Driven Self-Training.Sameer Khurana, Niko Moritz, Takaaki Hori, Jonathan Le Roux
2021ICASSPCapturing Multi-Resolution Context by Dilated Self-Attention.Niko Moritz, Takaaki Hori, Jonathan Le Roux
2021ICASSPSemi-Supervised Speech Recognition Via Graph-Based Temporal Classification.Niko Moritz, Takaaki Hori, Jonathan Le Roux
2021InterspeechMomentum Pseudo-Labeling for Semi-Supervised Speech Recognition.Yosuke Higuchi, Niko Moritz, Jonathan Le Roux, Takaaki Hori
2021InterspeechOptimizing Latency for Online Video Captioning Using Audio-Visual Transformers.Chiori Hori, Takaaki Hori, Jonathan Le Roux
2021InterspeechAdvanced Long-Context End-to-End Speech Recognition Using Context-Expanded Transformers.Takaaki Hori, Niko Moritz, Chiori Hori, Jonathan Le Roux
2021InterspeechDual Causal/Non-Causal Self-Attention for Streaming End-to-End Speech Recognition.Niko Moritz, Takaaki Hori, Jonathan Le Roux
2020ICASSPStreaming Automatic Speech Recognition with the Transformer Model.Niko Moritz, Takaaki Hori, Jonathan Le Roux
2020ICASSPUnsupervised Speaker Adaptation Using Attention-Based Speaker Memory for End-to-End ASR.Leda Sari, Niko Moritz, Takaaki Hori, Jonathan Le Roux
2020InterspeechTransformer-Based Long-Context End-to-End Speech Recognition.Takaaki Hori, Niko Moritz, Chiori Hori, Jonathan Le Roux
2020InterspeechAll-in-One Transformer: Unifying Speech Recognition, Audio Tagging, and Event Detection.Niko Moritz, Gordon Wichern, Takaaki Hori, Jonathan Le Roux
2019ASRUA Comparative Study on Transformer vs RNN in Speech Applications.Shigeki Karita, Xiaofei Wang, Shinji Watanabe, Takenori Yoshimura, Wangyou Zhang, Nanxin Chen, Tomoki Hayashi, Takaaki Hori, Hirofumi Inaguma, Ziyan Jiang, Masao Someki, Nelson Enrique Yalta Soplin, Ryuichi Yamamoto
2019ASRUStreaming End-to-End Speech Recognition with Joint CTC-Attention Based Models.Niko Moritz, Takaaki Hori, Jonathan Le Roux
2019ICASSPPromising Accurate Prefix Boosting for Sequence-to-sequence ASR.Murali Karthick Baskar, Luks Burget, Shinji Watanabe, Martin Karafit, Takaaki Hori, Jan Honza Cernock
2019ICASSPLanguage Model Integration Based on Memory Control for Sequence to Sequence Speech Recognition.Jaejin Cho, Shinji Watanabe, Takaaki Hori, Murali Karthick Baskar, Hirofumi Inaguma, Jess Villalba, Najim Dehak
2019ICASSPEnd-to-end Audio Visual Scene-aware Dialog Using Multimodal Attention-based Video Features.Chiori Hori, Huda AlAmri, Jue Wang, Gordon Wichern, Takaaki Hori, Anoop Cherian, Tim K. Marks, Vincent Cartillier, Raphael Gontijo Lopes, Abhishek Das, Irfan Essa, Dhruv Batra, Devi Parikh
2019ICASSPCycle-consistency Training for End-to-end Speech Recognition.Takaaki Hori, Ramn Fernandez Astudillo, Tomoki Hayashi, Yu Zhang, Shinji Watanabe, Jonathan Le Roux
2019ICASSPTriggered Attention for End-to-end Speech Recognition.Niko Moritz, Takaaki Hori, Jonathan Le Roux
2019ICASSPStream Attention-based Multi-array End-to-end Speech Recognition.Xiaofei Wang, Ruizhi Li, Sri Harish Mallidi, Takaaki Hori, Shinji Watanabe, Hynek Hermansky
2019InterspeechSemi-Supervised Sequence-to-Sequence ASR Using Unpaired Speech and Text.Murali Karthick Baskar, Shinji Watanabe, Ramn Fernandez Astudillo, Takaaki Hori, Luks Burget, Jan Cernock
2019InterspeechJoint Student-Teacher Learning for Audio-Visual Scene-Aware Dialog.Chiori Hori, Anoop Cherian, Tim K. Marks, Takaaki Hori
2019InterspeechAnalysis of Multilingual Sequence-to-Sequence Speech Recognition Systems.Martin Karafit, Murali Karthick Baskar, Shinji Watanabe, Takaaki Hori, Matthew Wiesner, Jan Cernock
2019InterspeechUnidirectional Neural Network Architectures for End-to-End Automatic Speech Recognition.Niko Moritz, Takaaki Hori, Jonathan Le Roux
2019InterspeechVectorized Beam Search for CTC-Attention-Based Speech Recognition.Hiroshi Seki, Takaaki Hori, Shinji Watanabe, Niko Moritz, Jonathan Le Roux
2019InterspeechEnd-to-End Multilingual Multi-Speaker Speech Recognition.Hiroshi Seki, Takaaki Hori, Shinji Watanabe, Jonathan Le Roux, John R. Hershey
2018ACLA Purely End-to-End System for Multi-speaker Speech Recognition.Hiroshi Seki, Takaaki Hori, Shinji Watanabe, Jonathan Le Roux, John R. Hershey
2018CVPRMultimodal Attention for Fusion of Audio and Spatiotemporal Features for Video Description.Chiori Hori, Takaaki Hori, Gordon Wichern, Jue Wang, Teng-Yok Lee, Anoop Cherian, Tim K. Marks
2018ICASSPSpeaker Adaptation for Multichannel End-to-End Speech Recognition.Tsubasa Ochiai, Shinji Watanabe, Shigeru Katagiri, Takaaki Hori, John R. Hershey
2018ICASSPAn End-to-End Language-Tracking Speech Recognizer for Mixed-Language Speech.Hiroshi Seki, Shinji Watanabe, Takaaki Hori, Jonathan Le Roux, John R. Hershey
2018ICASSPEnd-to-End Multi-Speaker Speech Recognition.Shane Settle, Jonathan Le Roux, Takaaki Hori, Shinji Watanabe, John R. Hershey
2018InterspeechESPnet: End-to-End Speech Processing Toolkit.Shinji Watanabe, Takaaki Hori, Shigeki Karita, Tomoki Hayashi, Jiro Nishitoba, Yuya Unno, Nelson Enrique Yalta Soplin, Jahn Heymann, Matthew Wiesner, Nanxin Chen, Adithya Renduchintala, Tsubasa Ochiai
2017ACLJoint CTC/attention decoding for end-to-end speech recognition.Takaaki Hori, Shinji Watanabe, John R. Hershey
2017ASRUEarly and late integration of audio features for automatic video description.Chiori Hori, Takaaki Hori, Tim K. Marks, John R. Hershey
2017ASRUMulti-level language modeling and decoding for open vocabulary end-to-end speech recognition.Takaaki Hori, Shinji Watanabe, John R. Hershey
2017ASRULanguage independent end-to-end architecture for joint language identification and speech recognition.Shinji Watanabe, Takaaki Hori, John R. Hershey
2017ICASSPBLSTM-HMM hybrid system combined with sound activity detection network for polyphonic Sound Event Detection.Tomoki Hayashi, Shinji Watanabe, Tomoki Toda, Takaaki Hori, Jonathan Le Roux, Kazuya Takeda
2017ICASSPJoint CTC-attention based end-to-end speech recognition using multi-task learning.Suyoun Kim, Takaaki Hori, Shinji Watanabe
2017ICASSPStudent-teacher network learning with enhanced features.Shinji Watanabe, Takaaki Hori, Jonathan Le Roux, John R. Hershey
2017ICCVAttention-Based Multimodal Fusion for Video Description.Chiori Hori, Takaaki Hori, Teng-Yok Lee, Ziming Zhang, Bret Harsham, John R. Hershey, Tim K. Marks, Kazuhiro Sumi
2017ICMLMultichannel End-to-end Speech Recognition.Tsubasa Ochiai, Shinji Watanabe, Takaaki Hori, John R. Hershey
2017InterspeechAdvances in Joint CTC-Attention Based End-to-End Speech Recognition with a Deep CNN Encoder and RNN-LM.Takaaki Hori, Shinji Watanabe, Yu Zhang, William Chan
2016ICASSPMinimum word error training of long short-term memory recurrent neural network language models for speech recognition.Takaaki Hori, Chiori Hori, Shinji Watanabe, John R. Hershey
2016InterspeechContext-Sensitive and Role-Dependent Spoken Language Understanding Using Bidirectional and Attention LSTMs.Chiori Hori, Takaaki Hori, Shinji Watanabe, John R. Hershey
2015ASRUThe MERL/SRI system for the 3RD CHiME challenge using beamforming, robust feature extraction, and advanced speech recognition.Takaaki Hori, Zhuo Chen, Hakan Erdogan, John R. Hershey, Jonathan Le Roux, Vikramjit Mitra, Shinji Watanabe
2015ICASSPDouble-layer neighborhood graph based similarity search for fast query-by-example spoken term detection.Kazuo Aoyama, Atsunori Ogawa, Takashi Hattori, Takaaki Hori
2015ICASSPContext adaptive deep neural networks for fast acoustic model adaptation.Marc Delcroix, Keisuke Kinoshita, Takaaki Hori, Tomohiro Nakatani
2015ICASSPWFST-based structural classification integrating dnn acoustic features and RNN language features for speech recognition.Quoc Truong Do, Satoshi Nakamura, Marc Delcroix, Takaaki Hori
2015ICASSPASR error detection and recognition rate estimation using deep bidirectional recurrent neural networks.Atsunori Ogawa, Takaaki Hori
2015InterspeechMultiscale recurrent neural network based language model.Tsuyoshi Morioka, Tomoharu Iwata, Takaaki Hori, Tetsunori Kobayashi
2014ICASSPZero-resource spoken term detection using hierarchical graph-based similarity search.Kazuo Aoyama, Atsunori Ogawa, Takashi Hattori, Takaaki Hori, Atsushi Nakamura
2014ICASSPReal-time one-pass decoding with recurrent neural network language model for speech recognition.Takaaki Hori, Yotaro Kubo, Atsushi Nakamura
2014ICASSPFast segment search for corpus-based speech enhancement based on speech recognition technology.Atsunori Ogawa, Keisuke Kinoshita, Takaaki Hori, Tomohiro Nakatani, Atsushi Nakamura
2014InterspeechRestructuring output layers of deep neural networks using minimum risk parameter clustering.Yotaro Kubo, Jun Suzuki, Takaaki Hori, Atsushi Nakamura
2013ICASSPGraph index based query-by-example search on a large speech data set.Kazuo Aoyama, Atsunori Ogawa, Takashi Hattori, Takaaki Hori, Atsushi Nakamura
2013ICASSPFeature space variational Bayesian linear regression and its combination with model space VBLR.Seong-Jun Hahm, Atsunori Ogawa, Marc Delcroix, Masakiyo Fujimoto, Takaaki Hori, Atsushi Nakamura
2013ICASSPLarge vocabulary continuous speech recognition based on WFST structured classifiers and deep bottleneck features.Yotaro Kubo, Takaaki Hori, Atsushi Nakamura
2013ICASSPCoupling beamforming with spatial and spectral feature based spectral enhancement and its application to meeting recognition.Tomohiro Nakatani, Mehrez Souden, Shoko Araki, Takuya Yoshioka, Takaaki Hori, Atsunori Ogawa
2013ICASSPDiscriminative recognition rate estimation for N-best list and its application to N-best rescoring.Atsunori Ogawa, Takaaki Hori, Atsushi Nakamura
2013InterspeechA method for structure estimation of weighted finite-state transducers and its application to grapheme-to-phoneme conversion.Yotaro Kubo, Takaaki Hori, Atsushi Nakamura
2013InterspeechUnsupervised discriminative language modeling using error rate estimator.Takanobu Oba, Atsunori Ogawa, Takaaki Hori, Hirokazu Masataki, Atsushi Nakamura
2012ICASSPHandling uncertain observations in unsupervised topic-mixture language model adaptation.Ekapol Chuangsuwanich, Shinji Watanabe, Takaaki Hori, Tomoharu Iwata, James R. Glass
2012ICASSPSpoken document retrieval by discriminative modeling in a high dimensional feature space.Takanobu Oba, Takaaki Hori, Atsushi Nakamura, Akinori Ito
2012ICASSPError type classification and word accuracy estimation using alignment features from word confusion network.Atsunori Ogawa, Takaaki Hori, Atsushi Nakamura
2012ICASSPBag Of ARCS: New representation of speech segment features based on finite state machines.Shinji Watanabe, Yotaro Kubo, Takanobu Oba, Takaaki Hori, Atsushi Nakamura
2012InterspeechSpeaker Adaptation Using Variational Bayesian Linear Regression in Normalized Feature Space.Seong-Jun Hahm, Atsunori Ogawa, Masakiyo Fujimoto, Takaaki Hori, Atsushi Nakamura
2012InterspeechEfficient Beam Width Control to Suppress Excessive Speech Recognition Computation Time Based on Prior Score Range Normalization.Satoshi Kobashikawa, Takaaki Hori, Yoshikazu Yamaguchi, Taichi Asami, Hirokazu Masataki, Satoshi Takahashi
2012InterspeechIntegrating Deep Neural Networks into Structural Classification Approach based on Weighted Finite-State Transducers.Yotaro Kubo, Takaaki Hori, Atsushi Nakamura
2011ICASSPRound-robin duel discriminative language models in one-pass decoding with on-the-fly error correction.Takanobu Oba, Takaaki Hori, Akinori Ito, Atsushi Nakamura
2011ICASSPGibbs sampling based Multi-scale Mixture Model for speaker clustering.Shinji Watanabe, Daichi Mochihashi, Takaaki Hori, Atsushi Nakamura
2010ICASSPSearch error risk minimization in Viterbi beam search for speech recognition.Takaaki Hori, Shinji Watanabe, Atsushi Nakamura
2010ICASSPA comparative study on methods of Weighted language model training for reranking lvcsr N-best hypotheses.Takanobu Oba, Takaaki Hori, Atsushi Nakamura
2010ICASSPA discriminative model for continuous speech recognition based on Weighted Finite State Transducers.Shinji Watanabe, Takaaki Hori, Erik McDermott, Atsushi Nakamura
2010InterspeechImprovements of search error risk minimization in viterbi beam search for speech recognition.Takaaki Hori, Shinji Watanabe, Atsushi Nakamura
2010InterspeechRound-robin discrimination model for reranking ASR hypotheses.Takanobu Oba, Takaaki Hori, Atsushi Nakamura
2010InterspeechLarge vocabulary continuous speech recognition using WFST-based linear classifier for structured data.Shinji Watanabe, Takaaki Hori, Atsushi Nakamura
2007ICASSPOpen-Vocabulary Spoken Utterance Retrieval using Confusion Networks.Takaaki Hori, I. Lee Hetherington, Timothy J. Hazen, James R. Glass
2007InterspeechAn approach to efficient generation of high-accuracy and compact error-corrective models for speech recognition.Takanobu Oba, Takaaki Hori, Atsushi Nakamura
2006ICASSPAn Extremely Large Vocabulary Approach to Named Entity Extraction from Speech.Takaaki Hori, Atsushi Nakamura
2006InterspeechSentence boundary detection using sequential dependency analysis combined with CRF-based chunking.Takanobu Oba, Takaaki Hori, Atsushi Nakamura
2005ICASSPEfficient Generation of high-order context-dependent Weighted Finite State Transducers for Speech Recognition.Mike Schuster, Takaaki Hori
2005InterspeechGeneralized fast on-the-fly composition algorithm for WFST-based speech recognition.Takaaki Hori, Atsushi Nakamura
2005InterspeechExperiments with probabilistic principal component analysis in LVCSR.Mike Schuster, Takaaki Hori, Atsushi Nakamura
2004InterspeechFast on-the-fly composition for weighted finite-state transducers in 1.8 million-word vocabulary continuous speech recognition.Takaaki Hori, Chiori Hori, Yasuhiro Minami
2003ACLSpoken Interactive ODQA System: SPIQA.Chiori Hori, Takaaki Hori, Hajime Tsukada, Hideki Isozaki, Yutaka Sasaki, Eisaku Maeda
2003ICASSPDeriving disambiguous queries in a spoken interactive ODQA system.Chiori Hori, Takaaki Hori, Hideki Isozaki, Eisaku Maeda, Shigeru Katagiri, Sadaoki Furui
2003ICASSPLanguage model adaptation using WFST-based speaking-style translation.Takaaki Hori, Daniel Willett, Yasuhiro Minami
2003InterspeechEvaluation method for automatic speech summarization.Chiori Hori, Takaaki Hori, Sadaoki Furui
2003InterspeechSpeech summarization using weighted finite-state transducers.Takaaki Hori, Chiori Hori, Yasuhiro Minami
2001InterspeechImproved phoneme-history-dependent search for large-vocabulary continuous-speech recognition.Takaaki Hori, Yoshiaki Noda, Shoichi Matsunaga