Skip to content

Shigeki Karita

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

22

Venues

4

Active years

2015–2024

Best venue rank

A*

Where they publish

Papers

22 indexed papers, newest first.

YearVenueTitleAuthors
2024InterspeechFLEURS-R: A Restored Multilingual Speech Corpus for Generation Tasks.Min Ma, Yuma Koizumi, Shigeki Karita, Heiga Zen, Jason Riesa, Haruko Ishikawa, Michiel Bacchiani
2023InterspeechLibriTTS-R: A Restored Multi-Speaker Text-to-Speech Corpus.Yuma Koizumi, Heiga Zen, Shigeki Karita, Yifan Ding, Kohei Yatabe, Nobuyuki Morioka, Michiel Bacchiani, Yu Zhang, Wei Han, Ankur Bapna
2022ICASSPKnowledge Transfer from Large-Scale Pretrained Language Models to End-To-End Speech Recognizers.Yotaro Kubo, Shigeki Karita, Michiel Bacchiani
2022InterspeechSNRi Target Training for Joint Speech Enhancement and Recognition.Yuma Koizumi, Shigeki Karita, Arun Narayanan, Sankaran Panchapagesan, Michiel Bacchiani
2021InterspeechA Comparative Study on Neural Architectures and Training Methods for Japanese Speech Recognition.Shigeki Karita, Yotaro Kubo, Michiel Adriaan Unico Bacchiani, Llion Jones
2021InterspeechUnsupervised Learning of Disentangled Speech Content and Style Representation.Andros Tjandra, Ruoming Pang, Yu Zhang, Shigeki Karita
2020ACLESPnet-ST: All-in-One Speech Translation Toolkit.Hirofumi Inaguma, Shun Kiyono, Kevin Duh, Shigeki Karita, Nelson Yalta, Tomoki Hayashi, Shinji Watanabe
2020InterspeechSelf-Distillation for Improving CTC-Transformer-Based ASR Systems.Takafumi Moriya, Tsubasa Ochiai, Shigeki Karita, Hiroshi Sato, Tomohiro Tanaka, Takanori Ashihara, Ryo Masumura, Yusuke Shinohara, Marc Delcroix
2019ASRUA Comparative Study on Transformer vs RNN in Speech Applications.Shigeki Karita, Xiaofei Wang, Shinji Watanabe, Takenori Yoshimura, Wangyou Zhang, Nanxin Chen, Tomoki Hayashi, Takaaki Hori, Hirofumi Inaguma, Ziyan Jiang, Masao Someki, Nelson Enrique Yalta Soplin, Ryuichi Yamamoto
2019ICASSPSemi-supervised End-to-end Speech Recognition Using Text-to-speech and Autoencoders.Shigeki Karita, Shinji Watanabe, Tomoharu Iwata, Marc Delcroix, Atsunori Ogawa, Tomohiro Nakatani
2019InterspeechEnd-to-End SpeakerBeam for Single Channel Target Speech Recognition.Marc Delcroix, Shinji Watanabe, Tsubasa Ochiai, Keisuke Kinoshita, Shigeki Karita, Atsunori Ogawa, Tomohiro Nakatani
2019InterspeechImproving Transformer-Based End-to-End Speech Recognition with Connectionist Temporal Classification and Language Model Integration.Shigeki Karita, Nelson Enrique Yalta Soplin, Shinji Watanabe, Marc Delcroix, Atsunori Ogawa, Tomohiro Nakatani
2019InterspeechImproved Deep Duel Model for Rescoring N-Best Speech Recognition List Using Backward LSTMLM and Ensemble Encoders.Atsunori Ogawa, Marc Delcroix, Shigeki Karita, Tomohiro Nakatani
2018ICASSPFrame-by-Frame Closed-Form Update for Mask-Based Adaptive MVDR Beamforming.Takuya Higuchi, Keisuke Kinoshita, Nobutaka Ito, Shigeki Karita, Tomohiro Nakatani
2018ICASSPSequence Training of Encoder-Decoder Model Using Policy Gradient for End-to-End Speech Recognition.Shigeki Karita, Atsunori Ogawa, Marc Delcroix, Tomohiro Nakatani
2018ICASSPRescoring N-Best Speech Recognition List Based on One-on-One Hypothesis Comparison Using Encoder-Classifier Model.Atsunori Ogawa, Marc Delcroix, Shigeki Karita, Tomohiro Nakatani
2018InterspeechAuxiliary Feature Based Adaptation of End-to-end ASR Systems.Marc Delcroix, Shinji Watanabe, Atsunori Ogawa, Shigeki Karita, Tomohiro Nakatani
2018InterspeechSemi-Supervised End-to-End Speech Recognition.Shigeki Karita, Shinji Watanabe, Tomoharu Iwata, Atsunori Ogawa, Marc Delcroix
2018InterspeechESPnet: End-to-End Speech Processing Toolkit.Shinji Watanabe, Takaaki Hori, Shigeki Karita, Tomoki Hayashi, Jiro Nishitoba, Yuya Unno, Nelson Enrique Yalta Soplin, Jahn Heymann, Matthew Wiesner, Nanxin Chen, Adithya Renduchintala, Tsubasa Ochiai
2017InterspeechForward-Backward Convolutional LSTM for Acoustic Modeling.Shigeki Karita, Atsunori Ogawa, Marc Delcroix, Tomohiro Nakatani
2017InterspeechUnfolded Deep Recurrent Convolutional Neural Network with Jump Ahead Connections for Acoustic Modeling.Dung T. Tran, Marc Delcroix, Shigeki Karita, Michael Hentschel, Atsunori Ogawa, Tomohiro Nakatani
2015ICASSPFar-field speech recognition using CNN-DNN-HMM with convolution in time.Takuya Yoshioka, Shigeki Karita, Tomohiro Nakatani