Shigeki Karita
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
22
Venues
4
Active years
2015–2024
Best venue rank
A*
Where they publish
Papers
22 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2024 | Interspeech | FLEURS-R: A Restored Multilingual Speech Corpus for Generation Tasks. | Min Ma, Yuma Koizumi, Shigeki Karita, Heiga Zen, Jason Riesa, Haruko Ishikawa, Michiel Bacchiani |
| 2023 | Interspeech | LibriTTS-R: A Restored Multi-Speaker Text-to-Speech Corpus. | Yuma Koizumi, Heiga Zen, Shigeki Karita, Yifan Ding, Kohei Yatabe, Nobuyuki Morioka, Michiel Bacchiani, Yu Zhang, Wei Han, Ankur Bapna |
| 2022 | ICASSP | Knowledge Transfer from Large-Scale Pretrained Language Models to End-To-End Speech Recognizers. | Yotaro Kubo, Shigeki Karita, Michiel Bacchiani |
| 2022 | Interspeech | SNRi Target Training for Joint Speech Enhancement and Recognition. | Yuma Koizumi, Shigeki Karita, Arun Narayanan, Sankaran Panchapagesan, Michiel Bacchiani |
| 2021 | Interspeech | A Comparative Study on Neural Architectures and Training Methods for Japanese Speech Recognition. | Shigeki Karita, Yotaro Kubo, Michiel Adriaan Unico Bacchiani, Llion Jones |
| 2021 | Interspeech | Unsupervised Learning of Disentangled Speech Content and Style Representation. | Andros Tjandra, Ruoming Pang, Yu Zhang, Shigeki Karita |
| 2020 | ACL | ESPnet-ST: All-in-One Speech Translation Toolkit. | Hirofumi Inaguma, Shun Kiyono, Kevin Duh, Shigeki Karita, Nelson Yalta, Tomoki Hayashi, Shinji Watanabe |
| 2020 | Interspeech | Self-Distillation for Improving CTC-Transformer-Based ASR Systems. | Takafumi Moriya, Tsubasa Ochiai, Shigeki Karita, Hiroshi Sato, Tomohiro Tanaka, Takanori Ashihara, Ryo Masumura, Yusuke Shinohara, Marc Delcroix |
| 2019 | ASRU | A Comparative Study on Transformer vs RNN in Speech Applications. | Shigeki Karita, Xiaofei Wang, Shinji Watanabe, Takenori Yoshimura, Wangyou Zhang, Nanxin Chen, Tomoki Hayashi, Takaaki Hori, Hirofumi Inaguma, Ziyan Jiang, Masao Someki, Nelson Enrique Yalta Soplin, Ryuichi Yamamoto |
| 2019 | ICASSP | Semi-supervised End-to-end Speech Recognition Using Text-to-speech and Autoencoders. | Shigeki Karita, Shinji Watanabe, Tomoharu Iwata, Marc Delcroix, Atsunori Ogawa, Tomohiro Nakatani |
| 2019 | Interspeech | End-to-End SpeakerBeam for Single Channel Target Speech Recognition. | Marc Delcroix, Shinji Watanabe, Tsubasa Ochiai, Keisuke Kinoshita, Shigeki Karita, Atsunori Ogawa, Tomohiro Nakatani |
| 2019 | Interspeech | Improving Transformer-Based End-to-End Speech Recognition with Connectionist Temporal Classification and Language Model Integration. | Shigeki Karita, Nelson Enrique Yalta Soplin, Shinji Watanabe, Marc Delcroix, Atsunori Ogawa, Tomohiro Nakatani |
| 2019 | Interspeech | Improved Deep Duel Model for Rescoring N-Best Speech Recognition List Using Backward LSTMLM and Ensemble Encoders. | Atsunori Ogawa, Marc Delcroix, Shigeki Karita, Tomohiro Nakatani |
| 2018 | ICASSP | Frame-by-Frame Closed-Form Update for Mask-Based Adaptive MVDR Beamforming. | Takuya Higuchi, Keisuke Kinoshita, Nobutaka Ito, Shigeki Karita, Tomohiro Nakatani |
| 2018 | ICASSP | Sequence Training of Encoder-Decoder Model Using Policy Gradient for End-to-End Speech Recognition. | Shigeki Karita, Atsunori Ogawa, Marc Delcroix, Tomohiro Nakatani |
| 2018 | ICASSP | Rescoring N-Best Speech Recognition List Based on One-on-One Hypothesis Comparison Using Encoder-Classifier Model. | Atsunori Ogawa, Marc Delcroix, Shigeki Karita, Tomohiro Nakatani |
| 2018 | Interspeech | Auxiliary Feature Based Adaptation of End-to-end ASR Systems. | Marc Delcroix, Shinji Watanabe, Atsunori Ogawa, Shigeki Karita, Tomohiro Nakatani |
| 2018 | Interspeech | Semi-Supervised End-to-End Speech Recognition. | Shigeki Karita, Shinji Watanabe, Tomoharu Iwata, Atsunori Ogawa, Marc Delcroix |
| 2018 | Interspeech | ESPnet: End-to-End Speech Processing Toolkit. | Shinji Watanabe, Takaaki Hori, Shigeki Karita, Tomoki Hayashi, Jiro Nishitoba, Yuya Unno, Nelson Enrique Yalta Soplin, Jahn Heymann, Matthew Wiesner, Nanxin Chen, Adithya Renduchintala, Tsubasa Ochiai |
| 2017 | Interspeech | Forward-Backward Convolutional LSTM for Acoustic Modeling. | Shigeki Karita, Atsunori Ogawa, Marc Delcroix, Tomohiro Nakatani |
| 2017 | Interspeech | Unfolded Deep Recurrent Convolutional Neural Network with Jump Ahead Connections for Acoustic Modeling. | Dung T. Tran, Marc Delcroix, Shigeki Karita, Michael Hentschel, Atsunori Ogawa, Tomohiro Nakatani |
| 2015 | ICASSP | Far-field speech recognition using CNN-DNN-HMM with convolution in time. | Takuya Yoshioka, Shigeki Karita, Tomohiro Nakatani |