| 2024 | ICASSP | What Do Self-Supervised Speech and Speaker Models Learn? New Findings from a Cross Model Layer-Wise Analysis. | Takanori Ashihara, Marc Delcroix, Takafumi Moriya, Kohei Matsuura, Taichi Asami, Yusuke Ijima |
| 2024 | Interspeech | Boosting Hybrid Autoregressive Transducer-based ASR with Internal Acoustic Model Training and Dual Blank Thresholding. | Takafumi Moriya, Takanori Ashihara, Masato Mimura, Hiroshi Sato, Kohei Matsuura, Ryo Masumura, Taichi Asami |
| 2023 | AAAI | An Improved Approximation Algorithm for Wage Determination and Online Task Allocation in Crowd-Sourcing. | Yuya Hikima, Yasunori Akagi, Hideaki Kim, Taichi Asami |
| 2023 | Interspeech | SpeechGLUE: How Well Can Self-Supervised Speech Models Capture Linguistic Knowledge? | Takanori Ashihara, Takafumi Moriya, Kohei Matsuura, Tomohiro Tanaka, Yusuke Ijima, Taichi Asami, Marc Delcroix, Yukinori Honma |
| 2023 | Interspeech | What are differences? Comparing DNN and Human by Their Performance and Characteristics in Speaker Age Estimation. | Yuki Kitagishi, Naohiro Tawara, Atsunori Ogawa, Ryo Masumura, Taichi Asami |
| 2023 | Interspeech | Knowledge Distillation for Neural Transducer-based Target-Speaker ASR: Exploiting Parallel Mixture/Single-Talker Speech Data. | Takafumi Moriya, Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Takanori Ashihara, Kohei Matsuura, Tomohiro Tanaka, Ryo Masumura, Atsunori Ogawa, Taichi Asami |
| 2021 | Interspeech | Streaming End-to-End Speech Recognition for Hybrid RNN-T/Attention Architecture. | Takafumi Moriya, Tomohiro Tanaka, Takanori Ashihara, Tsubasa Ochiai, Hiroshi Sato, Atsushi Ando, Ryo Masumura, Marc Delcroix, Taichi Asami |
| 2018 | ICASSP | Neural Confnet Classification: Fully Neural Network Based Spoken Utterance Classification Using Word Confusion Networks. | Ryo Masumura, Yusuke Ijima, Taichi Asami, Hirokazu Masataki, Ryuichiro Higashinaka |
| 2017 | ICASSP | Domain adaptation of DNN acoustic models using knowledge distillation. | Taichi Asami, Ryo Masumura, Yoshikazu Yamaguchi, Hirokazu Masataki, Yushi Aono |
| 2017 | ICASSP | Cross-modal transfer with neural word vectors for image feature learning. | Go Irie, Taichi Asami, Shuhei Tarashima, Takayuki Kurozumi, Tetsuya Kinebuchi |
| 2017 | ICASSP | Parallel phonetically aware DNNs and LSTM-RNNS for frame-by-frame discriminative modeling of spoken language identification. | Ryo Masumura, Taichi Asami, Hirokazu Masataki, Yushi Aono |
| 2017 | ICASSP | Cumulative moving averaged bottleneck speaker vectors for online speaker adaptation of CNN-based acoustic models. | Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Atsunori Ogawa, Taichi Asami, Shigeru Katagiri, Tomohiro Nakatani |
| 2017 | IJCNLP | Hyperspherical Query Likelihood Models with Word Embeddings. | Ryo Masumura, Taichi Asami, Hirokazu Masataki, Kugatsu Sadamitsu, Kyosuke Nishida, Ryuichiro Higashinaka |
| 2017 | Interspeech | Prosody Aware Word-Level Encoder Based on BLSTM-RNNs for DNN-Based Speech Synthesis. | Yusuke Ijima, Nobukatsu Hojo, Ryo Masumura, Taichi Asami |
| 2017 | Interspeech | Online End-of-Turn Detection from Speech Based on Stacked Time-Asynchronous Sequential Networks. | Ryo Masumura, Taichi Asami, Hirokazu Masataki, Ryo Ishii, Ryuichiro Higashinaka |
| 2016 | Interspeech | Recurrent Out-of-Vocabulary Word Detection Using Distribution of Features. | Taichi Asami, Ryo Masumura, Yushi Aono, Koichi Shinoda |
| 2016 | Interspeech | Objective Evaluation Using Association Between Dimensions Within Spectral Features for Statistical Parametric Speech Synthesis. | Yusuke Ijima, Taichi Asami, Hideyuki Mizuno |
| 2016 | Interspeech | Language Identification Based on Generative Modeling of Posteriorgram Sequences Extracted from Frame-by-Frame DNNs and LSTM-RNNs. | Ryo Masumura, Taichi Asami, Hirokazu Masataki, Yushi Aono, Sumitaka Sakauchi |
| 2015 | EMNLP | Hierarchical Latent Words Language Models for Robust Modeling to Out-Of Domain Tasks. | Ryo Masumura, Taichi Asami, Takanobu Oba, Hirokazu Masataki, Sumitaka Sakauchi, Akinori Ito |
| 2015 | Interspeech | Agreement and disagreement utterance detection in conversational speech by extracting and integrating local features. | Atsushi Ando, Taichi Asami, Manabu Okamoto, Hirokazu Masataki, Sumitaka Sakauchi |
| 2015 | Interspeech | Training data selection for acoustic modeling via submodular optimization of joint kullback-leibler divergence. | Taichi Asami, Ryo Masumura, Hirokazu Masataki, Manabu Okamoto, Sumitaka Sakauchi |
| 2015 | Interspeech | Combinations of various language model technologies including data expansion and adaptation in spontaneous speech recognition. | Ryo Masumura, Taichi Asami, Takanobu Oba, Hirokazu Masataki, Sumitaka Sakauchi, Akinori Ito |
| 2015 | Interspeech | Latent words recurrent neural network language models. | Ryo Masumura, Taichi Asami, Takanobu Oba, Hirokazu Masataki, Sumitaka Sakauchi, Akinori Ito |
| 2014 | Interspeech | Read and spontaneous speech classification based on variance of GMM supervectors. | Taichi Asami, Ryo Masumura, Hirokazu Masataki, Sumitaka Sakauchi |
| 2014 | Interspeech | Mixture of latent words language models for domain adaptation. | Ryo Masumura, Taichi Asami, Takanobu Oba, Hirokazu Masataki, Sumitaka Sakauchi |
| 2013 | Interspeech | Unsupervised confidence calibration using examples of recognized words and their contexts. | Taichi Asami, Satoshi Kobashikawa, Hirokazu Masataki, Osamu Yoshioka, Satoshi Takahashi |
| 2012 | Interspeech | Speech Data Clustering Based on Phoneme Error Trend for Unsupervised Acoustic Model Adaptation. | Taichi Asami, Satoshi Kobashikawa, Hirokazu Masataki, Osamu Yoshioka, Satoshi Takahashi |
| 2012 | Interspeech | Efficient Beam Width Control to Suppress Excessive Speech Recognition Computation Time Based on Prior Score Range Normalization. | Satoshi Kobashikawa, Takaaki Hori, Yoshikazu Yamaguchi, Taichi Asami, Hirokazu Masataki, Satoshi Takahashi |
| 2011 | ICASSP | Extracting call-reason segments from contact center dialogs by using automatically acquired boundary expressions. | Takaaki Fukutomi, Satoshi Kobashikawa, Taichi Asami, Tsubasa Shinozaki, Hirokazu Masataki, Satoshi Takahashi |
| 2011 | Interspeech | Spoken Document Confidence Estimation Using Contextual Coherence. | Taichi Asami, Narichika Nomoto, Satoshi Kobashikawa, Yoshikazu Yamaguchi, Hirokazu Masataki, Satoshi Takahashi |
| 2010 | Interspeech | Efficient data selection for speech recognition based on prior confidence estimation using speech and context independent models. | Satoshi Kobashikawa, Taichi Asami, Yoshikazu Yamaguchi, Hirokazu Masataki, Satoshi Takahashi |
| 2006 | ICASSP | A Stream-Weight and Threshold Estimation Method Using Adaboost for Multi-Stream Speaker Verification. | Taichi Asami, Koji Iwano, Sadaoki Furui |
| 2005 | Interspeech | Stream-weight optimization by LDA and adaboost for multi-stream speaker verification. | Taichi Asami, Koji Iwano, Sadaoki Furui |
| 2004 | Interspeech | Noise-robust speaker verification using F0 features. | Koji Iwano, Taichi Asami, Sadaoki Furui |