| 2024 | ICASSP | Talking Face Generation for Impression Conversion Considering Speech Semantics. | Saki Mizuno, Nobukatsu Hojo, Kazutoshi Shinoda, Keita Suzuki, Mana Ihori, Hiroshi Sato, Tomohiro Tanaka, Naotaka Kawata, Satoshi Kobashikawa, Ryo Masumura |
| 2024 | Interspeech | Learning from Multiple Annotator Biased Labels in Multimodal Conversation. | Kazutoshi Shinoda, Nobukatsu Hojo, Saki Mizuno, Keita Suzuki, Satoshi Kobashikawa, Ryo Masumura |
| 2023 | ICASSP | Modeling Lead-Lag Structure in Facial Expression Synchrony for Social-Psychological Outcome Prediction from Negotiation Interaction. | Nobukatsu Hojo, Saki Mizuno, Satoshi Kobashikawa, Ryo Masumura |
| 2023 | ICASSP | Next-Speaker Prediction Based on Non-Verbal Information in Multi-Party Video Conversation. | Saki Mizuno, Nobukatsu Hojo, Satoshi Kobashikawa, Ryo Masumura |
| 2023 | Interspeech | Audio-Visual Praise Estimation for Conversational Video based on Synchronization-Guided Multimodal Transformer. | Nobukatsu Hojo, Saki Mizuno, Satoshi Kobashikawa, Ryo Masumura, Mana Ihori, Hiroshi Sato, Tomohiro Tanaka |
| 2022 | LREC | Multimodal Negotiation Corpus with Various Subjective Assessments for Social-Psychological Outcome Prediction from Non-Verbal Cues. | Nobukatsu Hojo, Satoshi Kobashikawa, Saki Mizuno, Ryo Masumura |
| 2020 | ICASSP | Improving Speaker-Attribute Estimation by Voting Based on Speaker Cluster Information. | Naohiro Tawara, Hosana Kamiyama, Satoshi Kobashikawa, Atsunori Ogawa |
| 2019 | Interspeech | Does the Lombard Effect Improve Emotional Communication in Noise? - Analysis of Emotional Speech Acted in Noise. | Yi Zhao, Atsushi Ando, Shinji Takaki, Junichi Yamagishi, Satoshi Kobashikawa |
| 2019 | Interspeech | Speech Emotion Recognition Based on Multi-Label Emotion Existence Model. | Atsushi Ando, Ryo Masumura, Hosana Kamiyama, Satoshi Kobashikawa, Yushi Aono |
| 2019 | Interspeech | Improving Conversation-Context Language Models with Multiple Spoken Language Understanding Models. | Ryo Masumura, Tomohiro Tanaka, Atsushi Ando, Hosana Kamiyama, Takanobu Oba, Satoshi Kobashikawa, Yushi Aono |
| 2018 | ICASSP | Soft-Target Training with Ambiguous Emotional Utterances for DNN-Based Speech Emotion Classification. | Atsushi Ando, Satoshi Kobashikawa, Hosana Kamiyama, Ryo Masumura, Yusuke Ijima, Yushi Aono |
| 2018 | Interspeech | Automatic Question Detection from Acoustic and Phonetic Features Using Feature-wise Pre-training. | Atsushi Ando, Reine Asakawa, Ryo Masumura, Hosana Kamiyama, Satoshi Kobashikawa, Yushi Aono |
| 2017 | IJCNLP | Improving Neural Text Normalization with Data Augmentation at Character- and Morphological Levels. | Itsumi Saito, Jun Suzuki, Kyosuke Nishida, Kugatsu Sadamitsu, Satoshi Kobashikawa, Ryo Masumura, Yuji Matsumoto, Junji Tomita |
| 2017 | Interspeech | Hierarchical LSTMs with Joint Learning for Estimating Customer Satisfaction from Contact Center Calls. | Atsushi Ando, Ryo Masumura, Hosana Kamiyama, Satoshi Kobashikawa, Yushi Aono |
| 2017 | Interspeech | Interaction and Transition Model for Speech Emotion Recognition in Dialogue. | Ruo Zhang, Atsushi Ando, Satoshi Kobashikawa, Yushi Aono |
| 2013 | Interspeech | Unsupervised confidence calibration using examples of recognized words and their contexts. | Taichi Asami, Satoshi Kobashikawa, Hirokazu Masataki, Osamu Yoshioka, Satoshi Takahashi |
| 2012 | Interspeech | Speech Data Clustering Based on Phoneme Error Trend for Unsupervised Acoustic Model Adaptation. | Taichi Asami, Satoshi Kobashikawa, Hirokazu Masataki, Osamu Yoshioka, Satoshi Takahashi |
| 2012 | Interspeech | Efficient Beam Width Control to Suppress Excessive Speech Recognition Computation Time Based on Prior Score Range Normalization. | Satoshi Kobashikawa, Takaaki Hori, Yoshikazu Yamaguchi, Taichi Asami, Hirokazu Masataki, Satoshi Takahashi |
| 2011 | ICASSP | Extracting call-reason segments from contact center dialogs by using automatically acquired boundary expressions. | Takaaki Fukutomi, Satoshi Kobashikawa, Taichi Asami, Tsubasa Shinozaki, Hirokazu Masataki, Satoshi Takahashi |
| 2011 | Interspeech | Spoken Document Confidence Estimation Using Contextual Coherence. | Taichi Asami, Narichika Nomoto, Satoshi Kobashikawa, Yoshikazu Yamaguchi, Hirokazu Masataki, Satoshi Takahashi |
| 2011 | Interspeech | Morpheme Conversion for Connecting Speech Recognizer and Language Analyzers in Unsegmented Languages. | Kenji Imamura, Tomoko Izumi, Kugatsu Sadamitsu, Kuniko Saito, Satoshi Kobashikawa, Hirokazu Masataki |
| 2010 | Interspeech | Efficient data selection for speech recognition based on prior confidence estimation using speech and context independent models. | Satoshi Kobashikawa, Taichi Asami, Yoshikazu Yamaguchi, Hirokazu Masataki, Satoshi Takahashi |
| 2009 | Interspeech | Rapid unsupervised adaptation using frame independent output probabilities of gender and context independent phoneme models. | Satoshi Kobashikawa, Atsunori Ogawa, Yoshikazu Yamaguchi, Satoshi Takahashi |
| 2005 | Interspeech | Rapid response and robust speech recognition by preliminary model adaptation for additive and convolutional noise. | Satoshi Kobashikawa, Satoshi Takahashi, Yoshikazu Yamaguchi, Atsunori Ogawa |
| 2004 | Interspeech | Robust speech recognition based on HMM composition and modified wiener filter. | Sumitaka Sakauchi, Yoshikazu Yamaguchi, Satoshi Takahashi, Satoshi Kobashikawa |
| 2002 | Interspeech | Acoustic modeling of sentence stress using differential features between syllables for English rhythm learning system development. | Nobuaki Minematsu, Satoshi Kobashikawa, Keikichi Hirose, Donna Erickson |