| 2024 | WACV | Egocentric Action Recognition by Capturing Hand-Object Contact and Object State. | Tsukasa Shiota, Motohiro Takagi, Kaori Kumagai, Hitoshi Seshimo, Yushi Aono |
| 2022 | CVPR | Bilateral Video Magnification Filter. | Shoichiro Takeda, Kenta Niwa, Mariko Isogawa, Shinya Shimizu, Kazuki Okami, Yushi Aono |
| 2020 | HCI | Methods of Efficiently Constructing Text-Dialogue-Agent System Using Existing Anime Character. | Ryo Ishii, Ryuichiro Higashinaka, Koh Mitsuda, Taichi Katayama, Masahiro Mizukami, Junji Tomita, Hidetoshi Kawabata, Emi Yamaguchi, Noritake Adachi, Yushi Aono |
| 2020 | ICMI | Analyzing Nonverbal Behaviors along with Praising. | Toshiki Onishi, Arisa Yamauchi, Ryo Ishii, Yushi Aono, Akihiro Miyata |
| 2020 | LREC | Generating Responses that Reflect Meta Information in User-Generated Question Answer Pairs. | Takashi Kodama, Ryuichiro Higashinaka, Koh Mitsuda, Ryo Masumura, Yushi Aono, Ryuta Nakamura, Noritake Adachi, Hidetoshi Kawabata |
| 2019 | ICASSP | Large Context End-to-end Automatic Speech Recognition via Extension of Hierarchical Recurrent Encoder-decoder Models. | Ryo Masumura, Tomohiro Tanaka, Takafumi Moriya, Yusuke Shinohara, Takanobu Oba, Yushi Aono |
| 2019 | Interspeech | Speech Emotion Recognition Based on Multi-Label Emotion Existence Model. | Atsushi Ando, Ryo Masumura, Hosana Kamiyama, Satoshi Kobashikawa, Yushi Aono |
| 2019 | Interspeech | Neural Whispered Speech Detection with Imbalanced Learning. | Takanori Ashihara, Yusuke Shinohara, Hiroshi Sato, Takafumi Moriya, Kiyoaki Matsui, Takaaki Fukutomi, Yoshikazu Yamaguchi, Yushi Aono |
| 2019 | Interspeech | Improving Conversation-Context Language Models with Multiple Spoken Language Understanding Models. | Ryo Masumura, Tomohiro Tanaka, Atsushi Ando, Hosana Kamiyama, Takanobu Oba, Satoshi Kobashikawa, Yushi Aono |
| 2019 | Interspeech | Joint Maximization Decoder with Neural Converters for Fully Neural Network-Based Japanese Speech Recognition. | Takafumi Moriya, Jian Wang, Tomohiro Tanaka, Ryo Masumura, Yusuke Shinohara, Yoshikazu Yamaguchi, Yushi Aono |
| 2019 | Interspeech | A Joint End-to-End and DNN-HMM Hybrid Automatic Speech Recognition System with Transferring Sharable Knowledge. | Tomohiro Tanaka, Ryo Masumura, Takafumi Moriya, Takanobu Oba, Yushi Aono |
| 2018 | COLING | Multi-task and Multi-lingual Joint Learning of Neural Lexical Utterance Classification based on Partially-shared Modeling. | Ryo Masumura, Tomohiro Tanaka, Ryuichiro Higashinaka, Hirokazu Masataki, Yushi Aono |
| 2018 | EMNLP | Adversarial Training for Multi-task and Multi-lingual Joint Modeling of Utterance Intent Classification. | Ryo Masumura, Yusuke Shinohara, Ryuichiro Higashinaka, Yushi Aono |
| 2018 | ICASSP | Soft-Target Training with Ambiguous Emotional Utterances for DNN-Based Speech Emotion Classification. | Atsushi Ando, Satoshi Kobashikawa, Hosana Kamiyama, Ryo Masumura, Yusuke Ijima, Yushi Aono |
| 2018 | Interspeech | Automatic Question Detection from Acoustic and Phonetic Features Using Feature-wise Pre-training. | Atsushi Ando, Reine Asakawa, Ryo Masumura, Hosana Kamiyama, Satoshi Kobashikawa, Yushi Aono |
| 2018 | Interspeech | Role Play Dialogue Aware Language Models Based on Conditional Hierarchical Recurrent Encoder-Decoder. | Ryo Masumura, Tomohiro Tanaka, Atsushi Ando, Hirokazu Masataki, Yushi Aono |
| 2018 | Interspeech | Multi-task Learning with Augmentation Strategy for Acoustic-to-word Attention-based Encoder-decoder Speech Recognition. | Takafumi Moriya, Sei Ueno, Yusuke Shinohara, Marc Delcroix, Yoshikazu Yamaguchi, Yushi Aono |
| 2018 | Interspeech | Neural Error Corrective Language Models for Automatic Speech Recognition. | Tomohiro Tanaka, Ryo Masumura, Hirokazu Masataki, Yushi Aono |
| 2018 | Interspeech | Encoder Transfer for Attention-based Acoustic-to-word Speech Recognition. | Sei Ueno, Takafumi Moriya, Masato Mimura, Shinsuke Sakai, Yusuke Shinohara, Yoshikazu Yamaguchi, Yushi Aono, Tatsuya Kawahara |
| 2018 | Interspeech | Automatic DNN Node Pruning Using Mixture Distribution-based Group Regularization. | Tsukasa Yoshida, Takafumi Moriya, Kazuho Watanabe, Yusuke Shinohara, Yoshikazu Yamaguchi, Yushi Aono |
| 2018 | SIGdial | Neural Dialogue Context Online End-of-Turn Detection. | Ryo Masumura, Tomohiro Tanaka, Atsushi Ando, Ryo Ishii, Ryuichiro Higashinaka, Yushi Aono |
| 2017 | ICASSP | Domain adaptation of DNN acoustic models using knowledge distillation. | Taichi Asami, Ryo Masumura, Yoshikazu Yamaguchi, Hirokazu Masataki, Yushi Aono |
| 2017 | ICASSP | Parallel phonetically aware DNNs and LSTM-RNNS for frame-by-frame discriminative modeling of spoken language identification. | Ryo Masumura, Taichi Asami, Hirokazu Masataki, Yushi Aono |
| 2017 | Interspeech | Hierarchical LSTMs with Joint Learning for Estimating Customer Satisfaction from Contact Center Calls. | Atsushi Ando, Ryo Masumura, Hosana Kamiyama, Satoshi Kobashikawa, Yushi Aono |
| 2017 | Interspeech | Interaction and Transition Model for Speech Emotion Recognition in Dialogue. | Ruo Zhang, Atsushi Ando, Satoshi Kobashikawa, Yushi Aono |
| 2016 | Interspeech | Recurrent Out-of-Vocabulary Word Detection Using Distribution of Features. | Taichi Asami, Ryo Masumura, Yushi Aono, Koichi Shinoda |
| 2016 | Interspeech | Language Identification Based on Generative Modeling of Posteriorgram Sequences Extracted from Frame-by-Frame DNNs and LSTM-RNNs. | Ryo Masumura, Taichi Asami, Hirokazu Masataki, Yushi Aono, Sumitaka Sakauchi |