| 2026 | AAAI | SASST: Leveraging Syntax-Aware Chunking and LLMs for Simultaneous Speech Translation. | Zeyu Yang, Lai Wei, Roman Koshkin, Xi Chen, Satoshi Nakamura |
| 2026 | ACL | Redefining Machine Simultaneous Interpretation: From Incremental Translation to Human-Like Strategies. | Qianen Zhang, Zeyu Yang, Satoshi Nakamura |
| 2026 | AVI | Does Removing Pen Pressure in Cost-Cutting Pen Designs Matter for Handwritten Learning in Education? A Case Study of Geometry Problem Solving. | Yuki Miyazaki, Sari Kobayashi, Satoshi Nakamura, Akiyuki Kake |
| 2026 | CHI | Bridge Over Troubled Water: Aligning Commercial Incentives With Ethical Design Practice To Combat Deceptive Patterns. | Thomas Emeyer, Johanna Gunawan, Colin M. Gray, Lorena Snchez Chamorro, Alberto Monge Roffarello, Katie Seaborn, Hauke Sandhaus, Kai Lukoff, Gian-Luca Savino, Shruthi Sai Chivukula, Satoshi Nakamura |
| 2026 | CHI | Improving Data Quality via Pre-Task Participant Screening in Crowdsourced GUI Experiments. | Takaya Miyama, Satoshi Nakamura, Shota Yamanaka |
| 2026 | CHI | Drawing Attention: A Field Study of Sketch-Based Penguin Identification for Aquarium Visitor Engagement. | Yuki Nakagawa, Satoshi Nakamura |
| 2025 | ASRU | Learning Marmoset Vocal Patterns with a Masked Autoencoder for Robust Call Segmentation, Classification, and Caller Identification. | Bin Wu, Shinnosuke Takamichi, Sakriani Sakti, Satoshi Nakamura |
| 2025 | CHI | Global and Transdisciplinary Perspectives on Dark Patterns and Deceptive Design Practice: ダークパターンとひとをだますデザインに関する国際的かつ学際的な交流. | Katie Seaborn, Colin M. Gray, Johanna Gunawan, Thomas Mildner, Ren Schfer, Lorena Snchez Chamorro, Satoshi Nakamura |
| 2024 | ACL | LLaST: Improved End-to-end Speech Translation System Leveraged by Large Language Models. | Xi Chen, Songyang Zhang, Qibing Bai, Kai Chen, Satoshi Nakamura |
| 2024 | AVI | TsumeColorGram: A Method of Estimating an Object's Weight Based on the Thumb's Nail Color. | Sayuri Matsuda, Satoshi Nakamura |
| 2024 | AVI | Drawing-type Search Method Focusing on Penguin's Abdominal Patterns for Enriching Observation Experiences in an Aquarium. | Yuki Nakagawa, Satoshi Nakamura |
| 2024 | COLING | NAIST-SIC-Aligned: An Aligned English-Japanese Simultaneous Interpretation Corpus. | Jinming Zhao, Katsuhito Sudoh, Satoshi Nakamura, Yuka Ko, Kosuke Doi, Ryo Fukuda |
| 2024 | EMNLP | LLMs Are Zero-Shot Context-Aware Simultaneous Translators. | Roman Koshkin, Katsuhito Sudoh, Satoshi Nakamura |
| 2024 | EMNLP | TransLLaMa: LLM-based Simultaneous Translation System. | Roman Koshkin, Katsuhito Sudoh, Satoshi Nakamura |
| 2023 | ACII | Social Performance Rating During Social Skills Training in Adults with Autism Spectrum Disorder and Schizophrenia. | Kana Miyamoto, Hiroki Tanaka, Jennifer Hamet Bagnou, Elise Prigent, Cline Clavel, Jean-Claude Martin, Satoshi Nakamura |
| 2023 | EACL | Evaluating the Robustness of Discrete Prompts. | Yoichi Ishibashi, Danushka Bollegala, Katsuhito Sudoh, Satoshi Nakamura |
| 2023 | HAI | Multimodal Voice Activity Prediction: Turn-taking Events Detection in Expert-Novice Conversation. | Kazuyo Onishi, Hiroki Tanaka, Satoshi Nakamura |
| 2023 | HCI | BingoFit: A Bingo Clothes Presentation System for Utilizing Owned Clothes. | Yukino Aoki, Kouta Yokoyama, Satoshi Nakamura |
| 2023 | HCI | Do People Tend to Select a Delayed Item? | Yuichiro Kinoshita, Yuto Sekiguchi, Riho Ueki, Kouta Yokoyama, Satoshi Nakamura |
| 2023 | HCI | Glasses Encourage Your Choices: A System that Supports Indecisive Choosers by Eye-Tracking. | Tatsuya Komatsubara, Satoshi Nakamura |
| 2023 | HCI | A Study on the Effects of Intrinsic Motivation from Self-determination on Driving Skill. | Yuki Nakagawa, Sayuri Matsuda, Takumi Takaku, Satoshi Nakamura, Takanori Komatsu, Takeshi Torii, Ryuichi Sumikawa, Hideyuki Takao |
| 2023 | HCI | Does the Average Color Influence Selection? | Yuto Sekiguchi, Riho Ueki, Kouta Yokoyama, Satoshi Nakamura |
| 2023 | HCI | Does the Type of Font Face Induce the Selection? | Riho Ueki, Kouta Yokoyama, Satoshi Nakamura |
| 2023 | HCI | A Basic Study to Prevent Non-earnest Responses in Web Surveys by Arranging the Order of Open-Ended Questions. | Ikumi Yamazaki, Ken'ichi Hatanaka, Satoshi Nakamura, Takanori Komatsu |
| 2023 | ICASSP | Self-Adaptive Incremental Machine Speech Chain for Lombard TTS with High-Granularity ASR Feedback in Dynamic Noise Condition. | Sashi Novitasari, Sakriani Sakti, Satoshi Nakamura |
| 2023 | ICMI | Computational analyses of linguistic features with schizophrenic and autistic traits along with formal thought disorders. | Takeshi Saga, Hiroki Tanaka, Satoshi Nakamura |
| 2023 | ICMI | An Adaptive Virtual Agent Platform for Automated Social Skills Training. | Takeshi Saga, Jieyeon Woo, Alexis Gerard, Hiroki Tanaka, Catherine Achard, Satoshi Nakamura, Catherine Pelachaud |
| 2023 | ICMI | 4th Workshop on Social Affective Multimodal Interaction for Health (SAMIH). | Hiroki Tanaka, Satoshi Nakamura, Jean-Claude Martin, Catherine Pelachaud |
| 2023 | Interspeech | Average Token Delay: A Latency Metric for Simultaneous Translation. | Yasumasa Kano, Katsuhito Sudoh, Satoshi Nakamura |
| 2023 | Interspeech | Inter-connection: Effective Connection between Pre-trained Encoder and Decoder for Speech Translation. | Yuta Nishikawa, Satoshi Nakamura |
| 2022 | HCI | Driving Experiment System Using HMDs to Measure Drivers' Proficiency and Difficulty of Various Road Conditions. | Yukina Funazaki, Noboru Seto, Kota Ninomiya, Kazuyuki Hikawa, Satoshi Nakamura, Shota Yamanaka |
| 2022 | ICMI | 3rd Workshop on Social Affective Multimodal Interaction for Health (SAMIH). | Hiroki Tanaka, Satoshi Nakamura, Kazuhiro Shidara, Jean-Claude Martin, Catherine Pelachaud |
| 2022 | ICPR | A Method to Annotate Who Speaks a Text Line in Manga and Speaker-Line Dataset for Manga109. | Tsubasa Sakurai, Risa Ito, Kazuki Abe, Satoshi Nakamura |
| 2022 | ICPR | Considering Meanings and Effects of Frames Without Onomatopoeias in Japanese Comics. | Riko Sugita, Minami Okajima, Takanori Komatsu, Satoshi Nakamura |
| 2022 | Interspeech | Speech Segmentation Optimization using Segmented Bilingual Speech Corpus for End-to-end Speech Translation. | Ryo Fukuda, Katsuhito Sudoh, Satoshi Nakamura |
| 2022 | Interspeech | Applying Syntax-Prosody Mapping Hypothesis and Prosodic Well-Formedness Constraints to Neural Sequence-to-Sequence Speech Synthesis. | Kei Furukawa, Takeshi Kishiyama, Satoshi Nakamura |
| 2022 | Interspeech | Multimodal Persuasive Dialogue Corpus using Teleoperated Android. | Seiya Kawano, Muteki Arioka, Akishige Yuguchi, Kenta Yamamoto, Koji Inoue, Tatsuya Kawahara, Satoshi Nakamura, Koichiro Yoshino |
| 2022 | Interspeech | Improved Consistency Training for Semi-Supervised Sequence-to-Sequence ASR via Speech Chain Reconstruction and Self-Transcribing. | Heli Qi, Sashi Novitasari, Sakriani Sakti, Satoshi Nakamura |
| 2021 | ACII | Relationship between Mood Improvement and Questioning to Evaluate Automatic Thoughts in Cognitive Restructuring with a Virtual Agent. | Kazuhiro Shidara, Hiroki Tanaka, Hiroyoshi Adachi, Daisuke Kanayama, Yukako Sakagami, Takashi Kudo, Satoshi Nakamura |
| 2021 | ICMI | Meta-Learning for Emotion Prediction from EEG while Listening to Music. | Kana Miyamoto, Hiroki Tanaka, Satoshi Nakamura |
| 2021 | ICMI | Multimodal Dataset of Social Skills Training in Natural Conversational Setting. | Takeshi Saga, Hiroki Tanaka, Hidemi Iwasaka, Yasuhiro Matsuda, Tsubasa Morimoto, Mitsuhiro Uratani, Kosuke Okazaki, Yuichiro Fujimoto, Satoshi Nakamura |
| 2021 | ICMI | 2nd Workshop on Social Affective Multimodal Interaction for Health (SAMIH). | Hiroki Tanaka, Satoshi Nakamura, Jean-Claude Martin, Catherine Pelachaud |
| 2021 | Interact | Do Animation Direction and Position of Progress Bar Affect Selections? | Kota Yokoyama, Satoshi Nakamura, Shota Yamanaka |
| 2021 | Interspeech | Weakly-Supervised Speech-to-Text Mapping with Visually Connected Non-Parallel Speech-Text Data Using Cyclic Partially-Aligned Transformer. | Johanes Effendi, Sakriani Sakti, Satoshi Nakamura |
| 2021 | Interspeech | ASR Posterior-Based Loss for Multi-Task End-to-End Speech Translation. | Yuka Ko, Katsuhito Sudoh, Sakriani Sakti, Satoshi Nakamura |
| 2021 | Interspeech | Dynamically Adaptive Machine Speech Chain Inference for TTS in Noisy Environment: Listen and Speak Louder. | Sashi Novitasari, Sakriani Sakti, Satoshi Nakamura |
| 2020 | ACL | Reflection-based Word Attribute Transfer. | Yoichi Ishibashi, Katsuhito Sudoh, Koichiro Yoshino, Satoshi Nakamura |
| 2020 | ACL | Automatic Machine Translation Evaluation using Source Language Inputs and Cross-lingual Language Model. | Kosuke Takahashi, Katsuhito Sudoh, Satoshi Nakamura |
| 2020 | COLING | Incorporating Noisy Length Constraints into Transformer with Length-aware Positional Encodings. | Yui Oka, Katsuki Chousa, Katsuhito Sudoh, Satoshi Nakamura |
| 2020 | COLING | Improving Spoken Language Understanding by Wisdom of Crowds. | Koichiro Yoshino, Kana Ikeuchi, Katsuhito Sudoh, Satoshi Nakamura |
| 2020 | HCI | Comparison of the Remembering Ability by the Difference Between Handwriting and Typeface. | Risa Ito, Karin Hamano, Kosuke Nonaka, Ippei Sugano, Satoshi Nakamura, Akiyuki Kake, Kizuku Ishimaru |
| 2020 | HCI | Abstract Thinking Description System for Programming Education Facilitation. | Yasutsuna Matayoshi, Satoshi Nakamura |
| 2020 | ICASSP | Using Panoramic Videos for Multi-Person Localization and Tracking In A 3D Panoramic Coordinate. | Fan Yang, Feiran Li, Yang Wu, Sakriani Sakti, Satoshi Nakamura |
| 2020 | ICASSP | DEJA-VU: Double Feature Presentation and Iterated Loss in Deep Transformer Networks. | Andros Tjandra, Chunxi Liu, Frank Zhang, Xiaohui Zhang, Yongqiang Wang, Gabriel Synnaeve, Satoshi Nakamura, Geoffrey Zweig |
| 2020 | ICMI | Music Generation and Emotion Estimation from EEG Signals for Inducing Affective States. | Kana Miyamoto, Hiroki Tanaka, Satoshi Nakamura |
| 2020 | ICMI | Objective Prediction of Social Skills Level for Automated Social Skills Training Using Audio and Text Information. | Takeshi Saga, Hiroki Tanaka, Hidemi Iwasaka, Satoshi Nakamura |
| 2020 | ICMI | Analysis of Mood Changes and Facial Expressions during Cognitive Behavior Therapy through a Virtual Agent. | Kazuhiro Shidara, Hiroki Tanaka, Hiroyoshi Adachi, Daisuke Kanayama, Yukako Sakagami, Takashi Kudo, Satoshi Nakamura |
| 2020 | ICMI | Social Affective Multimodal Interaction for Health. | Hiroki Tanaka, Satoshi Nakamura, Jean-Claude Martin, Catherine Pelachaud |
| 2020 | Interspeech | Augmenting Images for ASR and TTS Through Single-Loop and Dual-Loop Multimodal Chain Framework. | Johanes Effendi, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2020 | Interspeech | Incremental Machine Speech Chain Towards Enabling Listening While Speaking in Real-Time. | Sashi Novitasari, Andros Tjandra, Tomoya Yanagita, Sakriani Sakti, Satoshi Nakamura |
| 2020 | Interspeech | Combining Audio and Brain Activity for Predicting Speech Quality. | Ivan Halim Parmonangan, Hiroki Tanaka, Sakriani Sakti, Satoshi Nakamura |
| 2019 | ASRU | Listening While Speaking and Visualizing: Improving ASR Through Multimodal Chain. | Johanes Effendi, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2019 | ASRU | Neural Machine Translation with Acoustic Embedding. | Takatomo Kano, Sakriani Sakti, Satoshi Nakamura |
| 2019 | ASRU | Zero-Shot Code-Switching ASR and TTS with Multilingual Machine Speech Chain. | Sahoko Nakayama, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2019 | ASRU | Speech-to-Speech Translation Between Untranscribed Unknown Languages. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2019 | CHI | Augmented typing: augmentation of keyboard typing experience by adding visual and sound effects. | Tsubasa Yumura, Satoshi Nakamura |
| 2019 | ICASSP | Speech Artifact Removal from Eeg Recordings of Spoken Word Production with Tensor Decomposition. | Holy Lovenia, Hiroki Tanaka, Sakriani Sakti, Ayu Purwarianti, Satoshi Nakamura |
| 2019 | ICASSP | End-to-end Feedback Loss in Speech Chain Framework via Straight-through Estimator. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2019 | ICASSP | Cross-lingual Speech-based Tobi Label Generation Using Bidirectional Lstm. | Marco Vetter, Sakriani Sakti, Satoshi Nakamura |
| 2019 | ICMI | Measuring Affective Sharing between Two People by EEG Hyperscanning. | Taiki Kinoshita, Hiroki Tanaka, Koichiro Yoshino, Satoshi Nakamura |
| 2019 | ICMI | Detecting Syntactic Violations from Single-trial EEG using Recurrent Neural Networks. | Shunnosuke Motomura, Hiroki Tanaka, Satoshi Nakamura |
| 2019 | ICMI | Detecting Dementia from Face in Human-Agent Interaction. | Hiroki Tanaka, Hiroyoshi Adachi, Hiroaki Kazui, Manabu Ikeda, Takashi Kudo, Satoshi Nakamura |
| 2019 | INLG | Neural Conversation Model Controllable by Given Dialogue Act Based on Adversarial Learning and Label-aware Objective. | Seiya Kawano, Koichiro Yoshino, Satoshi Nakamura |
| 2019 | Interact | The Possibility of Personality Extraction Using Skeletal Information in Hip-Hop Dance by Human or Machine. | Saeka Furuichi, Kazuki Abe, Satoshi Nakamura |
| 2019 | Interact | Does the Pop-Out Make an Effect in the Product Selection of Signage Vending Machine? | Mitsuki Hosoya, Hiroaki Yamaura, Satoshi Nakamura, Makoto Nakamura, Eiji Takamatsu, Yujiro Kitaide |
| 2019 | Interact | Analysis of Utilization in the Message Card Production by Use of Fusion Character of Handwriting and Typeface. | Mikako Sasaki, Junki Saito, Satoshi Nakamura |
| 2019 | Interspeech | An Incremental Turn-Taking Model for Task-Oriented Dialog Systems. | Andrei Catalin Coman, Koichiro Yoshino, Yukitoshi Murase, Satoshi Nakamura, Giuseppe Riccardi |
| 2019 | Interspeech | Sequence-to-Sequence Learning via Attention Transfer for Incremental Speech Recognition. | Sashi Novitasari, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2019 | Interspeech | Speech Quality Evaluation of Synthesized Japanese Speech Using EEG. | Ivan Halim Parmonangan, Hiroki Tanaka, Sakriani Sakti, Shinnosuke Takamichi, Satoshi Nakamura |
| 2018 | AAAI | Eliciting Positive Emotion through Affect-Sensitive Dialogue Response Generation: A Neural Network Approach. | Nurul Lubis, Sakriani Sakti, Koichiro Yoshino, Satoshi Nakamura |
| 2018 | AVI | Mojirage: average handwritten note. | Yasutsuna Matayoshi, Ryo Oshima, Satoshi Nakamura |
| 2018 | AVI | PhoToDo: image-based task management system by visual trigger. | Kouhei Matsuda, Satoshi Nakamura |
| 2018 | DaWaK | TRANS-AM: Discovery Method of Optimal Input Vectors Corresponding to Objective Variables. | Hiroaki Tanaka, Yu Suzuki, Koichiro Yoshino, Satoshi Nakamura |
| 2018 | DEXA | Information Filtering Method for Twitter Streaming Data Using Human-in-the-Loop Machine Learning. | Yu Suzuki, Satoshi Nakamura |
| 2018 | HCI | Deconaby: Animations for Improving Understandability of Web Images. | Kazuyuki Hikawa, Kohei Matsuda, Satoshi Nakamura |
| 2018 | HCI | Can People Sense Their Personalities Only by Watching the Movements of Their Skeleton in Street Dancing Performances? | Hikaru Saito, Yoshiki Maki, Shunki Tsuchiya, Satoshi Nakamura |
| 2018 | HCI | Image Blurring Method for Enhancing Digital Content Viewing Experience. | Hiroaki Yamaura, Masayuki Tamura, Satoshi Nakamura |
| 2018 | ICASSP | Graph Regularized Tensor Factorization for Single-Trial EEG Analysis. | Hayato Maki, Hiroki Tanaka, Sakriani Sakti, Satoshi Nakamura |
| 2018 | ICASSP | Sequence-to-Sequence Asr Optimization Via Reinforcement Learning. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2018 | ICMI | Listening Skills Assessment through Computer Agents. | Hiroki Tanaka, Hideki Negoro, Hidemi Iwasaka, Satoshi Nakamura |
| 2018 | IJCNN | Tensor Decomposition for Compressing Recurrent Neural Network. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2018 | Interspeech | Compressing End-to-end ASR Networks by Tensor-Train Decomposition. | Takuma Mori, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2017 | ACII | Processing negative emotions through social communication: Multimodal database construction and analysis. | Nurul Lubis, Michael Heck, Sakriani Sakti, Koichiro Yoshino, Satoshi Nakamura |
| 2017 | ACL | Neural Machine Translation via Binary Code Prediction. | Yusuke Oda, Philip Arthur, Graham Neubig, Koichiro Yoshino, Satoshi Nakamura |
| 2017 | ASRU | Feature optimized DPGMM clustering for unsupervised subword modeling: A contribution to zerospeech 2017. | Michael Heck, Sakriani Sakti, Satoshi Nakamura |
| 2017 | ASRU | Listening while speaking: Speech chain by deep learning. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2017 | ASRU | Attention-based Wav2Text with feature transfer learning. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2017 | ICMI | Tracking liking state in brain activity while watching multiple movies. | Naoto Terasawa, Hiroki Tanaka, Sakriani Sakti, Satoshi Nakamura |
| 2017 | IJCNLP | Acquisition and Assessment of Semantic Content for the Generation of Elaborateness and Indirectness in Spoken Dialogue Systems. | Louisa Pragst, Koichiro Yoshino, Wolfgang Minker, Satoshi Nakamura, Stefan Ultes |
| 2017 | IJCNLP | Local Monotonic Attention Mechanism for End-to-End Speech And Language Processing. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2017 | IJCNLP | Improving Neural Machine Translation through Phrase-based Forced Decoding. | Jingyi Zhang, Masao Utiyama, Eiichiro Sumita, Graham Neubig, Satoshi Nakamura |
| 2017 | IJCNN | Compressing recurrent neural network with tensor train. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2017 | Interspeech | Toward Expressive Speech Translation: A Unified Sequence-to-Sequence LSTMs Approach for Translating Words and Emphasis. | Quoc Truong Do, Sakriani Sakti, Satoshi Nakamura |
| 2017 | Interspeech | Ensembles of Multi-Scale VGG Acoustic Models. | Michael Heck, Masayuki Suzuki, Takashi Fukuda, Gakuto Kurata, Satoshi Nakamura |
| 2017 | Interspeech | Structured-Based Curriculum Learning for End-to-End English-Japanese Speech Translation. | Takatomo Kano, Sakriani Sakti, Satoshi Nakamura |
| 2016 | ACL | A Continuous Space Rule Selection Model for Syntax-based Statistical Machine Translation. | Jingyi Zhang, Masao Utiyama, Eiichiro Sumita, Graham Neubig, Satoshi Nakamura |
| 2016 | EMNLP | Learning a Lexicon and Translation Model from Phoneme Lattices. | Oliver Adams, Graham Neubig, Trevor Cohn, Steven Bird, Quoc Truong Do, Satoshi Nakamura |
| 2016 | EMNLP | Incorporating Discrete Translation Lexicons into Neural Machine Translation. | Philip Arthur, Graham Neubig, Satoshi Nakamura |
| 2016 | ICASSP | Implementation of F0 transformation for statistical singing voice conversion based on direct waveform modification. | Kazuhiro Kobayashi, Tomoki Toda, Satoshi Nakamura |
| 2016 | ICASSP | Noise suppression method for body-conducted soft speech enhancement based on external noise monitoring. | Yusuke Tajiri, Tomoki Toda, Satoshi Nakamura |
| 2016 | ICASSP | Statistical F0 prediction for electrolaryngeal speech enhancement considering generative process of F0 contours within product of experts framework. | Kou Tanaka, Hirokazu Kameoka, Tomoki Toda, Satoshi Nakamura |
| 2016 | ICASSP | An estimation method of voice timbre evaluation values using feature extraction with Gaussian mixture model based on reference singer. | Soichi Yamane, Kazuhiro Kobayashi, Tomoki Toda, Tomoyasu Nakano, Masataka Goto, Satoshi Nakamura |
| 2016 | ICMI | Personalized unknown word detection in non-native language reading using eye gaze. | Rui Hiraoka, Hiroki Tanaka, Sakriani Sakti, Graham Neubig, Satoshi Nakamura |
| 2016 | ICMI | Automatic detection of very early stage of dementia through multimodal interaction with computer avatars. | Hiroki Tanaka, Hiroyoshi Adachi, Norimichi Ukita, Takashi Kudo, Satoshi Nakamura |
| 2016 | ICPR | A sustainable practice method of hand-drawing by merging user's stroke and model's stroke. | Natsumi Kubota, Shinjiro Niino, Satoshi Nakamura, Masaaki Macky Suzuki |
| 2016 | IIWAS | Fast text anonymization using k-anonyminity. | Wakana Maeda, Yu Suzuki, Satoshi Nakamura |
| 2016 | IJCNN | Gated Recurrent Neural Tensor Network. | Andros Tjandra, Sakriani Sakti, Ruli Manurung, Mirna Adriani, Satoshi Nakamura |
| 2016 | Interspeech | Transferring Emphasis in Speech Translation Using Hard-Attentional Neural Network Models. | Quoc Truong Do, Sakriani Sakti, Graham Neubig, Satoshi Nakamura |
| 2016 | Interspeech | A Hybrid System for Continuous Word-Level Emphasis Modeling Based on HMM State Clustering and Adaptive Training. | Quoc Truong Do, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura |
| 2016 | Interspeech | Supervised Learning of Acoustic Models in a Zero Resource Setting to Improve DPGMM Clustering. | Michael Heck, Sakriani Sakti, Satoshi Nakamura |
| 2016 | Interspeech | The NU-NAIST Voice Conversion System for the Voice Conversion Challenge 2016. | Kazuhiro Kobayashi, Shinnosuke Takamichi, Satoshi Nakamura, Tomoki Toda |
| 2015 | ACL | Improving Pivot Translation by Remembering the Pivot. | Akiva Miura, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura |
| 2015 | ACL | Syntax-based Simultaneous Translation through Prediction of Unseen Syntactic Constituents. | Yusuke Oda, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura |
| 2015 | ASRU | The NAIST ASR system for the 2015 Multi-Genre Broadcast challenge: On combination of deep learning systems using a rank-score function. | Quoc Truong Do, Michael Heck, Sakriani Sakti, Graham Neubig, Tomoki Toda, Satoshi Nakamura |
| 2015 | ASRU | A study of social-affective communication: Automatic prediction of emotion triggers and responses in television talk shows. | Nurul Lubis, Sakriani Sakti, Graham Neubig, Koichiro Yoshino, Tomoki Toda, Satoshi Nakamura |
| 2015 | ASRU | Adaptive selection from multiple response candidates in example-based dialogue. | Masahiro Mizukami, Hideaki Kizuki, Toshio Nomura, Graham Neubig, Koichiro Yoshino, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura |
| 2015 | ASRU | Incremental sentence compression using LSTM recurrent networks. | Sakriani Sakti, Faiz Ilham, Graham Neubig, Tomoki Toda, Ayu Purwarianti, Satoshi Nakamura |
| 2015 | ASRU | Stochastic Gradient Variational Bayes for deep learning-based ASR. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura, Mirna Adriani |
| 2015 | ASSETS | An Enhanced Electrolarynx with Automatic Fundamental Frequency Control based on Statistical Prediction. | Kou Tanaka, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura |
| 2015 | EMNLP | A Binarized Neural Network Joint Model for Machine Translation. | Jingyi Zhang, Masao Utiyama, Eiichiro Sumita, Graham Neubig, Satoshi Nakamura |
| 2015 | ICASSP | WFST-based structural classification integrating dnn acoustic features and RNN language features for speech recognition. | Quoc Truong Do, Satoshi Nakamura, Marc Delcroix, Takaaki Hori |
| 2015 | ICASSP | EEG signal enhancement using multi-channel wiener filter with a spatial correlation prior. | Hayato Maki, Tomoki Toda, Sakriani Sakti, Graham Neubig, Satoshi Nakamura |
| 2015 | ICASSP | Statistical modeling of binaural signal and its application to binaural source separation. | Yuki Murota, Daichi Kitamura, Shoichi Koyama, Hiroshi Saruwatari, Satoshi Nakamura |
| 2015 | ICASSP | Parameter generation algorithm considering Modulation Spectrum for HMM-based speech synthesis. | Shinnosuke Takamichi, Tomoki Toda, Alan W. Black, Satoshi Nakamura |
| 2015 | ICASSP | Modulation spectrum-constrained trajectory training algorithm for GMM-based Voice Conversion. | Shinnosuke Takamichi, Tomoki Toda, Alan W. Black, Satoshi Nakamura |
| 2015 | ICASSP | Combination of two-dimensional cochleogram and spectrogram features for deep learning-based ASR. | Andros Tjandra, Sakriani Sakti, Graham Neubig, Tomoki Toda, Mirna Adriani, Satoshi Nakamura |
| 2015 | Interspeech | Preserving word-level emphasis in speech-to-speech translation using linear regression HSMMs. | Quoc Truong Do, Shinnosuke Takamichi, Sakriani Sakti, Graham Neubig, Tomoki Toda, Satoshi Nakamura |
| 2015 | Interspeech | Statistical singing voice conversion based on direct waveform modification with global variance. | Kazuhiro Kobayashi, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura |
| 2015 | Interspeech | Speed or accuracy? a study in evaluation of simultaneous speech translation. | Takashi Mieno, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura |
| 2015 | Interspeech | A latent variable model for joint pause prediction and dependency parsing. | The Tung Nguyen, Graham Neubig, Hiroyuki Shindo, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura |
| 2015 | Interspeech | Non-native speech synthesis preserving speaker individuality based on partial correction of prosodic and phonetic characteristics. | Yuji Oshima, Shinnosuke Takamichi, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura |
| 2014 | ACL | Optimizing Segmentation Strategies for Simultaneous Speech Translation. | Yusuke Oda, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura |
| 2014 | COLING | Discriminative Language Models as a Tool for Machine Translation Error Analysis. | Koichi Akabe, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura |
| 2014 | COLING | Reinforcement Learning of Cooperative Persuasive Dialogue Policies using Framing. | Takuya Hiraoka, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura |
| 2014 | EACL | Acquiring a Dictionary of Emotion-Provoking Events. | Hoa Trong Vu, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura |
| 2014 | HCOMP | Proposal and Initial Study for Animal Crowdsourcing. | Motohiro Makiguchi, Daichi Namikawa, Satoshi Nakamura, Taiga Yoshida, Masanori Yokoyama, Yuji Takano |
| 2014 | ICASSP | Regression approaches to perceptual age control in singing voice conversion. | Kazuhiro Kobayashi, Tomoki Toda, Tomoyasu Nakano, Masataka Goto, Graham Neubig, Sakriani Sakti, Satoshi Nakamura |
| 2014 | ICASSP | Narrow Adaptive Regularization of weights for grapheme-to-phoneme conversion. | Keigo Kubo, Sakriani Sakti, Graham Neubig, Tomoki Toda, Satoshi Nakamura |
| 2014 | ICASSP | Music signal separation based on Bayesian spectral amplitude estimator with automatic target prior adaptation. | Yuki Murota, Daichi Kitamura, Shunsuke Nakai, Hiroshi Saruwatari, Satoshi Nakamura, Yu Takahashi, Kazunobu Kondo |
| 2014 | ICASSP | A postfilter to modify the modulation spectrum in HMM-based speech synthesis. | Shinnosuke Takamichi, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura |
| 2014 | ICASSP | An evaluation of excitation feature prediction in a hybrid approach to electrolaryngeal speech enhancement. | Kou Tanaka, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura |
| 2014 | Interspeech | A hearing impairment simulation method using audiogram-based approximation of auditory charatecteristics. | Nozomi Jinbo, Shinnosuke Takamichi, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura |
| 2014 | Interspeech | Statistical singing voice conversion with direct waveform modification based on the spectrum differential. | Kazuhiro Kobayashi, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura |
| 2014 | Interspeech | Structured soft margin confidence weighted learning for grapheme-to-phoneme conversion. | Keigo Kubo, Sakriani Sakti, Graham Neubig, Tomoki Toda, Satoshi Nakamura |
| 2014 | Interspeech | Data-driven generation of text balloons based on linguistic and acoustic features of a comics-anime corpus. | Sho Matsumiya, Sakriani Sakti, Graham Neubig, Tomoki Toda, Satoshi Nakamura |
| 2013 | ACL | Towards High-Reliability Speech Translation in the Medical Domain. | Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura, Yuji Matsumoto, Ryosuke Isotani, Yukichi Ikeda |
| 2013 | ASRU | Dialogue management for leading the conversation in persuasive dialogue systems. | Takuya Hiraoka, Yuki Yamauchi, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura |
| 2013 | Interspeech | Evaluation of a singing voice conversion method based on many-to-many eigenvoice conversion. | Hironori Doi, Tomoki Toda, Tomoyasu Nakano, Masataka Goto, Satoshi Nakamura |
| 2013 | Interspeech | Simple, lexicalized choice of translation timing for simultaneous speech translation. | Tomoki Fujita, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura |
| 2013 | Interspeech | Generalizing continuous-space translation of paralinguistic information. | Takatomo Kano, Shinnosuke Takamichi, Sakriani Sakti, Graham Neubig, Tomoki Toda, Satoshi Nakamura |
| 2013 | Interspeech | An investigation of acoustic features for singing voice conversion based on perceptual age. | Kazuhiro Kobayashi, Hironori Doi, Tomoki Toda, Tomoyasu Nakano, Masataka Goto, Graham Neubig, Sakriani Sakti, Satoshi Nakamura |
| 2013 | Interspeech | Grapheme-to-phoneme conversion based on adaptive regularization of weight vectors. | Keigo Kubo, Sakriani Sakti, Graham Neubig, Tomoki Toda, Satoshi Nakamura |
| 2013 | Interspeech | A digital signal processor implementation of silent/electrolaryngeal speech enhancement based on real-time statistical voice conversion. | Takuto Moriguchi, Tomoki Toda, Motoaki Sano, Hiroshi Sato, Graham Neubig, Sakriani Sakti, Satoshi Nakamura |
| 2013 | Interspeech | An empirical comparison of joint optimization techniques for speech translation. | Masaya Ohgushi, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura |
| 2012 | AVI | Study of information clouding methods to prevent spoilers of sports match. | Satoshi Nakamura, Takanori Komatsu |
| 2012 | AVI | Personal photo browser that can classify photos by participants and situations. | Tomoya Onishi, Ryosuke Tokuami, Yasuyuki Kono, Satoshi Nakamura |
| 2012 | AVI | Search intent estimation from user's eye movements for supporting information seeking. | Kazutoshi Umemoto, Takehiro Yamamoto, Satoshi Nakamura, Katsumi Tanaka |
| 2012 | CogSci | Satisfaction evaluation and time perception for waiting time in ICT usage under dual task situation. | Sumaru Niida, Satoshi Nakamura, Tomomi Moroga, Etsuko T. Harada, Satoshi Uemura |
| 2012 | ICASSP | A bootstrapping approach for SLU portability to a new language by inducting unannotated user queries. | Teruhisa Misu, Etsuo Mizukami, Hideki Kashioka, Satoshi Nakamura, Haizhou Li |
| 2011 | ASRU | Blind noise suppression for Non-Audible Murmur recognition with stereo signal processing. | Shunta Ishii, Tomoki Toda, Hiroshi Saruwatari, Sakriani Sakti, Satoshi Nakamura |
| 2011 | CIKM | RerankEverything: a reranking interface for exploring search results. | Takehiro Yamamoto, Satoshi Nakamura, Katsumi Tanaka |
| 2011 | CIKM | Extracting adjective facets from community Q&A corpus. | Takehiro Yamamoto, Satoshi Nakamura, Katsumi Tanaka |
| 2011 | HCI | 3-D Sound Reproduction System for Immersive Environments Based on the Boundary Surface Control Principle. | Seigo Enomoto, Yusuke Ikeda, Shiro Ise, Satoshi Nakamura |
| 2011 | HCI | Personalized Voice Assignment Techniques for Synchronized Scenario Speech Output in Entertainment Systems. | Shinichi Kawamoto, Tatsuo Yotsukura, Satoshi Nakamura, Shigeo Morishima |
| 2011 | HCI | Providing Immersive Virtual Experience with First-Person Perspective Omnidirectional Movies and Three Dimensional Sound Field. | Kazuaki Kondo, Yasuhiro Mukaigawa, Yusuke Ikeda, Seigo Enomoto, Shiro Ise, Satoshi Nakamura, Yasushi Yagi |
| 2011 | HCI | Instant Movie Casting with Personality: Dive into the Movie System. | Shigeo Morishima, Yasushi Yagi, Satoshi Nakamura |
| 2011 | ICASSP | Unsupervised determination of efficient Korean LVCSR units using a Bayesian Dirichlet process model. | Sakriani Sakti, Andrew M. Finch, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2011 | ICASSP | Increasing discriminative capability on MAP-based mapping function estimation for acoustic model adaptation. | Yu Tsao, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2011 | ICASSP | A sampling-based environment population projection approach for rapid acoustic model adaptation. | Yu Tsao, Shigeki Matsuda, Shinsuke Sakai, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2011 | Interspeech | Adaptive Regularization Framework for Robust Voice Activity Detection. | Xugang Lu, Masashi Unoki, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2011 | Interspeech | User Study of Spoken Decision Support System. | Teruhisa Misu, Kiyonori Ohtake, Chiori Hori, Hisashi Kawai, Satoshi Nakamura |
| 2010 | DEXA | Plus One or Minus One: A Method to Browse from an Object to Another Object by Adding or Deleting an Element. | Kosetsu Tsukuda, Takehiro Yamamoto, Satoshi Nakamura, Katsumi Tanaka |
| 2010 | Interspeech | Brazilian portuguese acoustic model training based on data borrowing from other language. | Kazuhiko Abe, Sakriani Sakti, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2010 | Interspeech | Cluster-based language model for spoken document retrieval using NMF-based document clustering. | Xinhui Hu, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2010 | Interspeech | Construction and evaluations of an annotated Chinese conversational corpus in travel domain for the language model of speech recognition. | Xinhui Hu, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2010 | Interspeech | Voice activity detection in a reguarized reproducing kernel hilbert space. | Xugang Lu, Masashi Unoki, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2010 | Interspeech | Utilizing a noisy-channel approach for Korean LVCSR. | Sakriani Sakti, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2009 | ASRU | Weighted finite state transducer based statistical dialog management. | Chiori Hori, Kiyonori Ohtake, Teruhisa Misu, Hideki Kashioka, Satoshi Nakamura |
| 2009 | ASRU | The Asian network-based speech-to-speech translation system. | Sakriani Sakti, Noriyuki Kimura, Michael Paul, Chiori Hori, Eiichiro Sumita, Satoshi Nakamura, Jun Park, Chai Wutiwiwatchai, Bo Xu, Hammam Riza, Karunesh Arora, Chi Mai Luong, Haizhou Li |
| 2009 | ASRU | MAP estimation of online mapping parameters in ensemble speaker and speaking environment modeling. | Yu Tsao, Shigeki Matsuda, Satoshi Nakamura, Chin-Hui Lee |
| 2009 | DEXA | Reranking and Classifying Search Results Exhaustively Based on Edit-and-Propagate Operations. | Takehiro Yamamoto, Satoshi Nakamura, Katsumi Tanaka |
| 2009 | ICASSP | Automatic voice assignment tool for Instant Casting movie System. | Yoshihiro Adachi, Shinichi Kawamoto, Tatsuo Yotsukura, Shigeo Morishima, Satoshi Nakamura |
| 2009 | ICASSP | Statistical dialog management applied to WFST-based dialog systems. | Chiori Hori, Kiyonori Ohtake, Teruhisa Misu, Hideki Kashioka, Satoshi Nakamura |
| 2009 | ICASSP | Temporal contrast normalization and edge-preserved smoothing on temporal modulation structure for robust speech recognition. | Xugang Lu, Shigeki Matsuda, Masashi Unoki, Tohru Shimizu, Satoshi Nakamura |
| 2009 | ICASSP | CART-based modeling of Chinese tonal patterns with a functional model tracing the fundamental frequency trajectories. | Jinfu Ni, Shinsuke Sakai, Tohru Shimizu, Satoshi Nakamura |
| 2009 | ICASSP | Optimal learning of P-Layer additive F0 models with cross-validation. | Shinsuke Sakai, Tatsuya Kawahara, Tohru Shimizu, Satoshi Nakamura |
| 2009 | Interspeech | Recent advances in WFST-based dialog system. | Chiori Hori, Kiyonori Ohtake, Teruhisa Misu, Hideki Kashioka, Satoshi Nakamura |
| 2009 | Interspeech | Subband temporal modulation spectrum normalization for automatic speech recognition in reverberant environments. | Xugang Lu, Masashi Unoki, Satoshi Nakamura |
| 2009 | Interspeech | A decision tree-based clustering approach to state definition in an excitation modeling framework for HMM-based speech synthesis. | Ranniery Maia, Tomoki Toda, Keiichi Tokuda, Shinsuke Sakai, Satoshi Nakamura |
| 2009 | Interspeech | A study on soft margin estimation of linear regression parameters for speaker adaptation. | Shigeki Matsuda, Yu Tsao, Jinyu Li, Satoshi Nakamura, Chin-Hui Lee |
| 2009 | Interspeech | Annotating communicative function and semantic content in dialogue act for construction of consulting dialogue systems. | Teruhisa Misu, Kiyonori Ohtake, Chiori Hori, Hideki Kashioka, Satoshi Nakamura |
| 2009 | Interspeech | A close look into the probabilistic concatenation model for corpus-based speech synthesis. | Shinsuke Sakai, Ranniery Maia, Hisashi Kawai, Satoshi Nakamura |
| 2008 | CIKM | Can social annotation support users in evaluating the trustworthiness of video clips? | Satoshi Nakamura, Makoto Shimizu, Katsumi Tanaka |
| 2008 | COLING | Multilingual Mobile-Phone Translation Services for World Travelers. | Michael Paul, Hideo Okuma, Hirofumi Yamamoto, Eiichiro Sumita, Shigeki Matsuda, Tohru Shimizu, Satoshi Nakamura |
| 2008 | IJCNLP | Development of Indonesian Large Vocabulary Continuous Speech Recognition System within A-STAR Project. | Sakriani Sakti, Eka Kelana, Hammam Riza, Shinsuke Sakai, Konstantin Markov, Satoshi Nakamura |
| 2008 | Interspeech | Dialog management using weighted finite-state transducers. | Chiori Hori, Kiyonori Ohtake, Teruhisa Misu, Hideki Kashioka, Satoshi Nakamura |
| 2008 | Interspeech | Improved novelty detection for online GMM based speaker diarization. | Konstantin Markov, Satoshi Nakamura |
| 2008 | Interspeech | CENSREC-4: development of evaluation framework for distant-talking speech recognition under reverberant environments. | Masato Nakayama, Takanobu Nishiura, Yuki Denda, Norihide Kitaoka, Kazumasa Yamamoto, Takeshi Yamada, Satoru Tsuge, Chiyomi Miyajima, Masakiyo Fujimoto, Tetsuya Takiguchi, Satoshi Tamura, Tetsuji Ogawa, Shigeki Matsuda, Shingo Kuroiwa, Kazuya Takeda, Satoshi Nakamura |
| 2007 | ACL | NICT-ATR Speech-to-Speech Translation System. | Eiichiro Sumita, Tohru Shimizu, Satoshi Nakamura |
| 2007 | ASRU | Development of VAD evaluation framework CENSREC-1-C and investigation of relationship between VAD and speech recognition performance. | Norihide Kitaoka, Kazumasa Yamamoto, Tomohiro Kusamizu, Seiichi Nakagawa, Takeshi Yamada, Satoru Tsuge, Chiyomi Miyajima, Takanobu Nishiura, Masato Nakayama, Yuki Denda, Masakiyo Fujimoto, Tetsuya Takiguchi, Satoshi Tamura, Shingo Kuroiwa, Kazuya Takeda, Satoshi Nakamura |
| 2007 | ASRU | Never-ending learning system for on-line speaker diarization. | Konstantin Markov, Satoshi Nakamura |
| 2007 | DEXA | Rerank-by-Example: Efficient Browsing of Web Search Results. | Takehiro Yamamoto, Satoshi Nakamura, Katsumi Tanaka |
| 2007 | ICASSP | Use of Poisson Processes to Generate Fundamental Frequency Contours. | Jinfu Ni, Satoshi Nakamura |
| 2007 | Interspeech | Never-ending learning with dynamic hidden Markov network. | Konstantin Markov, Satoshi Nakamura |
| 2006 | ICASSP | Sequential Non-Stationary Noise Tracking Using Particle Filtering with Switching Dynamical System. | Masakiyo Fujimoto, Satoshi Nakamura |
| 2006 | ICASSP | Incorporation of Pentaphone-Context Dependency Based on Hybrid Hmm/Bn Acoustic Modeling Framework. | Sakriani Sakti, Konstantin Markov, Satoshi Nakamura |
| 2006 | ICASSP | Automatic Derivation of a Phoneme Set with Tone Information for Chinese Speech Recognition Based on Mutual Information Criterion. | Jinsong Zhang, Xinhui Hu, Satoshi Nakamura |
| 2006 | Interspeech | Forward-backwards training of hybrid HMM/BN acoustic models. | Konstantin Markov, Satoshi Nakamura |
| 2006 | Interspeech | CENSREC2: corpus and evaluation environments for in car continuous digit speech recognition. | Satoshi Nakamura, Masakiyo Fujimoto, Kazuya Takeda |
| 2005 | APWEB | Content Browsing by Walking in Real and Cyber Spaces. | Satoshi Nakamura, Sooyeon Oh, Mitsuru Minakuchi, Rieko Kadobayashi |
| 2005 | ICASSP | Particle Filter Based Non-Stationary Noise Tracking for Robust Speech Recognition. | Masakiyo Fujimoto, Satoshi Nakamura |
| 2005 | ICASSP | Joint optimization of LCMV beamforming and acoustic echo cancellation for automatic speech recognition. | Wolfgang Herbordt, Satoshi Nakamura, Walter Kellermann |
| 2005 | ICASSP | Modeling Successive Frame Dependencies with Hybrid HMM/BN Acoustic Model. | Konstantin Markov, Satoshi Nakamura |
| 2005 | ICASSP | Online cepstral filtering using a sequential EM approach with Polyak averaging and feedback. | Tor Andr Myrvoll, Satoshi Nakamura |
| 2005 | ICDE | CENSREC-3: Data Collection for In-Car Speech Recognition and Its Common Evaluation Framework. | Masakiyo Fujimoto, Satoshi Nakamura, Toshiki Endo, Kazuya Takeda, Chiyomi Miyajima, Shingo Kuroiwa, Takeshi Yamada, Norihide Kitaoka, Kazumasa Yamamoto, Mitsunori Mizumachi, Takanobu Nishiura, Akira Sasou |
| 2005 | ICIP | Automatic indexing of broadcast content using its live chat on the Web. | Hishasi Miyamori, Satoshi Nakamura, Katsumi Tanaka |
| 2005 | Interspeech | Spoken dialog system and its evaluation of geographic information system for elderly persons' mobility support. | Takatoshi Jitsuhiro, Shigeki Matsuda, Yutaka Ashikari, Satoshi Nakamura, Ikuko Eguchi Yairi, Seiji Igi |
| 2005 | Interspeech | Outlier detection for acoustic model training using robust statistics. | Shigeki Matsuda, Wolfgang Herbordt, Satoshi Nakamura |
| 2004 | ICASSP | Automatic generation of non-uniform HMM structures based on variational Bayesian approach. | Takatoshi Jitsuhiro, Satoshi Nakamura |
| 2004 | ICASSP | Out-of-domain detection based on confidence measures from multiple topic classification. | Ian R. Lane, Tatsuya Kawahara, Tomoko Matsui, Satoshi Nakamura |
| 2004 | ICASSP | Minimum mean square error filtering of noisy cepstral coefficients with applications to ASR. | Tor Andr Myrvoll, Satoshi Nakamura |
| 2004 | Interspeech | Speech recognition for multiple non-native accent groups with speaker-group-dependent acoustic models. | Tobias Cincarek, Rainer Gruhn, Satoshi Nakamura |
| 2004 | Interspeech | A statistical lexicon for non-native speech recognition. | Rainer Gruhn, Konstantin Markov, Satoshi Nakamura |
| 2004 | Interspeech | Increasing the mixture components of non-uniform HMM structures based on a variational Bayesian approach. | Takatoshi Jitsuhiro, Satoshi Nakamura |
| 2004 | Interspeech | Topic classification and verification modeling for out-of-domain utterance detection. | Tatsuya Kawahara, Ian Richard Lane, Tomoko Matsui, Satoshi Nakamura |
| 2004 | Interspeech | Robust verification of recognized words in noise. | Wai Kit Lo, Frank K. Soong, Satoshi Nakamura |
| 2004 | Interspeech | Integration of articulatory dynamic parameters in HMM/BN based speech recognition system. | Konstantin Markov, Satoshi Nakamura, Jianwu Dang |
| 2004 | Interspeech | Speech recognition system robust to noise and speaking styles. | Shigeki Matsuda, Takatoshi Jitsuhiro, Konstantin Markov, Satoshi Nakamura |
| 2004 | Interspeech | Online minimum mean square error filtering of noisy cepstral coefficients using a sequential EM algorithm. | Tor Andr Myrvoll, Satoshi Nakamura |
| 2004 | Interspeech | Indonesian speech recognition for hearing and speaking impaired people. | Sakriani Sakti, Arry Akhmad Arman, Satoshi Nakamura, Paulus Hutagaol |
| 2003 | ICASSP | Hybrid HMM/BN LVCSR system integrating multiple acoustic features. | Konstantin Markov, Satoshi Nakamura |
| 2003 | ICASSP | An evaluation of adaptive beamformer based on average speech spectrum for noisy speech recognition. | Takanobu Nishiura, Masato Nakayama, Satoshi Nakamura |
| 2003 | ICASSP | A multilevel framework to model the inherently confounding nature of sentential F0sentential F0 contours contours for recognizing Chinese lexical tones. | Jinsong Zhang, Keikichi Hirose, Satoshi Nakamura |
| 2003 | Interspeech | Detection and separation of speech segment using audio and video information fusion. | Futoshi Asano, Yoichi Motomura, Hideki Asoh, Takashi Yoshimura, Naoyuki Ichimura, Kiyoshi Yamamoto, Nobuhiko Kitawaki, Satoshi Nakamura |
| 2003 | Interspeech | Missing feature theory applied to robust speech recognition over IP network. | Toshiki Endo, Shingo Kuroiwa, Satoshi Nakamura |
| 2003 | Interspeech | A semi-blind source separation method for hands-free speech recognition of multiple talkers. | Panikos Heracleous, Satoshi Nakamura, Kiyohiro Shikano |
| 2003 | Interspeech | Automatic generation of non-uniform context-dependent HMM topologies based on the MDL criterion. | Takatoshi Jitsuhiro, Tomoko Matsui, Satoshi Nakamura |
| 2003 | Interspeech | Hierarchical topic classification for dialog speech recognition based on language model switching. | Ian R. Lane, Tatsuya Kawahara, Tomoko Matsui, Satoshi Nakamura |
| 2003 | Interspeech | Hybrid HMM/BN ASR system integrating spectrum and articulatory features. | Konstantin Markov, Jianwu Dang, Yosuke Iizuka, Satoshi Nakamura |
| 2003 | Interspeech | Noise reduction using paired-microphones on non-equally-spaced microphone arrangement. | Mitsunori Mizumachi, Satoshi Nakamura |
| 2003 | Interspeech | Environmental sound source identification based on hidden Markov model for robust speech recognition. | Takanobu Nishiura, Satoshi Nakamura, Kazuhiro Miki, Kiyohiro Shikano |
| 2002 | ICASSP | Audio-visual speech translation with automatic lip syncqronization and face tracking based on 3-D head model. | Shigeo Morishima, Shin Ogata, Kazumasa Murai, Satoshi Nakamura |
| 2002 | ICASSP | Robust bi-modal speech recognition based on state synchronous modeling and stream weight optimization. | Satoshi Nakamura, Ken'ichi Kumatani, Satoshi Tamura |
| 2002 | ICASSP | Talker localization in a real acoustic environment based on DOA estimation and statistical sound source identification. | Takanobu Nishiura, Satoshi Nakamura, Kiyohiro Shikano |
| 2002 | ICASSP | Noise adaptive speech recognition in time-varying noise based on sequential kullback proximal algorithm. | Kaisheng Yao, Kuldip K. Paliwal, Satoshi Nakamura |
| 2002 | ICMI | Multi-Modal Translation System and Its Evaluation. | Shigeo Morishima, Satoshi Nakamura |
| 2002 | ICMI | 3-D N-Best Search for Simultaneous Recognition of Distant-Talking Speech of Multiple Talkers. | Satoshi Nakamura, Panikos Heracleous |
| 2002 | ICMI | Multi-Modal Temporal Asynchronicity Modeling by Product HMMs for Robust. | Satoshi Nakamura, Ken'ichi Kumatani, Satoshi Tamura |
| 2002 | Interspeech | Weighted graph based decision tree optimization for high accuracy acoustic modeling. | Sheng Gao, Jinsong Zhang, Satoshi Nakamura, Chin-Hui Lee, Tat-Seng Chua |
| 2002 | Interspeech | HMM COmposition-based rapid model adaptation using a priori noise GMM adaptation evaluation on Aurora2 corpus. | Masaki Ida, Satoshi Nakamura |
| 2002 | Interspeech | Modeling HMM state distributions with Bayesian networks. | Konstantin Markov, Satoshi Nakamura |
| 2002 | Interspeech | The 2ch hybrid subtractive beamformer applied to line sound sources. | Mitsunori Mizumachi, Satoshi Nakamura |
| 2002 | Interspeech | Suitable design of adaptive beamformer based on average speech spectrum for noisy speech recognition. | Takanobu Nishiura, Satoshi Nakamura, Yuka Okada, Takeshi Yamada, Kiyohiro Shikano |
| 2002 | Interspeech | Speaking rate compensation based on likelihood criterion in acoustic model training and decoding. | Kozo Okuda, Tatsuya Kawahara, Satoshi Nakamura |
| 2001 | ICASSP | A microphone array-based 3-D N-best search algorithm for the simultaneous recognition of multiple sound sources in real environments. | Panikos Heracleous, Satoshi Nakamura, Kiyohiro Shikano |
| 2001 | ICASSP | Discriminative training of HMM using maximum normalized likelihood algorithm. | Konstantin Markov, Seiichi Nakagawa, Satoshi Nakamura |
| 2001 | Interspeech | Sub-band based additive noise removal for robust speech recognition. | Jingdong Chen, Kuldip K. Paliwal, Satoshi Nakamura |
| 2001 | Interspeech | Noise reduction using paired-microphones for both far-field and near-field sound sources. | Mitsunori Mizumachi, Satoshi Nakamura |
| 2001 | Interspeech | Statistical sound source identification in a real acoustic environment for robust speech recognition using a microphone array. | Takanobu Nishiura, Satoshi Nakamura, Kiyohiro Shikano |
| 2001 | Interspeech | Towards the creation of acoustic models for stressed Japanese speech. | Kozo Okuda, Tomoko Matsui, Satoshi Nakamura |
| 2000 | ICASSP | Localization of multiple sound sources based on a CSP analysis with a microphone array. | Takanobu Nishiura, Takeshi Yamada, Satoshi Nakamura, Kiyohiro Shikano |
| 2000 | ICASSP | Speech recognition for a distant moving speaker based on HMM composition and separation. | Tetsuya Takiguchi, Satoshi Nakamura, Kiyohiro Shikano |
| 2000 | Interspeech | Robust fundamental frequency estimation using instantaneous frequencies of harmonic components. | Yoshinori Atake, Toshio Irino, Hideki Kawahara, Jinlin Lu, Satoshi Nakamura, Kiyohiro Shikano |
| 2000 | Interspeech | A block cosine transform and its application in speech recognition. | Jingdong Chen, Kuldip K. Paliwal, Satoshi Nakamura |
| 2000 | Interspeech | Cellular-phone based speech-to-speech translation system ATR-MATRIX. | Rainer Gruhn, Harald Singer, Hajime Tsukada, Masaki Naito, Atsushi Nishino, Atsushi Nakamura, Yoshinori Sagisaka, Satoshi Nakamura |
| 2000 | Interspeech | Frame level likelihood transformations for ASR and utterance verification. | Konstantin P. Markov, Satoshi Nakamura |
| 2000 | Interspeech | Analysis of acoustic models trained on a large-scale Japanese speech database. | Tomoko Matsui, Masaki Naito, Yoshinori Sagisaka, Kozo Okuda, Satoshi Nakamura |
| 2000 | Interspeech | Design of robust subtractive beamformer for noisy speech recognition. | Mitsunori Mizumachi, Masato Akagi, Satoshi Nakamura |
| 2000 | Interspeech | Stream weight optimization of speech and lip image sequence for audio-visual speech recognition. | Satoshi Nakamura, Hidetoshi Ito, Kiyohiro Shikano |
| 2000 | Interspeech | Multimodal corpora for human-machine interaction research. | Satoshi Nakamura, Keiko Watanuki, Toshiyuki Takezawa, Satoru Hayamizu |
| 1999 | Interspeech | Simultaneous recognition of multiple sound sources based on 3-d n-best search using microphone array. | Panikos Heracleous, Takeshi Yamada, Satoshi Nakamura, Kiyohiro Shikano |
| 1999 | Interspeech | Data collection in real acoustical environments for sound scene understanding and hands-free speech recognition. | Satoshi Nakamura, Kazuo Hiyane, Futoshi Asano, Takeshi Yamada, Takashi Endo |
| 1998 | ICASSP | Efficient representation of short-time phase based on group delay. | Hideki Banno, Jinlin Lu, Satoshi Nakamura, Kiyohiro Shikano, Hideki Kawahara |
| 1998 | ICASSP | Robust speech recognition in car environments. | Makoto Shozakai, Satoshi Nakamura, Kiyohiro Shikano |
| 1998 | ICASSP | Hands-free speech recognition based on 3-D Viterbi search using a microphone array. | Takeshi Yamada, Satoshi Nakamura, Kiyohiro Shikano |
| 1998 | Interspeech | Creating speaker independent HMM models for restricted database using STRAIGHT-TEMPO morphing. | Alexandre Girardi, Kiyohiro Shikano, Satoshi Nakamura |
| 1997 | ICASSP | Model adaptation based on HMM decomposition for reverberant speech recognition. | Tetsuya Takiguchi, Satoshi Nakamura, Qiang Hou, Kiyohiro Shikano |
| 1997 | Interspeech | Maximum likelihood successive state splitting algorithm for tied-mixture HMNET. | Alexandre Girardi, Harald Singer, Kiyohiro Shikano, Satoshi Nakamura |
| 1997 | Interspeech | Microphone array design measures for hands-free speech recognition. | Masaaki Inoue, Satoshi Nakamura, Takeshi Yamada, Kiyohiro Shikano |
| 1997 | Interspeech | Improved bimodal speech recognition using tied-mixture HMMs and 5000 word audio-visual synchronous database. | Satoshi Nakamura, Ron Nagai, Kiyohiro Shikano |
| 1997 | Interspeech | Room acoustics and reverberation: impact on hands-free recognition. | Satoshi Nakamura, Kiyohiro Shikano |
| 1996 | ICASSP | Noise and room acoustics distorted speech recognition by HMM composition. | Satoshi Nakamura, Tetsuya Takiguchi, Kiyohiro Shikano |
| 1993 | Interspeech | Robust word spotting in adverse car environments. | Satoshi Nakamura, Toshio Akabane, Seiji Hamaguchi |
| 1991 | ICASSP | A neural speaker model for speaker clustering. | Satoshi Nakamura, Toshio Akabane |
| 1990 | ICASSP | ATR HMM-LR continuous speech recognition system. | Toshiyuki Hanazawa, Kenji Kita, Satoshi Nakamura, Takeshi Kawabata, Kiyohiro Shikano |
| 1990 | ICASSP | Supplementation of HMM for articulatory variation in speaker adaptation. | Hiroaki Hattori, Satoshi Nakamura, Kiyohiro Shikano |
| 1990 | ICASSP | A comparative study of spectral mapping for speaker adaptation. | Satoshi Nakamura, Kiyohiro Shikano |
| 1990 | Interspeech | Speaker weighted training of HMM using multiple reference speakers. | Hiroaki Hattori, Satoshi Nakamura, Kiyohiro Shikano, Shigeki Sagayama |
| 1989 | ICASSP | Speaker adaptation applied to HMM and neural networks. | Satoshi Nakamura, Kiyohiro Shikano |
| 1988 | ICASSP | Voice conversion through vector quantization. | Masanobu Abe, Satoshi Nakamura, Kiyohiro Shikano, Hisao Kuwabara |