Skip to content

Satoshi Nakamura

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

440

Venues

29

Active years

1988–2026

Best venue rank

A*

Where they publish

Papers

Showing the 300 most recent indexed papers.

YearVenueTitleAuthors
2026AAAISASST: Leveraging Syntax-Aware Chunking and LLMs for Simultaneous Speech Translation.Zeyu Yang, Lai Wei, Roman Koshkin, Xi Chen, Satoshi Nakamura
2026ACLRedefining Machine Simultaneous Interpretation: From Incremental Translation to Human-Like Strategies.Qianen Zhang, Zeyu Yang, Satoshi Nakamura
2026AVIDoes Removing Pen Pressure in Cost-Cutting Pen Designs Matter for Handwritten Learning in Education? A Case Study of Geometry Problem Solving.Yuki Miyazaki, Sari Kobayashi, Satoshi Nakamura, Akiyuki Kake
2026CHIBridge Over Troubled Water: Aligning Commercial Incentives With Ethical Design Practice To Combat Deceptive Patterns.Thomas Emeyer, Johanna Gunawan, Colin M. Gray, Lorena Snchez Chamorro, Alberto Monge Roffarello, Katie Seaborn, Hauke Sandhaus, Kai Lukoff, Gian-Luca Savino, Shruthi Sai Chivukula, Satoshi Nakamura
2026CHIImproving Data Quality via Pre-Task Participant Screening in Crowdsourced GUI Experiments.Takaya Miyama, Satoshi Nakamura, Shota Yamanaka
2026CHIDrawing Attention: A Field Study of Sketch-Based Penguin Identification for Aquarium Visitor Engagement.Yuki Nakagawa, Satoshi Nakamura
2025ASRULearning Marmoset Vocal Patterns with a Masked Autoencoder for Robust Call Segmentation, Classification, and Caller Identification.Bin Wu, Shinnosuke Takamichi, Sakriani Sakti, Satoshi Nakamura
2025CHIGlobal and Transdisciplinary Perspectives on Dark Patterns and Deceptive Design Practice: ダークパターンとひとをだますデザインに関する国際的かつ学際的な交流.Katie Seaborn, Colin M. Gray, Johanna Gunawan, Thomas Mildner, Ren Schfer, Lorena Snchez Chamorro, Satoshi Nakamura
2024ACLLLaST: Improved End-to-end Speech Translation System Leveraged by Large Language Models.Xi Chen, Songyang Zhang, Qibing Bai, Kai Chen, Satoshi Nakamura
2024AVITsumeColorGram: A Method of Estimating an Object's Weight Based on the Thumb's Nail Color.Sayuri Matsuda, Satoshi Nakamura
2024AVIDrawing-type Search Method Focusing on Penguin's Abdominal Patterns for Enriching Observation Experiences in an Aquarium.Yuki Nakagawa, Satoshi Nakamura
2024COLINGNAIST-SIC-Aligned: An Aligned English-Japanese Simultaneous Interpretation Corpus.Jinming Zhao, Katsuhito Sudoh, Satoshi Nakamura, Yuka Ko, Kosuke Doi, Ryo Fukuda
2024EMNLPLLMs Are Zero-Shot Context-Aware Simultaneous Translators.Roman Koshkin, Katsuhito Sudoh, Satoshi Nakamura
2024EMNLPTransLLaMa: LLM-based Simultaneous Translation System.Roman Koshkin, Katsuhito Sudoh, Satoshi Nakamura
2023ACIISocial Performance Rating During Social Skills Training in Adults with Autism Spectrum Disorder and Schizophrenia.Kana Miyamoto, Hiroki Tanaka, Jennifer Hamet Bagnou, Elise Prigent, Cline Clavel, Jean-Claude Martin, Satoshi Nakamura
2023EACLEvaluating the Robustness of Discrete Prompts.Yoichi Ishibashi, Danushka Bollegala, Katsuhito Sudoh, Satoshi Nakamura
2023HAIMultimodal Voice Activity Prediction: Turn-taking Events Detection in Expert-Novice Conversation.Kazuyo Onishi, Hiroki Tanaka, Satoshi Nakamura
2023HCIBingoFit: A Bingo Clothes Presentation System for Utilizing Owned Clothes.Yukino Aoki, Kouta Yokoyama, Satoshi Nakamura
2023HCIDo People Tend to Select a Delayed Item?Yuichiro Kinoshita, Yuto Sekiguchi, Riho Ueki, Kouta Yokoyama, Satoshi Nakamura
2023HCIGlasses Encourage Your Choices: A System that Supports Indecisive Choosers by Eye-Tracking.Tatsuya Komatsubara, Satoshi Nakamura
2023HCIA Study on the Effects of Intrinsic Motivation from Self-determination on Driving Skill.Yuki Nakagawa, Sayuri Matsuda, Takumi Takaku, Satoshi Nakamura, Takanori Komatsu, Takeshi Torii, Ryuichi Sumikawa, Hideyuki Takao
2023HCIDoes the Average Color Influence Selection?Yuto Sekiguchi, Riho Ueki, Kouta Yokoyama, Satoshi Nakamura
2023HCIDoes the Type of Font Face Induce the Selection?Riho Ueki, Kouta Yokoyama, Satoshi Nakamura
2023HCIA Basic Study to Prevent Non-earnest Responses in Web Surveys by Arranging the Order of Open-Ended Questions.Ikumi Yamazaki, Ken'ichi Hatanaka, Satoshi Nakamura, Takanori Komatsu
2023ICASSPSelf-Adaptive Incremental Machine Speech Chain for Lombard TTS with High-Granularity ASR Feedback in Dynamic Noise Condition.Sashi Novitasari, Sakriani Sakti, Satoshi Nakamura
2023ICMIComputational analyses of linguistic features with schizophrenic and autistic traits along with formal thought disorders.Takeshi Saga, Hiroki Tanaka, Satoshi Nakamura
2023ICMIAn Adaptive Virtual Agent Platform for Automated Social Skills Training.Takeshi Saga, Jieyeon Woo, Alexis Gerard, Hiroki Tanaka, Catherine Achard, Satoshi Nakamura, Catherine Pelachaud
2023ICMI4th Workshop on Social Affective Multimodal Interaction for Health (SAMIH).Hiroki Tanaka, Satoshi Nakamura, Jean-Claude Martin, Catherine Pelachaud
2023InterspeechAverage Token Delay: A Latency Metric for Simultaneous Translation.Yasumasa Kano, Katsuhito Sudoh, Satoshi Nakamura
2023InterspeechInter-connection: Effective Connection between Pre-trained Encoder and Decoder for Speech Translation.Yuta Nishikawa, Satoshi Nakamura
2022HCIDriving Experiment System Using HMDs to Measure Drivers' Proficiency and Difficulty of Various Road Conditions.Yukina Funazaki, Noboru Seto, Kota Ninomiya, Kazuyuki Hikawa, Satoshi Nakamura, Shota Yamanaka
2022ICMI3rd Workshop on Social Affective Multimodal Interaction for Health (SAMIH).Hiroki Tanaka, Satoshi Nakamura, Kazuhiro Shidara, Jean-Claude Martin, Catherine Pelachaud
2022ICPRA Method to Annotate Who Speaks a Text Line in Manga and Speaker-Line Dataset for Manga109.Tsubasa Sakurai, Risa Ito, Kazuki Abe, Satoshi Nakamura
2022ICPRConsidering Meanings and Effects of Frames Without Onomatopoeias in Japanese Comics.Riko Sugita, Minami Okajima, Takanori Komatsu, Satoshi Nakamura
2022InterspeechSpeech Segmentation Optimization using Segmented Bilingual Speech Corpus for End-to-end Speech Translation.Ryo Fukuda, Katsuhito Sudoh, Satoshi Nakamura
2022InterspeechApplying Syntax-Prosody Mapping Hypothesis and Prosodic Well-Formedness Constraints to Neural Sequence-to-Sequence Speech Synthesis.Kei Furukawa, Takeshi Kishiyama, Satoshi Nakamura
2022InterspeechMultimodal Persuasive Dialogue Corpus using Teleoperated Android.Seiya Kawano, Muteki Arioka, Akishige Yuguchi, Kenta Yamamoto, Koji Inoue, Tatsuya Kawahara, Satoshi Nakamura, Koichiro Yoshino
2022InterspeechImproved Consistency Training for Semi-Supervised Sequence-to-Sequence ASR via Speech Chain Reconstruction and Self-Transcribing.Heli Qi, Sashi Novitasari, Sakriani Sakti, Satoshi Nakamura
2021ACIIRelationship between Mood Improvement and Questioning to Evaluate Automatic Thoughts in Cognitive Restructuring with a Virtual Agent.Kazuhiro Shidara, Hiroki Tanaka, Hiroyoshi Adachi, Daisuke Kanayama, Yukako Sakagami, Takashi Kudo, Satoshi Nakamura
2021ICMIMeta-Learning for Emotion Prediction from EEG while Listening to Music.Kana Miyamoto, Hiroki Tanaka, Satoshi Nakamura
2021ICMIMultimodal Dataset of Social Skills Training in Natural Conversational Setting.Takeshi Saga, Hiroki Tanaka, Hidemi Iwasaka, Yasuhiro Matsuda, Tsubasa Morimoto, Mitsuhiro Uratani, Kosuke Okazaki, Yuichiro Fujimoto, Satoshi Nakamura
2021ICMI2nd Workshop on Social Affective Multimodal Interaction for Health (SAMIH).Hiroki Tanaka, Satoshi Nakamura, Jean-Claude Martin, Catherine Pelachaud
2021InteractDo Animation Direction and Position of Progress Bar Affect Selections?Kota Yokoyama, Satoshi Nakamura, Shota Yamanaka
2021InterspeechWeakly-Supervised Speech-to-Text Mapping with Visually Connected Non-Parallel Speech-Text Data Using Cyclic Partially-Aligned Transformer.Johanes Effendi, Sakriani Sakti, Satoshi Nakamura
2021InterspeechASR Posterior-Based Loss for Multi-Task End-to-End Speech Translation.Yuka Ko, Katsuhito Sudoh, Sakriani Sakti, Satoshi Nakamura
2021InterspeechDynamically Adaptive Machine Speech Chain Inference for TTS in Noisy Environment: Listen and Speak Louder.Sashi Novitasari, Sakriani Sakti, Satoshi Nakamura
2020ACLReflection-based Word Attribute Transfer.Yoichi Ishibashi, Katsuhito Sudoh, Koichiro Yoshino, Satoshi Nakamura
2020ACLAutomatic Machine Translation Evaluation using Source Language Inputs and Cross-lingual Language Model.Kosuke Takahashi, Katsuhito Sudoh, Satoshi Nakamura
2020COLINGIncorporating Noisy Length Constraints into Transformer with Length-aware Positional Encodings.Yui Oka, Katsuki Chousa, Katsuhito Sudoh, Satoshi Nakamura
2020COLINGImproving Spoken Language Understanding by Wisdom of Crowds.Koichiro Yoshino, Kana Ikeuchi, Katsuhito Sudoh, Satoshi Nakamura
2020HCIComparison of the Remembering Ability by the Difference Between Handwriting and Typeface.Risa Ito, Karin Hamano, Kosuke Nonaka, Ippei Sugano, Satoshi Nakamura, Akiyuki Kake, Kizuku Ishimaru
2020HCIAbstract Thinking Description System for Programming Education Facilitation.Yasutsuna Matayoshi, Satoshi Nakamura
2020ICASSPUsing Panoramic Videos for Multi-Person Localization and Tracking In A 3D Panoramic Coordinate.Fan Yang, Feiran Li, Yang Wu, Sakriani Sakti, Satoshi Nakamura
2020ICASSPDEJA-VU: Double Feature Presentation and Iterated Loss in Deep Transformer Networks.Andros Tjandra, Chunxi Liu, Frank Zhang, Xiaohui Zhang, Yongqiang Wang, Gabriel Synnaeve, Satoshi Nakamura, Geoffrey Zweig
2020ICMIMusic Generation and Emotion Estimation from EEG Signals for Inducing Affective States.Kana Miyamoto, Hiroki Tanaka, Satoshi Nakamura
2020ICMIObjective Prediction of Social Skills Level for Automated Social Skills Training Using Audio and Text Information.Takeshi Saga, Hiroki Tanaka, Hidemi Iwasaka, Satoshi Nakamura
2020ICMIAnalysis of Mood Changes and Facial Expressions during Cognitive Behavior Therapy through a Virtual Agent.Kazuhiro Shidara, Hiroki Tanaka, Hiroyoshi Adachi, Daisuke Kanayama, Yukako Sakagami, Takashi Kudo, Satoshi Nakamura
2020ICMISocial Affective Multimodal Interaction for Health.Hiroki Tanaka, Satoshi Nakamura, Jean-Claude Martin, Catherine Pelachaud
2020InterspeechAugmenting Images for ASR and TTS Through Single-Loop and Dual-Loop Multimodal Chain Framework.Johanes Effendi, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2020InterspeechIncremental Machine Speech Chain Towards Enabling Listening While Speaking in Real-Time.Sashi Novitasari, Andros Tjandra, Tomoya Yanagita, Sakriani Sakti, Satoshi Nakamura
2020InterspeechCombining Audio and Brain Activity for Predicting Speech Quality.Ivan Halim Parmonangan, Hiroki Tanaka, Sakriani Sakti, Satoshi Nakamura
2019ASRUListening While Speaking and Visualizing: Improving ASR Through Multimodal Chain.Johanes Effendi, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2019ASRUNeural Machine Translation with Acoustic Embedding.Takatomo Kano, Sakriani Sakti, Satoshi Nakamura
2019ASRUZero-Shot Code-Switching ASR and TTS with Multilingual Machine Speech Chain.Sahoko Nakayama, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2019ASRUSpeech-to-Speech Translation Between Untranscribed Unknown Languages.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2019CHIAugmented typing: augmentation of keyboard typing experience by adding visual and sound effects.Tsubasa Yumura, Satoshi Nakamura
2019ICASSPSpeech Artifact Removal from Eeg Recordings of Spoken Word Production with Tensor Decomposition.Holy Lovenia, Hiroki Tanaka, Sakriani Sakti, Ayu Purwarianti, Satoshi Nakamura
2019ICASSPEnd-to-end Feedback Loss in Speech Chain Framework via Straight-through Estimator.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2019ICASSPCross-lingual Speech-based Tobi Label Generation Using Bidirectional Lstm.Marco Vetter, Sakriani Sakti, Satoshi Nakamura
2019ICMIMeasuring Affective Sharing between Two People by EEG Hyperscanning.Taiki Kinoshita, Hiroki Tanaka, Koichiro Yoshino, Satoshi Nakamura
2019ICMIDetecting Syntactic Violations from Single-trial EEG using Recurrent Neural Networks.Shunnosuke Motomura, Hiroki Tanaka, Satoshi Nakamura
2019ICMIDetecting Dementia from Face in Human-Agent Interaction.Hiroki Tanaka, Hiroyoshi Adachi, Hiroaki Kazui, Manabu Ikeda, Takashi Kudo, Satoshi Nakamura
2019INLGNeural Conversation Model Controllable by Given Dialogue Act Based on Adversarial Learning and Label-aware Objective.Seiya Kawano, Koichiro Yoshino, Satoshi Nakamura
2019InteractThe Possibility of Personality Extraction Using Skeletal Information in Hip-Hop Dance by Human or Machine.Saeka Furuichi, Kazuki Abe, Satoshi Nakamura
2019InteractDoes the Pop-Out Make an Effect in the Product Selection of Signage Vending Machine?Mitsuki Hosoya, Hiroaki Yamaura, Satoshi Nakamura, Makoto Nakamura, Eiji Takamatsu, Yujiro Kitaide
2019InteractAnalysis of Utilization in the Message Card Production by Use of Fusion Character of Handwriting and Typeface.Mikako Sasaki, Junki Saito, Satoshi Nakamura
2019InterspeechAn Incremental Turn-Taking Model for Task-Oriented Dialog Systems.Andrei Catalin Coman, Koichiro Yoshino, Yukitoshi Murase, Satoshi Nakamura, Giuseppe Riccardi
2019InterspeechSequence-to-Sequence Learning via Attention Transfer for Incremental Speech Recognition.Sashi Novitasari, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2019InterspeechSpeech Quality Evaluation of Synthesized Japanese Speech Using EEG.Ivan Halim Parmonangan, Hiroki Tanaka, Sakriani Sakti, Shinnosuke Takamichi, Satoshi Nakamura
2018AAAIEliciting Positive Emotion through Affect-Sensitive Dialogue Response Generation: A Neural Network Approach.Nurul Lubis, Sakriani Sakti, Koichiro Yoshino, Satoshi Nakamura
2018AVIMojirage: average handwritten note.Yasutsuna Matayoshi, Ryo Oshima, Satoshi Nakamura
2018AVIPhoToDo: image-based task management system by visual trigger.Kouhei Matsuda, Satoshi Nakamura
2018DaWaKTRANS-AM: Discovery Method of Optimal Input Vectors Corresponding to Objective Variables.Hiroaki Tanaka, Yu Suzuki, Koichiro Yoshino, Satoshi Nakamura
2018DEXAInformation Filtering Method for Twitter Streaming Data Using Human-in-the-Loop Machine Learning.Yu Suzuki, Satoshi Nakamura
2018HCIDeconaby: Animations for Improving Understandability of Web Images.Kazuyuki Hikawa, Kohei Matsuda, Satoshi Nakamura
2018HCICan People Sense Their Personalities Only by Watching the Movements of Their Skeleton in Street Dancing Performances?Hikaru Saito, Yoshiki Maki, Shunki Tsuchiya, Satoshi Nakamura
2018HCIImage Blurring Method for Enhancing Digital Content Viewing Experience.Hiroaki Yamaura, Masayuki Tamura, Satoshi Nakamura
2018ICASSPGraph Regularized Tensor Factorization for Single-Trial EEG Analysis.Hayato Maki, Hiroki Tanaka, Sakriani Sakti, Satoshi Nakamura
2018ICASSPSequence-to-Sequence Asr Optimization Via Reinforcement Learning.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2018ICMIListening Skills Assessment through Computer Agents.Hiroki Tanaka, Hideki Negoro, Hidemi Iwasaka, Satoshi Nakamura
2018IJCNNTensor Decomposition for Compressing Recurrent Neural Network.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2018InterspeechCompressing End-to-end ASR Networks by Tensor-Train Decomposition.Takuma Mori, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2017ACIIProcessing negative emotions through social communication: Multimodal database construction and analysis.Nurul Lubis, Michael Heck, Sakriani Sakti, Koichiro Yoshino, Satoshi Nakamura
2017ACLNeural Machine Translation via Binary Code Prediction.Yusuke Oda, Philip Arthur, Graham Neubig, Koichiro Yoshino, Satoshi Nakamura
2017ASRUFeature optimized DPGMM clustering for unsupervised subword modeling: A contribution to zerospeech 2017.Michael Heck, Sakriani Sakti, Satoshi Nakamura
2017ASRUListening while speaking: Speech chain by deep learning.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2017ASRUAttention-based Wav2Text with feature transfer learning.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2017ICMITracking liking state in brain activity while watching multiple movies.Naoto Terasawa, Hiroki Tanaka, Sakriani Sakti, Satoshi Nakamura
2017IJCNLPAcquisition and Assessment of Semantic Content for the Generation of Elaborateness and Indirectness in Spoken Dialogue Systems.Louisa Pragst, Koichiro Yoshino, Wolfgang Minker, Satoshi Nakamura, Stefan Ultes
2017IJCNLPLocal Monotonic Attention Mechanism for End-to-End Speech And Language Processing.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2017IJCNLPImproving Neural Machine Translation through Phrase-based Forced Decoding.Jingyi Zhang, Masao Utiyama, Eiichiro Sumita, Graham Neubig, Satoshi Nakamura
2017IJCNNCompressing recurrent neural network with tensor train.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2017InterspeechToward Expressive Speech Translation: A Unified Sequence-to-Sequence LSTMs Approach for Translating Words and Emphasis.Quoc Truong Do, Sakriani Sakti, Satoshi Nakamura
2017InterspeechEnsembles of Multi-Scale VGG Acoustic Models.Michael Heck, Masayuki Suzuki, Takashi Fukuda, Gakuto Kurata, Satoshi Nakamura
2017InterspeechStructured-Based Curriculum Learning for End-to-End English-Japanese Speech Translation.Takatomo Kano, Sakriani Sakti, Satoshi Nakamura
2016ACLA Continuous Space Rule Selection Model for Syntax-based Statistical Machine Translation.Jingyi Zhang, Masao Utiyama, Eiichiro Sumita, Graham Neubig, Satoshi Nakamura
2016EMNLPLearning a Lexicon and Translation Model from Phoneme Lattices.Oliver Adams, Graham Neubig, Trevor Cohn, Steven Bird, Quoc Truong Do, Satoshi Nakamura
2016EMNLPIncorporating Discrete Translation Lexicons into Neural Machine Translation.Philip Arthur, Graham Neubig, Satoshi Nakamura
2016ICASSPImplementation of F0 transformation for statistical singing voice conversion based on direct waveform modification.Kazuhiro Kobayashi, Tomoki Toda, Satoshi Nakamura
2016ICASSPNoise suppression method for body-conducted soft speech enhancement based on external noise monitoring.Yusuke Tajiri, Tomoki Toda, Satoshi Nakamura
2016ICASSPStatistical F0 prediction for electrolaryngeal speech enhancement considering generative process of F0 contours within product of experts framework.Kou Tanaka, Hirokazu Kameoka, Tomoki Toda, Satoshi Nakamura
2016ICASSPAn estimation method of voice timbre evaluation values using feature extraction with Gaussian mixture model based on reference singer.Soichi Yamane, Kazuhiro Kobayashi, Tomoki Toda, Tomoyasu Nakano, Masataka Goto, Satoshi Nakamura
2016ICMIPersonalized unknown word detection in non-native language reading using eye gaze.Rui Hiraoka, Hiroki Tanaka, Sakriani Sakti, Graham Neubig, Satoshi Nakamura
2016ICMIAutomatic detection of very early stage of dementia through multimodal interaction with computer avatars.Hiroki Tanaka, Hiroyoshi Adachi, Norimichi Ukita, Takashi Kudo, Satoshi Nakamura
2016ICPRA sustainable practice method of hand-drawing by merging user's stroke and model's stroke.Natsumi Kubota, Shinjiro Niino, Satoshi Nakamura, Masaaki Macky Suzuki
2016IIWASFast text anonymization using k-anonyminity.Wakana Maeda, Yu Suzuki, Satoshi Nakamura
2016IJCNNGated Recurrent Neural Tensor Network.Andros Tjandra, Sakriani Sakti, Ruli Manurung, Mirna Adriani, Satoshi Nakamura
2016InterspeechTransferring Emphasis in Speech Translation Using Hard-Attentional Neural Network Models.Quoc Truong Do, Sakriani Sakti, Graham Neubig, Satoshi Nakamura
2016InterspeechA Hybrid System for Continuous Word-Level Emphasis Modeling Based on HMM State Clustering and Adaptive Training.Quoc Truong Do, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura
2016InterspeechSupervised Learning of Acoustic Models in a Zero Resource Setting to Improve DPGMM Clustering.Michael Heck, Sakriani Sakti, Satoshi Nakamura
2016InterspeechThe NU-NAIST Voice Conversion System for the Voice Conversion Challenge 2016.Kazuhiro Kobayashi, Shinnosuke Takamichi, Satoshi Nakamura, Tomoki Toda
2015ACLImproving Pivot Translation by Remembering the Pivot.Akiva Miura, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura
2015ACLSyntax-based Simultaneous Translation through Prediction of Unseen Syntactic Constituents.Yusuke Oda, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura
2015ASRUThe NAIST ASR system for the 2015 Multi-Genre Broadcast challenge: On combination of deep learning systems using a rank-score function.Quoc Truong Do, Michael Heck, Sakriani Sakti, Graham Neubig, Tomoki Toda, Satoshi Nakamura
2015ASRUA study of social-affective communication: Automatic prediction of emotion triggers and responses in television talk shows.Nurul Lubis, Sakriani Sakti, Graham Neubig, Koichiro Yoshino, Tomoki Toda, Satoshi Nakamura
2015ASRUAdaptive selection from multiple response candidates in example-based dialogue.Masahiro Mizukami, Hideaki Kizuki, Toshio Nomura, Graham Neubig, Koichiro Yoshino, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura
2015ASRUIncremental sentence compression using LSTM recurrent networks.Sakriani Sakti, Faiz Ilham, Graham Neubig, Tomoki Toda, Ayu Purwarianti, Satoshi Nakamura
2015ASRUStochastic Gradient Variational Bayes for deep learning-based ASR.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura, Mirna Adriani
2015ASSETSAn Enhanced Electrolarynx with Automatic Fundamental Frequency Control based on Statistical Prediction.Kou Tanaka, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura
2015EMNLPA Binarized Neural Network Joint Model for Machine Translation.Jingyi Zhang, Masao Utiyama, Eiichiro Sumita, Graham Neubig, Satoshi Nakamura
2015ICASSPWFST-based structural classification integrating dnn acoustic features and RNN language features for speech recognition.Quoc Truong Do, Satoshi Nakamura, Marc Delcroix, Takaaki Hori
2015ICASSPEEG signal enhancement using multi-channel wiener filter with a spatial correlation prior.Hayato Maki, Tomoki Toda, Sakriani Sakti, Graham Neubig, Satoshi Nakamura
2015ICASSPStatistical modeling of binaural signal and its application to binaural source separation.Yuki Murota, Daichi Kitamura, Shoichi Koyama, Hiroshi Saruwatari, Satoshi Nakamura
2015ICASSPParameter generation algorithm considering Modulation Spectrum for HMM-based speech synthesis.Shinnosuke Takamichi, Tomoki Toda, Alan W. Black, Satoshi Nakamura
2015ICASSPModulation spectrum-constrained trajectory training algorithm for GMM-based Voice Conversion.Shinnosuke Takamichi, Tomoki Toda, Alan W. Black, Satoshi Nakamura
2015ICASSPCombination of two-dimensional cochleogram and spectrogram features for deep learning-based ASR.Andros Tjandra, Sakriani Sakti, Graham Neubig, Tomoki Toda, Mirna Adriani, Satoshi Nakamura
2015InterspeechPreserving word-level emphasis in speech-to-speech translation using linear regression HSMMs.Quoc Truong Do, Shinnosuke Takamichi, Sakriani Sakti, Graham Neubig, Tomoki Toda, Satoshi Nakamura
2015InterspeechStatistical singing voice conversion based on direct waveform modification with global variance.Kazuhiro Kobayashi, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura
2015InterspeechSpeed or accuracy? a study in evaluation of simultaneous speech translation.Takashi Mieno, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura
2015InterspeechA latent variable model for joint pause prediction and dependency parsing.The Tung Nguyen, Graham Neubig, Hiroyuki Shindo, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura
2015InterspeechNon-native speech synthesis preserving speaker individuality based on partial correction of prosodic and phonetic characteristics.Yuji Oshima, Shinnosuke Takamichi, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura
2014ACLOptimizing Segmentation Strategies for Simultaneous Speech Translation.Yusuke Oda, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura
2014COLINGDiscriminative Language Models as a Tool for Machine Translation Error Analysis.Koichi Akabe, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura
2014COLINGReinforcement Learning of Cooperative Persuasive Dialogue Policies using Framing.Takuya Hiraoka, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura
2014EACLAcquiring a Dictionary of Emotion-Provoking Events.Hoa Trong Vu, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura
2014HCOMPProposal and Initial Study for Animal Crowdsourcing.Motohiro Makiguchi, Daichi Namikawa, Satoshi Nakamura, Taiga Yoshida, Masanori Yokoyama, Yuji Takano
2014ICASSPRegression approaches to perceptual age control in singing voice conversion.Kazuhiro Kobayashi, Tomoki Toda, Tomoyasu Nakano, Masataka Goto, Graham Neubig, Sakriani Sakti, Satoshi Nakamura
2014ICASSPNarrow Adaptive Regularization of weights for grapheme-to-phoneme conversion.Keigo Kubo, Sakriani Sakti, Graham Neubig, Tomoki Toda, Satoshi Nakamura
2014ICASSPMusic signal separation based on Bayesian spectral amplitude estimator with automatic target prior adaptation.Yuki Murota, Daichi Kitamura, Shunsuke Nakai, Hiroshi Saruwatari, Satoshi Nakamura, Yu Takahashi, Kazunobu Kondo
2014ICASSPA postfilter to modify the modulation spectrum in HMM-based speech synthesis.Shinnosuke Takamichi, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura
2014ICASSPAn evaluation of excitation feature prediction in a hybrid approach to electrolaryngeal speech enhancement.Kou Tanaka, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura
2014InterspeechA hearing impairment simulation method using audiogram-based approximation of auditory charatecteristics.Nozomi Jinbo, Shinnosuke Takamichi, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura
2014InterspeechStatistical singing voice conversion with direct waveform modification based on the spectrum differential.Kazuhiro Kobayashi, Tomoki Toda, Graham Neubig, Sakriani Sakti, Satoshi Nakamura
2014InterspeechStructured soft margin confidence weighted learning for grapheme-to-phoneme conversion.Keigo Kubo, Sakriani Sakti, Graham Neubig, Tomoki Toda, Satoshi Nakamura
2014InterspeechData-driven generation of text balloons based on linguistic and acoustic features of a comics-anime corpus.Sho Matsumiya, Sakriani Sakti, Graham Neubig, Tomoki Toda, Satoshi Nakamura
2013ACLTowards High-Reliability Speech Translation in the Medical Domain.Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura, Yuji Matsumoto, Ryosuke Isotani, Yukichi Ikeda
2013ASRUDialogue management for leading the conversation in persuasive dialogue systems.Takuya Hiraoka, Yuki Yamauchi, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura
2013InterspeechEvaluation of a singing voice conversion method based on many-to-many eigenvoice conversion.Hironori Doi, Tomoki Toda, Tomoyasu Nakano, Masataka Goto, Satoshi Nakamura
2013InterspeechSimple, lexicalized choice of translation timing for simultaneous speech translation.Tomoki Fujita, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura
2013InterspeechGeneralizing continuous-space translation of paralinguistic information.Takatomo Kano, Shinnosuke Takamichi, Sakriani Sakti, Graham Neubig, Tomoki Toda, Satoshi Nakamura
2013InterspeechAn investigation of acoustic features for singing voice conversion based on perceptual age.Kazuhiro Kobayashi, Hironori Doi, Tomoki Toda, Tomoyasu Nakano, Masataka Goto, Graham Neubig, Sakriani Sakti, Satoshi Nakamura
2013InterspeechGrapheme-to-phoneme conversion based on adaptive regularization of weight vectors.Keigo Kubo, Sakriani Sakti, Graham Neubig, Tomoki Toda, Satoshi Nakamura
2013InterspeechA digital signal processor implementation of silent/electrolaryngeal speech enhancement based on real-time statistical voice conversion.Takuto Moriguchi, Tomoki Toda, Motoaki Sano, Hiroshi Sato, Graham Neubig, Sakriani Sakti, Satoshi Nakamura
2013InterspeechAn empirical comparison of joint optimization techniques for speech translation.Masaya Ohgushi, Graham Neubig, Sakriani Sakti, Tomoki Toda, Satoshi Nakamura
2012AVIStudy of information clouding methods to prevent spoilers of sports match.Satoshi Nakamura, Takanori Komatsu
2012AVIPersonal photo browser that can classify photos by participants and situations.Tomoya Onishi, Ryosuke Tokuami, Yasuyuki Kono, Satoshi Nakamura
2012AVISearch intent estimation from user's eye movements for supporting information seeking.Kazutoshi Umemoto, Takehiro Yamamoto, Satoshi Nakamura, Katsumi Tanaka
2012CogSciSatisfaction evaluation and time perception for waiting time in ICT usage under dual task situation.Sumaru Niida, Satoshi Nakamura, Tomomi Moroga, Etsuko T. Harada, Satoshi Uemura
2012ICASSPA bootstrapping approach for SLU portability to a new language by inducting unannotated user queries.Teruhisa Misu, Etsuo Mizukami, Hideki Kashioka, Satoshi Nakamura, Haizhou Li
2011ASRUBlind noise suppression for Non-Audible Murmur recognition with stereo signal processing.Shunta Ishii, Tomoki Toda, Hiroshi Saruwatari, Sakriani Sakti, Satoshi Nakamura
2011CIKMRerankEverything: a reranking interface for exploring search results.Takehiro Yamamoto, Satoshi Nakamura, Katsumi Tanaka
2011CIKMExtracting adjective facets from community Q&A corpus.Takehiro Yamamoto, Satoshi Nakamura, Katsumi Tanaka
2011HCI3-D Sound Reproduction System for Immersive Environments Based on the Boundary Surface Control Principle.Seigo Enomoto, Yusuke Ikeda, Shiro Ise, Satoshi Nakamura
2011HCIPersonalized Voice Assignment Techniques for Synchronized Scenario Speech Output in Entertainment Systems.Shinichi Kawamoto, Tatsuo Yotsukura, Satoshi Nakamura, Shigeo Morishima
2011HCIProviding Immersive Virtual Experience with First-Person Perspective Omnidirectional Movies and Three Dimensional Sound Field.Kazuaki Kondo, Yasuhiro Mukaigawa, Yusuke Ikeda, Seigo Enomoto, Shiro Ise, Satoshi Nakamura, Yasushi Yagi
2011HCIInstant Movie Casting with Personality: Dive into the Movie System.Shigeo Morishima, Yasushi Yagi, Satoshi Nakamura
2011ICASSPUnsupervised determination of efficient Korean LVCSR units using a Bayesian Dirichlet process model.Sakriani Sakti, Andrew M. Finch, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura
2011ICASSPIncreasing discriminative capability on MAP-based mapping function estimation for acoustic model adaptation.Yu Tsao, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura
2011ICASSPA sampling-based environment population projection approach for rapid acoustic model adaptation.Yu Tsao, Shigeki Matsuda, Shinsuke Sakai, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura
2011InterspeechAdaptive Regularization Framework for Robust Voice Activity Detection.Xugang Lu, Masashi Unoki, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura
2011InterspeechUser Study of Spoken Decision Support System.Teruhisa Misu, Kiyonori Ohtake, Chiori Hori, Hisashi Kawai, Satoshi Nakamura
2010DEXAPlus One or Minus One: A Method to Browse from an Object to Another Object by Adding or Deleting an Element.Kosetsu Tsukuda, Takehiro Yamamoto, Satoshi Nakamura, Katsumi Tanaka
2010InterspeechBrazilian portuguese acoustic model training based on data borrowing from other language.Kazuhiko Abe, Sakriani Sakti, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura
2010InterspeechCluster-based language model for spoken document retrieval using NMF-based document clustering.Xinhui Hu, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura
2010InterspeechConstruction and evaluations of an annotated Chinese conversational corpus in travel domain for the language model of speech recognition.Xinhui Hu, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura
2010InterspeechVoice activity detection in a reguarized reproducing kernel hilbert space.Xugang Lu, Masashi Unoki, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura
2010InterspeechUtilizing a noisy-channel approach for Korean LVCSR.Sakriani Sakti, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura
2009ASRUWeighted finite state transducer based statistical dialog management.Chiori Hori, Kiyonori Ohtake, Teruhisa Misu, Hideki Kashioka, Satoshi Nakamura
2009ASRUThe Asian network-based speech-to-speech translation system.Sakriani Sakti, Noriyuki Kimura, Michael Paul, Chiori Hori, Eiichiro Sumita, Satoshi Nakamura, Jun Park, Chai Wutiwiwatchai, Bo Xu, Hammam Riza, Karunesh Arora, Chi Mai Luong, Haizhou Li
2009ASRUMAP estimation of online mapping parameters in ensemble speaker and speaking environment modeling.Yu Tsao, Shigeki Matsuda, Satoshi Nakamura, Chin-Hui Lee
2009DEXAReranking and Classifying Search Results Exhaustively Based on Edit-and-Propagate Operations.Takehiro Yamamoto, Satoshi Nakamura, Katsumi Tanaka
2009ICASSPAutomatic voice assignment tool for Instant Casting movie System.Yoshihiro Adachi, Shinichi Kawamoto, Tatsuo Yotsukura, Shigeo Morishima, Satoshi Nakamura
2009ICASSPStatistical dialog management applied to WFST-based dialog systems.Chiori Hori, Kiyonori Ohtake, Teruhisa Misu, Hideki Kashioka, Satoshi Nakamura
2009ICASSPTemporal contrast normalization and edge-preserved smoothing on temporal modulation structure for robust speech recognition.Xugang Lu, Shigeki Matsuda, Masashi Unoki, Tohru Shimizu, Satoshi Nakamura
2009ICASSPCART-based modeling of Chinese tonal patterns with a functional model tracing the fundamental frequency trajectories.Jinfu Ni, Shinsuke Sakai, Tohru Shimizu, Satoshi Nakamura
2009ICASSPOptimal learning of P-Layer additive F0 models with cross-validation.Shinsuke Sakai, Tatsuya Kawahara, Tohru Shimizu, Satoshi Nakamura
2009InterspeechRecent advances in WFST-based dialog system.Chiori Hori, Kiyonori Ohtake, Teruhisa Misu, Hideki Kashioka, Satoshi Nakamura
2009InterspeechSubband temporal modulation spectrum normalization for automatic speech recognition in reverberant environments.Xugang Lu, Masashi Unoki, Satoshi Nakamura
2009InterspeechA decision tree-based clustering approach to state definition in an excitation modeling framework for HMM-based speech synthesis.Ranniery Maia, Tomoki Toda, Keiichi Tokuda, Shinsuke Sakai, Satoshi Nakamura
2009InterspeechA study on soft margin estimation of linear regression parameters for speaker adaptation.Shigeki Matsuda, Yu Tsao, Jinyu Li, Satoshi Nakamura, Chin-Hui Lee
2009InterspeechAnnotating communicative function and semantic content in dialogue act for construction of consulting dialogue systems.Teruhisa Misu, Kiyonori Ohtake, Chiori Hori, Hideki Kashioka, Satoshi Nakamura
2009InterspeechA close look into the probabilistic concatenation model for corpus-based speech synthesis.Shinsuke Sakai, Ranniery Maia, Hisashi Kawai, Satoshi Nakamura
2008CIKMCan social annotation support users in evaluating the trustworthiness of video clips?Satoshi Nakamura, Makoto Shimizu, Katsumi Tanaka
2008COLINGMultilingual Mobile-Phone Translation Services for World Travelers.Michael Paul, Hideo Okuma, Hirofumi Yamamoto, Eiichiro Sumita, Shigeki Matsuda, Tohru Shimizu, Satoshi Nakamura
2008IJCNLPDevelopment of Indonesian Large Vocabulary Continuous Speech Recognition System within A-STAR Project.Sakriani Sakti, Eka Kelana, Hammam Riza, Shinsuke Sakai, Konstantin Markov, Satoshi Nakamura
2008InterspeechDialog management using weighted finite-state transducers.Chiori Hori, Kiyonori Ohtake, Teruhisa Misu, Hideki Kashioka, Satoshi Nakamura
2008InterspeechImproved novelty detection for online GMM based speaker diarization.Konstantin Markov, Satoshi Nakamura
2008InterspeechCENSREC-4: development of evaluation framework for distant-talking speech recognition under reverberant environments.Masato Nakayama, Takanobu Nishiura, Yuki Denda, Norihide Kitaoka, Kazumasa Yamamoto, Takeshi Yamada, Satoru Tsuge, Chiyomi Miyajima, Masakiyo Fujimoto, Tetsuya Takiguchi, Satoshi Tamura, Tetsuji Ogawa, Shigeki Matsuda, Shingo Kuroiwa, Kazuya Takeda, Satoshi Nakamura
2007ACLNICT-ATR Speech-to-Speech Translation System.Eiichiro Sumita, Tohru Shimizu, Satoshi Nakamura
2007ASRUDevelopment of VAD evaluation framework CENSREC-1-C and investigation of relationship between VAD and speech recognition performance.Norihide Kitaoka, Kazumasa Yamamoto, Tomohiro Kusamizu, Seiichi Nakagawa, Takeshi Yamada, Satoru Tsuge, Chiyomi Miyajima, Takanobu Nishiura, Masato Nakayama, Yuki Denda, Masakiyo Fujimoto, Tetsuya Takiguchi, Satoshi Tamura, Shingo Kuroiwa, Kazuya Takeda, Satoshi Nakamura
2007ASRUNever-ending learning system for on-line speaker diarization.Konstantin Markov, Satoshi Nakamura
2007DEXARerank-by-Example: Efficient Browsing of Web Search Results.Takehiro Yamamoto, Satoshi Nakamura, Katsumi Tanaka
2007ICASSPUse of Poisson Processes to Generate Fundamental Frequency Contours.Jinfu Ni, Satoshi Nakamura
2007InterspeechNever-ending learning with dynamic hidden Markov network.Konstantin Markov, Satoshi Nakamura
2006ICASSPSequential Non-Stationary Noise Tracking Using Particle Filtering with Switching Dynamical System.Masakiyo Fujimoto, Satoshi Nakamura
2006ICASSPIncorporation of Pentaphone-Context Dependency Based on Hybrid Hmm/Bn Acoustic Modeling Framework.Sakriani Sakti, Konstantin Markov, Satoshi Nakamura
2006ICASSPAutomatic Derivation of a Phoneme Set with Tone Information for Chinese Speech Recognition Based on Mutual Information Criterion.Jinsong Zhang, Xinhui Hu, Satoshi Nakamura
2006InterspeechForward-backwards training of hybrid HMM/BN acoustic models.Konstantin Markov, Satoshi Nakamura
2006InterspeechCENSREC2: corpus and evaluation environments for in car continuous digit speech recognition.Satoshi Nakamura, Masakiyo Fujimoto, Kazuya Takeda
2005APWEBContent Browsing by Walking in Real and Cyber Spaces.Satoshi Nakamura, Sooyeon Oh, Mitsuru Minakuchi, Rieko Kadobayashi
2005ICASSPParticle Filter Based Non-Stationary Noise Tracking for Robust Speech Recognition.Masakiyo Fujimoto, Satoshi Nakamura
2005ICASSPJoint optimization of LCMV beamforming and acoustic echo cancellation for automatic speech recognition.Wolfgang Herbordt, Satoshi Nakamura, Walter Kellermann
2005ICASSPModeling Successive Frame Dependencies with Hybrid HMM/BN Acoustic Model.Konstantin Markov, Satoshi Nakamura
2005ICASSPOnline cepstral filtering using a sequential EM approach with Polyak averaging and feedback.Tor Andr Myrvoll, Satoshi Nakamura
2005ICDECENSREC-3: Data Collection for In-Car Speech Recognition and Its Common Evaluation Framework.Masakiyo Fujimoto, Satoshi Nakamura, Toshiki Endo, Kazuya Takeda, Chiyomi Miyajima, Shingo Kuroiwa, Takeshi Yamada, Norihide Kitaoka, Kazumasa Yamamoto, Mitsunori Mizumachi, Takanobu Nishiura, Akira Sasou
2005ICIPAutomatic indexing of broadcast content using its live chat on the Web.Hishasi Miyamori, Satoshi Nakamura, Katsumi Tanaka
2005InterspeechSpoken dialog system and its evaluation of geographic information system for elderly persons' mobility support.Takatoshi Jitsuhiro, Shigeki Matsuda, Yutaka Ashikari, Satoshi Nakamura, Ikuko Eguchi Yairi, Seiji Igi
2005InterspeechOutlier detection for acoustic model training using robust statistics.Shigeki Matsuda, Wolfgang Herbordt, Satoshi Nakamura
2004ICASSPAutomatic generation of non-uniform HMM structures based on variational Bayesian approach.Takatoshi Jitsuhiro, Satoshi Nakamura
2004ICASSPOut-of-domain detection based on confidence measures from multiple topic classification.Ian R. Lane, Tatsuya Kawahara, Tomoko Matsui, Satoshi Nakamura
2004ICASSPMinimum mean square error filtering of noisy cepstral coefficients with applications to ASR.Tor Andr Myrvoll, Satoshi Nakamura
2004InterspeechSpeech recognition for multiple non-native accent groups with speaker-group-dependent acoustic models.Tobias Cincarek, Rainer Gruhn, Satoshi Nakamura
2004InterspeechA statistical lexicon for non-native speech recognition.Rainer Gruhn, Konstantin Markov, Satoshi Nakamura
2004InterspeechIncreasing the mixture components of non-uniform HMM structures based on a variational Bayesian approach.Takatoshi Jitsuhiro, Satoshi Nakamura
2004InterspeechTopic classification and verification modeling for out-of-domain utterance detection.Tatsuya Kawahara, Ian Richard Lane, Tomoko Matsui, Satoshi Nakamura
2004InterspeechRobust verification of recognized words in noise.Wai Kit Lo, Frank K. Soong, Satoshi Nakamura
2004InterspeechIntegration of articulatory dynamic parameters in HMM/BN based speech recognition system.Konstantin Markov, Satoshi Nakamura, Jianwu Dang
2004InterspeechSpeech recognition system robust to noise and speaking styles.Shigeki Matsuda, Takatoshi Jitsuhiro, Konstantin Markov, Satoshi Nakamura
2004InterspeechOnline minimum mean square error filtering of noisy cepstral coefficients using a sequential EM algorithm.Tor Andr Myrvoll, Satoshi Nakamura
2004InterspeechIndonesian speech recognition for hearing and speaking impaired people.Sakriani Sakti, Arry Akhmad Arman, Satoshi Nakamura, Paulus Hutagaol
2003ICASSPHybrid HMM/BN LVCSR system integrating multiple acoustic features.Konstantin Markov, Satoshi Nakamura
2003ICASSPAn evaluation of adaptive beamformer based on average speech spectrum for noisy speech recognition.Takanobu Nishiura, Masato Nakayama, Satoshi Nakamura
2003ICASSPA multilevel framework to model the inherently confounding nature of sentential F0sentential F0 contours contours for recognizing Chinese lexical tones.Jinsong Zhang, Keikichi Hirose, Satoshi Nakamura
2003InterspeechDetection and separation of speech segment using audio and video information fusion.Futoshi Asano, Yoichi Motomura, Hideki Asoh, Takashi Yoshimura, Naoyuki Ichimura, Kiyoshi Yamamoto, Nobuhiko Kitawaki, Satoshi Nakamura
2003InterspeechMissing feature theory applied to robust speech recognition over IP network.Toshiki Endo, Shingo Kuroiwa, Satoshi Nakamura
2003InterspeechA semi-blind source separation method for hands-free speech recognition of multiple talkers.Panikos Heracleous, Satoshi Nakamura, Kiyohiro Shikano
2003InterspeechAutomatic generation of non-uniform context-dependent HMM topologies based on the MDL criterion.Takatoshi Jitsuhiro, Tomoko Matsui, Satoshi Nakamura
2003InterspeechHierarchical topic classification for dialog speech recognition based on language model switching.Ian R. Lane, Tatsuya Kawahara, Tomoko Matsui, Satoshi Nakamura
2003InterspeechHybrid HMM/BN ASR system integrating spectrum and articulatory features.Konstantin Markov, Jianwu Dang, Yosuke Iizuka, Satoshi Nakamura
2003InterspeechNoise reduction using paired-microphones on non-equally-spaced microphone arrangement.Mitsunori Mizumachi, Satoshi Nakamura
2003InterspeechEnvironmental sound source identification based on hidden Markov model for robust speech recognition.Takanobu Nishiura, Satoshi Nakamura, Kazuhiro Miki, Kiyohiro Shikano
2002ICASSPAudio-visual speech translation with automatic lip syncqronization and face tracking based on 3-D head model.Shigeo Morishima, Shin Ogata, Kazumasa Murai, Satoshi Nakamura
2002ICASSPRobust bi-modal speech recognition based on state synchronous modeling and stream weight optimization.Satoshi Nakamura, Ken'ichi Kumatani, Satoshi Tamura
2002ICASSPTalker localization in a real acoustic environment based on DOA estimation and statistical sound source identification.Takanobu Nishiura, Satoshi Nakamura, Kiyohiro Shikano
2002ICASSPNoise adaptive speech recognition in time-varying noise based on sequential kullback proximal algorithm.Kaisheng Yao, Kuldip K. Paliwal, Satoshi Nakamura
2002ICMIMulti-Modal Translation System and Its Evaluation.Shigeo Morishima, Satoshi Nakamura
2002ICMI3-D N-Best Search for Simultaneous Recognition of Distant-Talking Speech of Multiple Talkers.Satoshi Nakamura, Panikos Heracleous
2002ICMIMulti-Modal Temporal Asynchronicity Modeling by Product HMMs for Robust.Satoshi Nakamura, Ken'ichi Kumatani, Satoshi Tamura
2002InterspeechWeighted graph based decision tree optimization for high accuracy acoustic modeling.Sheng Gao, Jinsong Zhang, Satoshi Nakamura, Chin-Hui Lee, Tat-Seng Chua
2002InterspeechHMM COmposition-based rapid model adaptation using a priori noise GMM adaptation evaluation on Aurora2 corpus.Masaki Ida, Satoshi Nakamura
2002InterspeechModeling HMM state distributions with Bayesian networks.Konstantin Markov, Satoshi Nakamura
2002InterspeechThe 2ch hybrid subtractive beamformer applied to line sound sources.Mitsunori Mizumachi, Satoshi Nakamura
2002InterspeechSuitable design of adaptive beamformer based on average speech spectrum for noisy speech recognition.Takanobu Nishiura, Satoshi Nakamura, Yuka Okada, Takeshi Yamada, Kiyohiro Shikano
2002InterspeechSpeaking rate compensation based on likelihood criterion in acoustic model training and decoding.Kozo Okuda, Tatsuya Kawahara, Satoshi Nakamura
2001ICASSPA microphone array-based 3-D N-best search algorithm for the simultaneous recognition of multiple sound sources in real environments.Panikos Heracleous, Satoshi Nakamura, Kiyohiro Shikano
2001ICASSPDiscriminative training of HMM using maximum normalized likelihood algorithm.Konstantin Markov, Seiichi Nakagawa, Satoshi Nakamura
2001InterspeechSub-band based additive noise removal for robust speech recognition.Jingdong Chen, Kuldip K. Paliwal, Satoshi Nakamura
2001InterspeechNoise reduction using paired-microphones for both far-field and near-field sound sources.Mitsunori Mizumachi, Satoshi Nakamura
2001InterspeechStatistical sound source identification in a real acoustic environment for robust speech recognition using a microphone array.Takanobu Nishiura, Satoshi Nakamura, Kiyohiro Shikano
2001InterspeechTowards the creation of acoustic models for stressed Japanese speech.Kozo Okuda, Tomoko Matsui, Satoshi Nakamura
2000ICASSPLocalization of multiple sound sources based on a CSP analysis with a microphone array.Takanobu Nishiura, Takeshi Yamada, Satoshi Nakamura, Kiyohiro Shikano
2000ICASSPSpeech recognition for a distant moving speaker based on HMM composition and separation.Tetsuya Takiguchi, Satoshi Nakamura, Kiyohiro Shikano
2000InterspeechRobust fundamental frequency estimation using instantaneous frequencies of harmonic components.Yoshinori Atake, Toshio Irino, Hideki Kawahara, Jinlin Lu, Satoshi Nakamura, Kiyohiro Shikano
2000InterspeechA block cosine transform and its application in speech recognition.Jingdong Chen, Kuldip K. Paliwal, Satoshi Nakamura
2000InterspeechCellular-phone based speech-to-speech translation system ATR-MATRIX.Rainer Gruhn, Harald Singer, Hajime Tsukada, Masaki Naito, Atsushi Nishino, Atsushi Nakamura, Yoshinori Sagisaka, Satoshi Nakamura
2000InterspeechFrame level likelihood transformations for ASR and utterance verification.Konstantin P. Markov, Satoshi Nakamura
2000InterspeechAnalysis of acoustic models trained on a large-scale Japanese speech database.Tomoko Matsui, Masaki Naito, Yoshinori Sagisaka, Kozo Okuda, Satoshi Nakamura
2000InterspeechDesign of robust subtractive beamformer for noisy speech recognition.Mitsunori Mizumachi, Masato Akagi, Satoshi Nakamura
2000InterspeechStream weight optimization of speech and lip image sequence for audio-visual speech recognition.Satoshi Nakamura, Hidetoshi Ito, Kiyohiro Shikano
2000InterspeechMultimodal corpora for human-machine interaction research.Satoshi Nakamura, Keiko Watanuki, Toshiyuki Takezawa, Satoru Hayamizu
1999InterspeechSimultaneous recognition of multiple sound sources based on 3-d n-best search using microphone array.Panikos Heracleous, Takeshi Yamada, Satoshi Nakamura, Kiyohiro Shikano
1999InterspeechData collection in real acoustical environments for sound scene understanding and hands-free speech recognition.Satoshi Nakamura, Kazuo Hiyane, Futoshi Asano, Takeshi Yamada, Takashi Endo
1998ICASSPEfficient representation of short-time phase based on group delay.Hideki Banno, Jinlin Lu, Satoshi Nakamura, Kiyohiro Shikano, Hideki Kawahara
1998ICASSPRobust speech recognition in car environments.Makoto Shozakai, Satoshi Nakamura, Kiyohiro Shikano
1998ICASSPHands-free speech recognition based on 3-D Viterbi search using a microphone array.Takeshi Yamada, Satoshi Nakamura, Kiyohiro Shikano
1998InterspeechCreating speaker independent HMM models for restricted database using STRAIGHT-TEMPO morphing.Alexandre Girardi, Kiyohiro Shikano, Satoshi Nakamura
1997ICASSPModel adaptation based on HMM decomposition for reverberant speech recognition.Tetsuya Takiguchi, Satoshi Nakamura, Qiang Hou, Kiyohiro Shikano
1997InterspeechMaximum likelihood successive state splitting algorithm for tied-mixture HMNET.Alexandre Girardi, Harald Singer, Kiyohiro Shikano, Satoshi Nakamura
1997InterspeechMicrophone array design measures for hands-free speech recognition.Masaaki Inoue, Satoshi Nakamura, Takeshi Yamada, Kiyohiro Shikano
1997InterspeechImproved bimodal speech recognition using tied-mixture HMMs and 5000 word audio-visual synchronous database.Satoshi Nakamura, Ron Nagai, Kiyohiro Shikano
1997InterspeechRoom acoustics and reverberation: impact on hands-free recognition.Satoshi Nakamura, Kiyohiro Shikano
1996ICASSPNoise and room acoustics distorted speech recognition by HMM composition.Satoshi Nakamura, Tetsuya Takiguchi, Kiyohiro Shikano
1993InterspeechRobust word spotting in adverse car environments.Satoshi Nakamura, Toshio Akabane, Seiji Hamaguchi
1991ICASSPA neural speaker model for speaker clustering.Satoshi Nakamura, Toshio Akabane
1990ICASSPATR HMM-LR continuous speech recognition system.Toshiyuki Hanazawa, Kenji Kita, Satoshi Nakamura, Takeshi Kawabata, Kiyohiro Shikano
1990ICASSPSupplementation of HMM for articulatory variation in speaker adaptation.Hiroaki Hattori, Satoshi Nakamura, Kiyohiro Shikano
1990ICASSPA comparative study of spectral mapping for speaker adaptation.Satoshi Nakamura, Kiyohiro Shikano
1990InterspeechSpeaker weighted training of HMM using multiple reference speakers.Hiroaki Hattori, Satoshi Nakamura, Kiyohiro Shikano, Shigeki Sagayama
1989ICASSPSpeaker adaptation applied to HMM and neural networks.Satoshi Nakamura, Kiyohiro Shikano
1988ICASSPVoice conversion through vector quantization.Masanobu Abe, Satoshi Nakamura, Kiyohiro Shikano, Hisao Kuwabara