Skip to content

Kazuhiro Nakadai

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

166

Venues

27

Active years

1995–2026

Best venue rank

A*

Where they publish

Papers

166 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIUnsupervised Single-Channel Audio Separation with Diffusion Source Priors.Runwu Shi, Chang Li, Jiang Wang, Rui Zhang, Nabeela Khan, Benjamin Yen, Takeshi Ashizawa, Kazuhiro Nakadai
2026ACLPattern Enhanced Multi-Turn Jailbreaking: Exploiting Structural Vulnerabilities in Large Language Models.Ragib Amin Nihal, Rui Wen, Kazuhiro Nakadai, Jun Sakuma
2025ACLMultilingual Gloss-free Sign Language Translation: Towards Building a Sign Language Foundation Model.Sihan Tan, Taro Miyazaki, Kazuhiro Nakadai
2025COLINGImprovement in Sign Language Translation Using Text CTC Alignment.Sihan Tan, Taro Miyazaki, Nabeela Khan, Kazuhiro Nakadai
2025ICASSPDistance Based Single-Channel Target Speech Extraction.Runwu Shi, Benjamin Yen, Kazuhiro Nakadai
2025ICMISignFlow: End-to-End Sign Language Generation for One-to-Many Modeling using Conditional Flow Matching.Nabeela Khan, Bowen Wu, Sihan Tan, Carlos Toshinori Ishi, Kazuhiro Nakadai
2025IROSSwarm Active Audition with Robots and Drones: Real-World Performance Validation.Kazuhiro Nakadai, Kotaro Hoshiba, Benjamin Yen, Makoto Kumon, Yoko Sasaki
2025IROSSingle-Microphone-Based Sound Source Localization for Mobile Robots in Reverberant Environments.Jiang Wang, Runwu Shi, Benjamin Yen, He Kong, Kazuhiro Nakadai
2025RO-MANTowards Online Sign Language Expression for Real-Time Human-Robot Interaction.Nabeela Khan, Sihan Tan, Kazuhiro Nakadai
2024ICPRUAV-Enhanced Combination to Application: Comprehensive Analysis and Benchmarking of a Human Detection Dataset for Disaster Scenarios.Ragib Amin Nihal, Benjamin Yen, Katsutoshi Itoyama, Kazuhiro Nakadai
2024RO-MANImproving Impressions of Response Delay in AI-based Spoken Dialogue Systems.Shuhei Asaka, Katsutoshi Itoyama, Kazuhiro Nakadai
2023InterspeechminiStreamer: Enhancing Small Conformer with Chunked-Context Masking for Streaming ASR Applications on the Edge.Haris Gulzar, Monikka Roslianna Busto, Takeharu Eda, Katsutoshi Itoyama, Kazuhiro Nakadai
2023InterspeechRetraining-free Customized ASR for Enharmonic Words Based on a Named-Entity-Aware Model and Phoneme Similarity Estimation.Yui Sudo, Kazuya Hata, Kazuhiro Nakadai
2023RO-MANImproving Sign Language Understanding Introducing Label Smoothing.Sihan Tan, Khan Nabeela Khanum, Katsutoshi Itoyama, Kazuhiro Nakadai
2023RO-MANOnline Adaptation of Fourier Series Based Acoustic Transfer Function Model to Improve Sound Source Localization and Separation.Yui Sudo, Masayuki Takigahira, Hideo Tsuru, Kazuhiro Nakadai, Hirofumi Nakajima
2022InterspeechWeakly-Supervised Neural Full-Rank Spatial Covariance Analysis for a Front-End System of Distant Speech Recognition.Yoshiaki Bando, Takahiro Aizawa, Katsutoshi Itoyama, Kazuhiro Nakadai
2022InterspeechStreaming Automatic Speech Recognition with Re-blocking Processing Based on Integrated Voice Activity Detection.Yui Sudo, Muhammad Shakeel, Kazuhiro Nakadai, Jiatong Shi, Shinji Watanabe
2022InterspeechEmpirical Sampling from Latent Utterance-wise Evidence Model for Missing Data ASR based on Neural Encoder-Decoder Model.Ryu Takeda, Yui Sudo, Kazuhiro Nakadai, Kazunori Komatani
2022IROSSpotforming by NMF Using Multiple Microphone Arrays.Yasuhiro Kagimoto, Katsutoshi Itoyama, Kenji Nishida, Kazuhiro Nakadai
2022IROSOutdoor evaluation of sound source localization for drone groups using microphone arrays.Taiki Yamada, Katsutoshi Itoyama, Kenji Nishida, Kazuhiro Nakadai
2021InterspeechAssessment of von Mises-Bernoulli Deep Neural Network in Sound Source Localization.Katsutoshi Itoyama, Yoshiya Morimoto, Shungo Masaki, Ryosuke Kojima, Kenji Nishida, Kazuhiro Nakadai
2021IROSFully-Online Always-Adaptation of Transfer Functions and Its Application to Sound Source Localization and Separation.Kazuhiro Nakadai, Masayuki Takigahira, Yusuke Kawai, Hirofumi Nakajima
2020IROSSynchronization of Microphones Based on Rank Minimization of Warped Spectrum for Asynchronous Distributed Recording.Katsutoshi Itoyama, Kazuhiro Nakadai
2019ICASSPAn Integrated Framework for Field Recording, Localization, Classification and Annotation of Birdsongs Using Robot Audition Techniques - Harkbird 2.0.Shinji Sumitani, Reiji Suzuki, Naoaki Chiba, Shiho Matsubayashi, Takaya Arita, Kazuhiro Nakadai, Hiroshi Gitchang Okuno
2019IJCNNWeakly-Supervised Deep Recurrent Neural Networks for Basic Dance Step Generation.Nelson Yalta, Shinji Watanabe, Kazuhiro Nakadai, Tetsuya Ogata
2019IROSEnvironmental sound segmentation utilizing Mask U-Net.Yui Sudo, Katsutoshi Itoyama, Kenji Nishida, Kazuhiro Nakadai
2018IROSHARK-Bird-Box: A Portable Real-time Bird Song Scene Analysis System.Ryosuke Kojima, Osamu Sugiyama, Kotaro Hoshiba, Reiji Suzuki, Kazuhiro Nakadai
2018IROSExtracting the Relationship between the Spatial Distribution and Types of Bird Vocalizations Using Robot Audition System HARK.Shinji Sumitani, Reiji Suzuki, Shiho Matsubayashi, Takaya Arita, Kazuhiro Nakadai, Hiroshi G. Okuno
2018IROSMulti-timescale Feature-extraction Architecture of Deep Neural Networks for Acoustic Model Training from Raw Speech Signal.Ryu Takeda, Kazuhiro Nakadai, Kazunori Komatani
2018IVATo animate or anime-te?: Investigating sign avatar comprehensibility.Heike Brock, Shigeaki Nishina, Kazuhiro Nakadai
2018LRECDeep JSLC: A Multimodal Corpus Collection for Data-driven Generation of Japanese Sign Language Expressions.Heike Brock, Kazuhiro Nakadai
2018RO-MANData-driven development of Virtual Sign Language Communication Agents.Agathe Balayn, Heike Brock, Kazuhiro Nakadai
2018RO-MANSignal Restoration based on Bi-directional LSTM with Spectral Filtering for Robot Audition.Ryosuke Taniguchi, Kotaro Hoshiba, Katsutoshi Itoyama, Kenji Nishida, Kazuhiro Nakadai
2017DSAAA Spatial-Cue-Based Probabilistic Model for Bird Song Scene Analysis.Ryosuke Kojima, Osamu Sugiyama, Kotaro Hoshiba, Reiji Suzuki, Kazuhiro Nakadai
2017InterspeechNode Pruning Based on Entropy of Weights and Node Activity for Small-Footprint Acoustic Model Based on Deep Neural Networks.Ryu Takeda, Kazuhiro Nakadai, Kazunori Komatani
2017IROSDevelopment of microphone-array-embedded UAV for search and rescue task.Kazuhiro Nakadai, Makoto Kumon, Hiroshi G. Okuno, Kotaro Hoshiba, Mizuho Wakabayashi, Kai Washizaki, Takahiro Ishiki, Daniel Gabriel, Yoshiaki Bando, Takayuki Morito, Ryosuke Kojima, Osamu Sugiyama
2016CHIDesigning Speech and Multimodal Interactions for Mobile, Wearable, and Pervasive Applications.Cosmin Munteanu, Pourang Irani, Sharon L. Oviatt, Matthew P. Aylett, Gerald Penn, Shimei Pan, Nikhil Sharma, Frank Rudzicz, Randy Gomez, Keisuke Nakamura, Kazuhiro Nakadai
2016InterspeechLocalizing Bird Songs Using an Open Source Robot Audition System with a Microphone Array.Reiji Suzuki, Shiho Matsubayashi, Kazuhiro Nakadai, Hiroshi G. Okuno
2016IROSSemi-automatic bird song analysis by spatial-cue-based integration of sound source detection, localization, separation, and identification.Ryosuke Kojima, Osamu Sugiyama, Reiji Suzuki, Kazuhiro Nakadai, Charles E. Taylor
2016IROSPartially Shared Deep Neural Network in sound source separation and identification using a UAV-embedded microphone array.Takayuki Morito, Osamu Sugiyama, Ryosuke Kojima, Kazuhiro Nakadai
2016IROSOnline simultaneous localization and mapping of multiple sound sources and asynchronous microphone arrays.Kouhei Sekiguchi, Yoshiaki Bando, Keisuke Nakamura, Kazuhiro Nakadai, Katsutoshi Itoyama, Kazuyoshi Yoshii
2016IROSRobust sound source mapping using three-layered selective audio rays for mobile robots.Daobilige Su, Keisuke Nakamura, Kazuhiro Nakadai, Jaime Valls Mir
2016LRECConstruction of Japanese Audio-Visual Emotion Database and Its Application in Emotion Recognition.Nurul Lubis, Randy Gomez, Sakriani Sakti, Keisuke Nakamura, Koichiro Yoshino, Satoshi Nakamura, Kazuhiro Nakadai
2016RO-MANLeveraging phantom signals for improved voice-based human-robot interaction.Randy Gomez, Yurii Vasylkiv, Keisuke Nakamura, Takeshi Mizumoto, Kazuhiro Nakadai
2015ASRUAcoustic model training based on node-wise weight boundary model increasing speed of discrete neural networks.Ryu Takeda, Kazunori Komatani, Kazuhiro Nakadai
2015ICASSPRobot audition: Its rise and perspectives.Hiroshi G. Okuno, Kazuhiro Nakadai
2015ICRATemporal smearing compensation in reverberant environment for speech-based human-robot interaction.Randy Gomez, Keisuke Nakamura, Takeshi Mizumoto, Kazuhiro Nakadai
2015ICRAOn-the-spot calibration of microphone array Transfer Functions for robot audition.Keisuke Nakamura, Surya Ambrose, Kazuhiro Nakadai
2015InterspeechDereverberation for active human-robot communication robust to speaker's face orientation.Randy Gomez, Levko Ivanchuk, Keisuke Nakamura, Takeshi Mizumoto, Kazuhiro Nakadai
2015IROSMicrophone-accelerometer based 3D posture estimation for a hose-shaped rescue robot.Yoshiaki Bando, Katsutoshi Itoyama, Masashi Konyo, Satoshi Tadokoro, Kazuhiro Nakadai, Kazuyoshi Yoshii, Hiroshi G. Okuno
2015IROSUtilizing visual cues in robot audition for sound source discrimination in speech-based human-robot communication.Randy Gomez, Levko Ivanchuk, Keisuke Nakamura, Takeshi Mizumoto, Kazuhiro Nakadai
2015IROSAudio-visual scene understanding utilizing text information for a cooking support robot.Ryosuke Kojima, Osamu Sugiyama, Kazuhiro Nakadai
2015IROSRobot-Audition-based Human-Machine Interface for a Car.Kazuhiro Nakadai, Takeshi Mizumoto, Keisuke Nakamura
2015IROSRobot audition based Acoustic Event Identification using a Bayesian model considering spectral and temporal uncertainties.Keisuke Nakamura, Kazuhiro Nakadai
2015IROSInteractive sound source localization using robot audition for tablet devices.Keisuke Nakamura, Lana Sinapayen, Kazuhiro Nakadai
2015RO-MANA case study of an automatic volume control interface for a telepresence system.Masaaki Takahashi, Masa Ogata, Michita Imai, Keisuke Nakamura, Kazuhiro Nakadai
2014HAIVolume adaptation and visualization by modeling the volume level in noisy environments for telepresence system.Akira Hayamizu, Michita Imai, Keisuke Nakamura, Kazuhiro Nakadai
2014InterspeechLipreading using convolutional neural network.Kuniaki Noda, Yuki Yamaguchi, Kazuhiro Nakadai, Hiroshi G. Okuno, Tetsuya Ogata
2014IROSSpeech-based human-robot interaction robust to acoustic reflections in real environment.Randy Gomez, Koji Inoue, Keisuke Nakamura, Takeshi Mizumoto, Kazuhiro Nakadai
2014IROSImprovement in outdoor sound source detection using a quadrotor-embedded microphone array.Takuma Ohata, Keisuke Nakamura, Takeshi Mizumoto, Taiki Tezuka, Kazuhiro Nakadai
2014IROSMaking a robot dance to diverse musical genre in noisy environments.Joo Lobato Oliveira, Keisuke Nakamura, Thibault Langlois, Fabien Gouyon, Kazuhiro Nakadai, Angelica Lim, Lus Paulo Reis, Hiroshi G. Okuno
2014ICRAEgo-motion noise suppression for robots based on Semi-Blind Infinite Non-negative Matrix Factorization.Taiki Tezuka, Takami Yoshida, Kazuhiro Nakadai
2014SMCAuditory-aware navigation for mobile robots based on reflection-robust sound source localization and visual SLAM.Gautam Narang, Keisuke Nakamura, Kazuhiro Nakadai
2014SMCSound annotation tool for multidirectional sounds based on spatial information extracted by HARK robot audition software.Osamu Sugiyama, Katsutoshi Itoyama, Kazuhiro Nakadai, Hiroshi G. Okuno
2013ICASSPRobustness to speaker position in distant-talking automatic speech recognition.Randy Gomez, Keisuke Nakamura, Kazuhiro Nakadai
2013ICRAHands-free human-robot communication robust to speaker's radial position.Randy Gomez, Keisuke Nakamura, Kazuhiro Nakadai, Ui-Hyun Kim, Hiroshi G. Okuno, Tatsuya Kawahara
2013IROSPosture estimation of hose-shaped robot using microphone array localization.Yoshiaki Bando, Takeshi Mizumoto, Katsutoshi Itoyama, Kazuhiro Nakadai, Hiroshi G. Okuno
2013IROSNoise correlation matrix estimation for improving sound source localization by multirotor UAV.Koutarou Furukawa, Keita Okutani, Kohei Nagira, Takuma Otsuka, Katsutoshi Itoyama, Kazuhiro Nakadai, Hiroshi G. Okuno
2013IROSDereverberation robust to speaker's azimuthal orientation in multi-channel human-robot communication.Randy Gomez, Keisuke Nakamura, Kazuhiro Nakadai
2013IROSReal-time super-resolution three-dimensional sound source localization for robots.Keisuke Nakamura, Randy Gomez, Kazuhiro Nakadai
2012HRIMulti-party human-robot interaction with distant-talking speech recognition.Randy Gomez, Tatsuya Kawahara, Keisuke Nakamura, Kazuhiro Nakadai
2012ICASSPSound source localization in spatially colored noise using a hierarchical Bayesian model.Futoshi Asano, Hideki Asoh, Kazuhiro Nakadai
2012ICRAOnline audio beat tracking for a dancing robot in the presence of ego-motion noise in a real environment.Joo Lobato Oliveira, Gkhan Ince, Keisuke Nakamura, Kazuhiro Nakadai
2012IROSOnline learning for template-based multi-channel ego noise estimation.Gkhan Ince, Kazuhiro Nakadai, Keisuke Nakamura
2012IROSReal-time super-resolution Sound Source Localization for robots.Keisuke Nakamura, Kazuhiro Nakadai, Gkhan Ince
2012IROSOutdoor auditory scene analysis using a moving microphone array embedded in a quadrocopter.Keita Okutani, Takami Yoshida, Keisuke Nakamura, Kazuhiro Nakadai
2012IROSLive assessment of beat tracking for robot audition.Joo Lobato Oliveira, Gkhan Ince, Keisuke Nakamura, Kazuhiro Nakadai, Hiroshi G. Okuno, Lus Paulo Reis, Fabien Gouyon
2012RO-MANAn active audition framework for auditory-driven HRI: Application to interactive robot dancing.Joo Lobato Oliveira, Gkhan Ince, Keisuke Nakamura, Kazuhiro Nakadai, Hiroshi G. Okuno, Lus Paulo Reis, Fabien Gouyon
2011HRIRhythmic reference of a human while a rope turning task.Kenta Yonekura, Chyon Hae Kim, Kazuhiro Nakadai, Hiroshi Tsujino, Shigeki Sugano
2011ICASSPCorrelation matrix interpolation in Sound Source Localization for a robot.Keisuke Nakamura, Kazuhiro Nakadai, Hirofumi Nakajima, Gkhan Ince
2011ICRAAssessment of general applicability of ego noise estimation.Gkhan Ince, Keisuke Nakamura, Futoshi Asano, Hirofumi Nakajima, Kazuhiro Nakadai
2011ICRADesign and implementation of selectable sound separation on the Texai telepresence system using HARK.Takeshi Mizumoto, Kazuhiro Nakadai, Takami Yoshida, Ryu Takeda, Takuma Otsuka, Toru Takahashi, Hiroshi G. Okuno
2011InterspeechRobust Intonation Pattern Classification in Human Robot Interaction.Martin Heckmann, Kazuhiro Nakadai, Hirofumi Nakajima
2011InterspeechBayesian Extension of MUSIC for Sound Source Localization and Tracking.Takuma Otsuka, Kazuhiro Nakadai, Tetsuya Ogata, Hiroshi G. Okuno
2011IROSHARK based real-time single pane 3D auditory scene visualizer empowered by Speech Arrow.Zheng Gong, Kazuhiro Nakadai, Hirofumi Nakajima, Ichiro Hagiwara
2011IROSAssessment of single-channel ego noise estimation methods.Gkhan Ince, Kazuhiro Nakadai, Tobias Rodemann, Jun-ichi Imura, Keisuke Nakamura, Hirofumi Nakajima
2011IROSIncremental learning for ego noise estimation of a robot.Gkhan Ince, Kazuhiro Nakadai, Tobias Rodemann, Jun-ichi Imura, Keisuke Nakamura, Hirofumi Nakajima
2011IROSSLAM-based online calibration of asynchronous microphone array for robot audition.Hiroaki Miura, Takami Yoshida, Keisuke Nakamura, Kazuhiro Nakadai
2011IROSIntelligent sound source localization and its application to multimodal human tracking.Keisuke Nakamura, Kazuhiro Nakadai, Futoshi Asano, Gkhan Ince
2010AAAIDesign and Implementation of Two-level Synchronization for Interactive Music Robot.Takuma Otsuka, Kazuhiro Nakadai, Toru Takahashi, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2010ICRAA hybrid framework for ego noise cancellation of a robot.Gkhan Ince, Kazuhiro Nakadai, Tobias Rodemann, Yuji Hasegawa, Hiroshi Tsujino, Jun-ichi Imura
2010InterspeechApplying geometric source separation for improved pitch extraction in human-robot interaction.Martin Heckmann, Claudius Glser, Frank Joublin, Kazuhiro Nakadai
2010InterspeechA robust speech recognition system against the ego noise of a robot.Gkhan Ince, Kazuhiro Nakadai, Tobias Rodemann, Hiroshi Tsujino, Jun-ichi Imura
2010InterspeechTwo-layered audio-visual integration in voice activity detection and automatic speech recognition for robots.Takami Yoshida, Kazuhiro Nakadai
2010IROSPROT - An embodied agent for intelligible and user-friendly human-robot interaction.Ryota Fujimura, Kazuhiro Nakadai, Michita Imai, Ren Ohmura
2010IROSPitch extraction in Human-Robot interaction.Martin Heckmann, Frank Joublin, Kazuhiro Nakadai
2010IROSMulti-talker speech recognition under ego-motion noise using Missing Feature Theory.Gkhan Ince, Kazuhiro Nakadai, Tobias Rodemann, Hiroshi Tsujino, Jun-ichi Imura
2010IROSHuman-robot ensemble between robot thereminist and human percussionist using coupled oscillator model.Takeshi Mizumoto, Takuma Otsuka, Kazuhiro Nakadai, Toru Takahashi, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2010IROSSound source separation and automatic speech recognition for moving sources.Kazuhiro Nakadai, Hirofumi Nakajima, Gkhan Ince, Yuji Hasegawa
2010IROSAn easily-configurable robot audition system using Histogram-based Recursive Level Estimation.Hirofumi Nakajima, Gkhan Ince, Kazuhiro Nakadai, Yuji Hasegawa
2010IROSAn improvement in automatic speech recognition using soft missing feature masks for robot audition.Toru Takahashi, Kazuhiro Nakadai, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2010IROSSpeedup and performance improvement of ICA-based robot audition by parallel and resampling-based block-wise processing.Ryu Takeda, Kazuhiro Nakadai, Toru Takahashi, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2010IROSTwo-layered audio-visual speech recognition for robots in noisy environments.Takami Yoshida, Kazuhiro Nakadai, Hiroshi G. Okuno
2010ICRAImprovement in listening capability for humanoid robot HRP-2.Toru Takahashi, Kazuhiro Nakadai, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2010ICRAUpper-limit evaluation of robot audition based on ICA-BSS in multi-source, barge-in and highly reverberant conditions.Ryu Takeda, Kazuhiro Nakadai, Toru Takahashi, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2009ICASSPSound source separation of moving speakers for robot audition.Kazuhiro Nakadai, Hirofumi Nakajima, Yuji Hasegawa, Hiroshi Tsujino
2009ICASSPICA-based efficient blind dereverberation and echo cancellation method for barge-in-able robot audition.Ryu Takeda, Kazuhiro Nakadai, Toru Takahashi, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2009IROSEgo noise suppression of a robot using template subtraction.Gkhan Ince, Kazuhiro Nakadai, Tobias Rodemann, Yuji Hasegawa, Hiroshi Tsujino, Jun-ichi Imura
2009IROSReal-time sound source orientation estimation using a 96 channel microphone array.Hirofumi Nakajima, Keiko Kikuchi, Touru Daigo, Yutaka Kaneda, Kazuhiro Nakadai, Yuji Hasegawa
2009IROSIntelligent sound source localization for dynamic environments.Keisuke Nakamura, Kazuhiro Nakadai, Futoshi Asano, Yuji Hasegawa, Hiroshi Tsujino
2009IROSIncremental polyphonic audio to score alignment using beat tracking for singer robots.Takuma Otsuka, Toru Takahashi, Hiroshi G. Okuno, Kazunori Komatani, Tetsuya Ogata, Kazumasa Murata, Kazuhiro Nakadai
2009IROSMissing-feature-theory-based robust simultaneous speech recognition system with non-clean speech acoustic model.Toru Takahashi, Kazuhiro Nakadai, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2009IROSStep-size parameter adaptation of multi-channel semi-blind ICA with piecewise linear model for barge-in-able robot audition.Ryu Takeda, Kazuhiro Nakadai, Toru Takahashi, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2009ISRRRobot Audition: Missing Feature Theory Approach and Active Audition.Hiroshi G. Okuno, Kazuhiro Nakadai, Hyun-Don Kim
2008ICASSPAdaptive step-size parameter control for real-world blind source separation.Hirofumi Nakajima, Kazuhiro Nakadai, Yuji Hasegawa, Hiroshi Tsujino
2008ICRAA robot referee for rock-paper-scissors sound games.Kazuhiro Nakadai, Shun'ichi Yamamoto, Hiroshi G. Okuno, Hirofumi Nakajima, Yuji Hasegawa, Hiroshi Tsujino
2008InterspeechSoft missing-feature mask generation for simultaneous speech recognition system in robots.Toru Takahashi, Shun'ichi Yamamoto, Kazuhiro Nakadai, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2008IROSA robot uses its own microphone to synchronize its steps to musical beats while scatting and singing.Kazumasa Murata, Kazuhiro Nakadai, Kazuyoshi Yoshii, Ryu Takeda, Toyotaka Torii, Hiroshi G. Okuno, Yuji Hasegawa, Hiroshi Tsujino
2008IROSHigh performance sound source separation adaptable to environmental changes for robot audition.Hirofumi Nakajima, Kazuhiro Nakadai, Yuji Hasegawa, Hiroshi Tsujino
2008IROSBarge-in-able robot audition based on ICA and missing feature theory under semi-blind situation.Ryu Takeda, Kazuhiro Nakadai, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2007ASRUDesign and implementation of a robot audition system for automatic speech recognition of simultaneous speech.Shun'ichi Yamamoto, Kazuhiro Nakadai, Mikio Nakano, Hiroshi Tsujino, Jean-Marc Valin, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2007HCIA Navigation System Using Ultrasonic Directional Speaker with Rotating Base.Kentaro Ishii, Yukiko Yamamoto, Michita Imai, Kazuhiro Nakadai
2007IROSCoarse speech recognition by audio-visual integration based on missing feature theory.Tomoaki Koiwa, Kazuhiro Nakadai, Jun-ichi Imura
2007IROSExploiting known sound source signals to improve ICA-based robot audition in speech separation and recognition.Ryu Takeda, Kazuhiro Nakadai, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2007IROSA biped robot that keeps steps in time with musical beats while listening to music with its own ears.Kazuyoshi Yoshii, Kazuhiro Nakadai, Toyotaka Torii, Yuji Hasegawa, Hiroshi Tsujino, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2006ICASSPRobust Tracking of Multiple Sound Sources by Spatial Integration of Room And Robot Microphone Arrays.Kazuhiro Nakadai, Hirofumi Nakajima, Masamitsu Murase, Satoshi Kaijiri, Kentaro Yamada, Takahiro Nakamura, Yuji Hasegawa, Hiroshi G. Okuno, Hiroshi Tsujino
2006InterspeechSpeech recognition for a robot under its motor noises by selective application of missing feature theory and MLLR.Yoshitaka Nishimura, Mikio Nakano, Kazuhiro Nakadai, Hiroshi Tsujino, Mitsuru Ishizuka
2006InterspeechLeak energy based missing feature mask generation for ICA and GSS and its evaluation with simultaneous speech recognition.Shun'ichi Yamamoto, Ryu Takeda, Kazuhiro Nakadai, Mikio Nakano, Hiroshi Tsujino, Jean-Marc Valin, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2006IROSReal-Time Tracking of Multiple Sound Sources by Integration of In-Room and Robot-Embedded Microphone Arrays.Kazuhiro Nakadai, Hirofumi Nakajima, Masamitsu Murase, Hiroshi G. Okuno, Yuji Hasegawa, Hiroshi Tsujino
2006IROSReal-Time Robot Audition System That Recognizes Simultaneous Speech in The Real World.Shun'ichi Yamamoto, Kazuhiro Nakadai, Mikio Nakano, Hiroshi Tsujino, Jean-Marc Valin, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2006PRICAIRecognition of Simultaneous Speech by Estimating Reliability of Separated Signals for Robot Audition.Shun'ichi Yamamoto, Ryu Takeda, Kazuhiro Nakadai, Mikio Nakano, Hiroshi Tsujino, Jean-Marc Valin, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2006SIGdialMulti-Domain Spoken Dialogue System with Extensibility and Robustness against Speech Recognition Errors.Kazunori Komatani, Naoyuki Kanda, Mikio Nakano, Kazuhiro Nakadai, Hiroshi Tsujino, Tetsuya Ogata, Hiroshi G. Okuno
2005ICRATowards New Human-Humanoid Communication: Listening During Speaking by Using Ultrasonic Directional Speaker.Kazuhiro Nakadai, Hiroshi Tsujino
2005InterspeechMultiple moving speaker tracking by microphone array on mobile robot.Masamitsu Murase, Shun'ichi Yamamoto, Jean-Marc Valin, Kazuhiro Nakadai, Kentaro Yamada, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2005IROSImplementation of active direction-pass filter on dynamically reconfigurable processor.Shunsuke Kurotaki, Noriaki Suzuki, Kazuhiro Nakadai, Hiroshi G. Okuno, Hideharu Amano
2005IROSSound source tracking with directivity pattern estimation using a 64 ch microphone array.Kazuhiro Nakadai, Hirofumi Nakajima, Kentaro Yamada, Yuji Hasegawa, Takahiro Nakamura, Hiroshi Tsujino
2005IROSA two-layer model for behavior and dialogue planning in conversational service robots.Mikio Nakano, Yuji Hasegawa, Kazuhiro Nakadai, Takahiro Nakamura, Johane Takeuchi, Toyotaka Torii, Hiroshi Tsujino, Naoyuki Kanda, Hiroshi G. Okuno
2005IROSMaking a robot recognize three simultaneous sentences in real-time.Shun'ichi Yamamoto, Kazuhiro Nakadai, Jean-Marc Valin, Jean Rouat, Franois Michaud, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2005ICRAEnhanced Robot Speech Recognition Based on Microphone Array Source Separation and Missing Feature Theory.Shun'ichi Yamamoto, Jean-Marc Valin, Kazuhiro Nakadai, Jean Rouat, Franois Michaud, Tetsuya Ogata, Hiroshi G. Okuno
2004InterspeechMultimodal expression for humanoid robots by integration of human speech mimicking and facial color.Tokitomo Ariyoshi, Kazuhiro Nakadai, Hiroshi Tsujino
2004IROSAssessment of general applicability of robot audition system by recognizing three simultaneous speeches.Shun'ichi Yamamoto, Kazuhiro Nakadai, Hiroshi Tsujino, Hiroshi G. Okuno
2004ICRAImprovement of Robot Audition by Interfacing Sound Source Separation and Automatic Speech Recognition with Missing Feature Theory.Shun'ichi Yamamoto, Kazuhiro Nakadai, Hiroshi Tsujino, Toshio Yokoyama, Hiroshi G. Okuno
2003ICRARobot recognizes three simultaneous speech by active audition.Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano
2003ICRARealizing personality in audio-visually triggered non-verbal behaviors.Hiroshi G. Okuno, Kazuhiro Nakadai, Hiroaki Kitano
2003InterspeechThree simultaneous speech recognition by integration of active audition and face recognition for humanoid.Kazuhiro Nakadai, Daisuke Matsuura, Hiroshi G. Okuno, Hiroshi Tsujino
2003IROSApplying scattering theory to robot audition system: robust sound source localization and extraction.Kazuhiro Nakadai, Daisuke Matsuura, Hiroshi G. Okuno, Hiroaki Kitano
2003IWANNReal-Time Sound Source Localization and Separation Based on Active Audio-Visual Integration.Hiroshi G. Okuno, Kazuhiro Nakadai
2002AAAIExploiting Auditory Fovea in Humanoid-Human Interaction.Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano
2002ICRAReal-Time Speaker Localization and Speech Separation by Audio-Visual Integration.Kazuhiro Nakadai, Ken-ichi Hidai, Hiroshi G. Okuno, Hiroaki Kitano
2002InterspeechReal-time sound source localization and separation for robot audition.Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano
2002InterspeechAuditory fovea based speech enhancement and its application to human-robot dialog system.Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano
2002IROSAuditory fovea based speech separation and its application to dialog system.Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano
2002PRICAIRealizing Audio-Visually Triggered ELIZA-Like Non-verbal Behaviors.Hiroshi G. Okuno, Kazuhiro Nakadai, Hiroaki Kitano
2001ESANNA computational model of monkey grating cells for oriented repetitive alternating patterns.Tino Lourens, Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano
2001ESANNGraph extraction from color images.Tino Lourens, Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano
2001IJCAIReal-Time Auditory and Visual Multiple-Object Tracking for Humanoids.Kazuhiro Nakadai, Ken-ichi Hidai, Hiroshi Mizoguchi, Hiroshi G. Okuno, Hiroaki Kitano
2001InterspeechReal-time multiple speaker tracking by multi-modal integration for mobile robots.Kazuhiro Nakadai, Ken-ichi Hidai, Hiroshi G. Okuno, Hiroaki Kitano
2001InterspeechSeparating three simultaneous speeches with two microphones by integrating auditory and visual processing.Hiroshi G. Okuno, Kazuhiro Nakadai, Tino Lourens, Hiroaki Kitano
2001IROSEpipolar geometry based sound localization and extraction for humanoid audition.Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano
2001IROSHuman-robot interaction through real-time auditory and visual multiple-talker tracking.Hiroshi G. Okuno, Kazuhiro Nakadai, Ken-ichi Hidai, Hiroshi Mizoguchi, Hiroaki Kitano
2000AAAIActive Audition for Humanoid.Kazuhiro Nakadai, Tino Lourens, Hiroshi G. Okuno, Hiroaki Kitano
2000IROSDesign and architecture of SIG the humanoid: an experimental platform for integrated perception in RoboCup humanoid challenge.Hiroaki Kitano, Hiroshi G. Okuno, Kazuhiro Nakadai, Theo Sabisch, Tatsuya Matsui
2000IROSActive audition system and humanoid exterior design.Kazuhiro Nakadai, Tatsuya Matsui, Hiroshi G. Okuno, Hiroaki Kitano
2000PRICAIHumanoid Active Audition System Improved by the Cover Acoustics.Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano
2000RoboCupAnd the Fans Are Going Wild! SIG plus MIKE.Ian Frank, Kumiko Tanaka-Ishii, Hiroshi G. Okuno, Junichi Akita, Yukiko Nakagawa, Kazuaki Maeda, Kazuhiro Nakadai, Hiroaki Kitano
1995IJCAIOrganization of Hierarchical Perceptual Sounds: Music Scene Analysis with Autonomous Processing Modules and a Quantitative Information Integration Mechanism.Kunio Kashino, Kazuhiro Nakadai, Tomoyoshi Kinoshita, Hidehiko Tanaka