| 2026 | AAAI | Unsupervised Single-Channel Audio Separation with Diffusion Source Priors. | Runwu Shi, Chang Li, Jiang Wang, Rui Zhang, Nabeela Khan, Benjamin Yen, Takeshi Ashizawa, Kazuhiro Nakadai |
| 2026 | ACL | Pattern Enhanced Multi-Turn Jailbreaking: Exploiting Structural Vulnerabilities in Large Language Models. | Ragib Amin Nihal, Rui Wen, Kazuhiro Nakadai, Jun Sakuma |
| 2025 | ACL | Multilingual Gloss-free Sign Language Translation: Towards Building a Sign Language Foundation Model. | Sihan Tan, Taro Miyazaki, Kazuhiro Nakadai |
| 2025 | COLING | Improvement in Sign Language Translation Using Text CTC Alignment. | Sihan Tan, Taro Miyazaki, Nabeela Khan, Kazuhiro Nakadai |
| 2025 | ICASSP | Distance Based Single-Channel Target Speech Extraction. | Runwu Shi, Benjamin Yen, Kazuhiro Nakadai |
| 2025 | ICMI | SignFlow: End-to-End Sign Language Generation for One-to-Many Modeling using Conditional Flow Matching. | Nabeela Khan, Bowen Wu, Sihan Tan, Carlos Toshinori Ishi, Kazuhiro Nakadai |
| 2025 | IROS | Swarm Active Audition with Robots and Drones: Real-World Performance Validation. | Kazuhiro Nakadai, Kotaro Hoshiba, Benjamin Yen, Makoto Kumon, Yoko Sasaki |
| 2025 | IROS | Single-Microphone-Based Sound Source Localization for Mobile Robots in Reverberant Environments. | Jiang Wang, Runwu Shi, Benjamin Yen, He Kong, Kazuhiro Nakadai |
| 2025 | RO-MAN | Towards Online Sign Language Expression for Real-Time Human-Robot Interaction. | Nabeela Khan, Sihan Tan, Kazuhiro Nakadai |
| 2024 | ICPR | UAV-Enhanced Combination to Application: Comprehensive Analysis and Benchmarking of a Human Detection Dataset for Disaster Scenarios. | Ragib Amin Nihal, Benjamin Yen, Katsutoshi Itoyama, Kazuhiro Nakadai |
| 2024 | RO-MAN | Improving Impressions of Response Delay in AI-based Spoken Dialogue Systems. | Shuhei Asaka, Katsutoshi Itoyama, Kazuhiro Nakadai |
| 2023 | Interspeech | miniStreamer: Enhancing Small Conformer with Chunked-Context Masking for Streaming ASR Applications on the Edge. | Haris Gulzar, Monikka Roslianna Busto, Takeharu Eda, Katsutoshi Itoyama, Kazuhiro Nakadai |
| 2023 | Interspeech | Retraining-free Customized ASR for Enharmonic Words Based on a Named-Entity-Aware Model and Phoneme Similarity Estimation. | Yui Sudo, Kazuya Hata, Kazuhiro Nakadai |
| 2023 | RO-MAN | Improving Sign Language Understanding Introducing Label Smoothing. | Sihan Tan, Khan Nabeela Khanum, Katsutoshi Itoyama, Kazuhiro Nakadai |
| 2023 | RO-MAN | Online Adaptation of Fourier Series Based Acoustic Transfer Function Model to Improve Sound Source Localization and Separation. | Yui Sudo, Masayuki Takigahira, Hideo Tsuru, Kazuhiro Nakadai, Hirofumi Nakajima |
| 2022 | Interspeech | Weakly-Supervised Neural Full-Rank Spatial Covariance Analysis for a Front-End System of Distant Speech Recognition. | Yoshiaki Bando, Takahiro Aizawa, Katsutoshi Itoyama, Kazuhiro Nakadai |
| 2022 | Interspeech | Streaming Automatic Speech Recognition with Re-blocking Processing Based on Integrated Voice Activity Detection. | Yui Sudo, Muhammad Shakeel, Kazuhiro Nakadai, Jiatong Shi, Shinji Watanabe |
| 2022 | Interspeech | Empirical Sampling from Latent Utterance-wise Evidence Model for Missing Data ASR based on Neural Encoder-Decoder Model. | Ryu Takeda, Yui Sudo, Kazuhiro Nakadai, Kazunori Komatani |
| 2022 | IROS | Spotforming by NMF Using Multiple Microphone Arrays. | Yasuhiro Kagimoto, Katsutoshi Itoyama, Kenji Nishida, Kazuhiro Nakadai |
| 2022 | IROS | Outdoor evaluation of sound source localization for drone groups using microphone arrays. | Taiki Yamada, Katsutoshi Itoyama, Kenji Nishida, Kazuhiro Nakadai |
| 2021 | Interspeech | Assessment of von Mises-Bernoulli Deep Neural Network in Sound Source Localization. | Katsutoshi Itoyama, Yoshiya Morimoto, Shungo Masaki, Ryosuke Kojima, Kenji Nishida, Kazuhiro Nakadai |
| 2021 | IROS | Fully-Online Always-Adaptation of Transfer Functions and Its Application to Sound Source Localization and Separation. | Kazuhiro Nakadai, Masayuki Takigahira, Yusuke Kawai, Hirofumi Nakajima |
| 2020 | IROS | Synchronization of Microphones Based on Rank Minimization of Warped Spectrum for Asynchronous Distributed Recording. | Katsutoshi Itoyama, Kazuhiro Nakadai |
| 2019 | ICASSP | An Integrated Framework for Field Recording, Localization, Classification and Annotation of Birdsongs Using Robot Audition Techniques - Harkbird 2.0. | Shinji Sumitani, Reiji Suzuki, Naoaki Chiba, Shiho Matsubayashi, Takaya Arita, Kazuhiro Nakadai, Hiroshi Gitchang Okuno |
| 2019 | IJCNN | Weakly-Supervised Deep Recurrent Neural Networks for Basic Dance Step Generation. | Nelson Yalta, Shinji Watanabe, Kazuhiro Nakadai, Tetsuya Ogata |
| 2019 | IROS | Environmental sound segmentation utilizing Mask U-Net. | Yui Sudo, Katsutoshi Itoyama, Kenji Nishida, Kazuhiro Nakadai |
| 2018 | IROS | HARK-Bird-Box: A Portable Real-time Bird Song Scene Analysis System. | Ryosuke Kojima, Osamu Sugiyama, Kotaro Hoshiba, Reiji Suzuki, Kazuhiro Nakadai |
| 2018 | IROS | Extracting the Relationship between the Spatial Distribution and Types of Bird Vocalizations Using Robot Audition System HARK. | Shinji Sumitani, Reiji Suzuki, Shiho Matsubayashi, Takaya Arita, Kazuhiro Nakadai, Hiroshi G. Okuno |
| 2018 | IROS | Multi-timescale Feature-extraction Architecture of Deep Neural Networks for Acoustic Model Training from Raw Speech Signal. | Ryu Takeda, Kazuhiro Nakadai, Kazunori Komatani |
| 2018 | IVA | To animate or anime-te?: Investigating sign avatar comprehensibility. | Heike Brock, Shigeaki Nishina, Kazuhiro Nakadai |
| 2018 | LREC | Deep JSLC: A Multimodal Corpus Collection for Data-driven Generation of Japanese Sign Language Expressions. | Heike Brock, Kazuhiro Nakadai |
| 2018 | RO-MAN | Data-driven development of Virtual Sign Language Communication Agents. | Agathe Balayn, Heike Brock, Kazuhiro Nakadai |
| 2018 | RO-MAN | Signal Restoration based on Bi-directional LSTM with Spectral Filtering for Robot Audition. | Ryosuke Taniguchi, Kotaro Hoshiba, Katsutoshi Itoyama, Kenji Nishida, Kazuhiro Nakadai |
| 2017 | DSAA | A Spatial-Cue-Based Probabilistic Model for Bird Song Scene Analysis. | Ryosuke Kojima, Osamu Sugiyama, Kotaro Hoshiba, Reiji Suzuki, Kazuhiro Nakadai |
| 2017 | Interspeech | Node Pruning Based on Entropy of Weights and Node Activity for Small-Footprint Acoustic Model Based on Deep Neural Networks. | Ryu Takeda, Kazuhiro Nakadai, Kazunori Komatani |
| 2017 | IROS | Development of microphone-array-embedded UAV for search and rescue task. | Kazuhiro Nakadai, Makoto Kumon, Hiroshi G. Okuno, Kotaro Hoshiba, Mizuho Wakabayashi, Kai Washizaki, Takahiro Ishiki, Daniel Gabriel, Yoshiaki Bando, Takayuki Morito, Ryosuke Kojima, Osamu Sugiyama |
| 2016 | CHI | Designing Speech and Multimodal Interactions for Mobile, Wearable, and Pervasive Applications. | Cosmin Munteanu, Pourang Irani, Sharon L. Oviatt, Matthew P. Aylett, Gerald Penn, Shimei Pan, Nikhil Sharma, Frank Rudzicz, Randy Gomez, Keisuke Nakamura, Kazuhiro Nakadai |
| 2016 | Interspeech | Localizing Bird Songs Using an Open Source Robot Audition System with a Microphone Array. | Reiji Suzuki, Shiho Matsubayashi, Kazuhiro Nakadai, Hiroshi G. Okuno |
| 2016 | IROS | Semi-automatic bird song analysis by spatial-cue-based integration of sound source detection, localization, separation, and identification. | Ryosuke Kojima, Osamu Sugiyama, Reiji Suzuki, Kazuhiro Nakadai, Charles E. Taylor |
| 2016 | IROS | Partially Shared Deep Neural Network in sound source separation and identification using a UAV-embedded microphone array. | Takayuki Morito, Osamu Sugiyama, Ryosuke Kojima, Kazuhiro Nakadai |
| 2016 | IROS | Online simultaneous localization and mapping of multiple sound sources and asynchronous microphone arrays. | Kouhei Sekiguchi, Yoshiaki Bando, Keisuke Nakamura, Kazuhiro Nakadai, Katsutoshi Itoyama, Kazuyoshi Yoshii |
| 2016 | IROS | Robust sound source mapping using three-layered selective audio rays for mobile robots. | Daobilige Su, Keisuke Nakamura, Kazuhiro Nakadai, Jaime Valls Mir |
| 2016 | LREC | Construction of Japanese Audio-Visual Emotion Database and Its Application in Emotion Recognition. | Nurul Lubis, Randy Gomez, Sakriani Sakti, Keisuke Nakamura, Koichiro Yoshino, Satoshi Nakamura, Kazuhiro Nakadai |
| 2016 | RO-MAN | Leveraging phantom signals for improved voice-based human-robot interaction. | Randy Gomez, Yurii Vasylkiv, Keisuke Nakamura, Takeshi Mizumoto, Kazuhiro Nakadai |
| 2015 | ASRU | Acoustic model training based on node-wise weight boundary model increasing speed of discrete neural networks. | Ryu Takeda, Kazunori Komatani, Kazuhiro Nakadai |
| 2015 | ICASSP | Robot audition: Its rise and perspectives. | Hiroshi G. Okuno, Kazuhiro Nakadai |
| 2015 | ICRA | Temporal smearing compensation in reverberant environment for speech-based human-robot interaction. | Randy Gomez, Keisuke Nakamura, Takeshi Mizumoto, Kazuhiro Nakadai |
| 2015 | ICRA | On-the-spot calibration of microphone array Transfer Functions for robot audition. | Keisuke Nakamura, Surya Ambrose, Kazuhiro Nakadai |
| 2015 | Interspeech | Dereverberation for active human-robot communication robust to speaker's face orientation. | Randy Gomez, Levko Ivanchuk, Keisuke Nakamura, Takeshi Mizumoto, Kazuhiro Nakadai |
| 2015 | IROS | Microphone-accelerometer based 3D posture estimation for a hose-shaped rescue robot. | Yoshiaki Bando, Katsutoshi Itoyama, Masashi Konyo, Satoshi Tadokoro, Kazuhiro Nakadai, Kazuyoshi Yoshii, Hiroshi G. Okuno |
| 2015 | IROS | Utilizing visual cues in robot audition for sound source discrimination in speech-based human-robot communication. | Randy Gomez, Levko Ivanchuk, Keisuke Nakamura, Takeshi Mizumoto, Kazuhiro Nakadai |
| 2015 | IROS | Audio-visual scene understanding utilizing text information for a cooking support robot. | Ryosuke Kojima, Osamu Sugiyama, Kazuhiro Nakadai |
| 2015 | IROS | Robot-Audition-based Human-Machine Interface for a Car. | Kazuhiro Nakadai, Takeshi Mizumoto, Keisuke Nakamura |
| 2015 | IROS | Robot audition based Acoustic Event Identification using a Bayesian model considering spectral and temporal uncertainties. | Keisuke Nakamura, Kazuhiro Nakadai |
| 2015 | IROS | Interactive sound source localization using robot audition for tablet devices. | Keisuke Nakamura, Lana Sinapayen, Kazuhiro Nakadai |
| 2015 | RO-MAN | A case study of an automatic volume control interface for a telepresence system. | Masaaki Takahashi, Masa Ogata, Michita Imai, Keisuke Nakamura, Kazuhiro Nakadai |
| 2014 | HAI | Volume adaptation and visualization by modeling the volume level in noisy environments for telepresence system. | Akira Hayamizu, Michita Imai, Keisuke Nakamura, Kazuhiro Nakadai |
| 2014 | Interspeech | Lipreading using convolutional neural network. | Kuniaki Noda, Yuki Yamaguchi, Kazuhiro Nakadai, Hiroshi G. Okuno, Tetsuya Ogata |
| 2014 | IROS | Speech-based human-robot interaction robust to acoustic reflections in real environment. | Randy Gomez, Koji Inoue, Keisuke Nakamura, Takeshi Mizumoto, Kazuhiro Nakadai |
| 2014 | IROS | Improvement in outdoor sound source detection using a quadrotor-embedded microphone array. | Takuma Ohata, Keisuke Nakamura, Takeshi Mizumoto, Taiki Tezuka, Kazuhiro Nakadai |
| 2014 | IROS | Making a robot dance to diverse musical genre in noisy environments. | Joo Lobato Oliveira, Keisuke Nakamura, Thibault Langlois, Fabien Gouyon, Kazuhiro Nakadai, Angelica Lim, Lus Paulo Reis, Hiroshi G. Okuno |
| 2014 | ICRA | Ego-motion noise suppression for robots based on Semi-Blind Infinite Non-negative Matrix Factorization. | Taiki Tezuka, Takami Yoshida, Kazuhiro Nakadai |
| 2014 | SMC | Auditory-aware navigation for mobile robots based on reflection-robust sound source localization and visual SLAM. | Gautam Narang, Keisuke Nakamura, Kazuhiro Nakadai |
| 2014 | SMC | Sound annotation tool for multidirectional sounds based on spatial information extracted by HARK robot audition software. | Osamu Sugiyama, Katsutoshi Itoyama, Kazuhiro Nakadai, Hiroshi G. Okuno |
| 2013 | ICASSP | Robustness to speaker position in distant-talking automatic speech recognition. | Randy Gomez, Keisuke Nakamura, Kazuhiro Nakadai |
| 2013 | ICRA | Hands-free human-robot communication robust to speaker's radial position. | Randy Gomez, Keisuke Nakamura, Kazuhiro Nakadai, Ui-Hyun Kim, Hiroshi G. Okuno, Tatsuya Kawahara |
| 2013 | IROS | Posture estimation of hose-shaped robot using microphone array localization. | Yoshiaki Bando, Takeshi Mizumoto, Katsutoshi Itoyama, Kazuhiro Nakadai, Hiroshi G. Okuno |
| 2013 | IROS | Noise correlation matrix estimation for improving sound source localization by multirotor UAV. | Koutarou Furukawa, Keita Okutani, Kohei Nagira, Takuma Otsuka, Katsutoshi Itoyama, Kazuhiro Nakadai, Hiroshi G. Okuno |
| 2013 | IROS | Dereverberation robust to speaker's azimuthal orientation in multi-channel human-robot communication. | Randy Gomez, Keisuke Nakamura, Kazuhiro Nakadai |
| 2013 | IROS | Real-time super-resolution three-dimensional sound source localization for robots. | Keisuke Nakamura, Randy Gomez, Kazuhiro Nakadai |
| 2012 | HRI | Multi-party human-robot interaction with distant-talking speech recognition. | Randy Gomez, Tatsuya Kawahara, Keisuke Nakamura, Kazuhiro Nakadai |
| 2012 | ICASSP | Sound source localization in spatially colored noise using a hierarchical Bayesian model. | Futoshi Asano, Hideki Asoh, Kazuhiro Nakadai |
| 2012 | ICRA | Online audio beat tracking for a dancing robot in the presence of ego-motion noise in a real environment. | Joo Lobato Oliveira, Gkhan Ince, Keisuke Nakamura, Kazuhiro Nakadai |
| 2012 | IROS | Online learning for template-based multi-channel ego noise estimation. | Gkhan Ince, Kazuhiro Nakadai, Keisuke Nakamura |
| 2012 | IROS | Real-time super-resolution Sound Source Localization for robots. | Keisuke Nakamura, Kazuhiro Nakadai, Gkhan Ince |
| 2012 | IROS | Outdoor auditory scene analysis using a moving microphone array embedded in a quadrocopter. | Keita Okutani, Takami Yoshida, Keisuke Nakamura, Kazuhiro Nakadai |
| 2012 | IROS | Live assessment of beat tracking for robot audition. | Joo Lobato Oliveira, Gkhan Ince, Keisuke Nakamura, Kazuhiro Nakadai, Hiroshi G. Okuno, Lus Paulo Reis, Fabien Gouyon |
| 2012 | RO-MAN | An active audition framework for auditory-driven HRI: Application to interactive robot dancing. | Joo Lobato Oliveira, Gkhan Ince, Keisuke Nakamura, Kazuhiro Nakadai, Hiroshi G. Okuno, Lus Paulo Reis, Fabien Gouyon |
| 2011 | HRI | Rhythmic reference of a human while a rope turning task. | Kenta Yonekura, Chyon Hae Kim, Kazuhiro Nakadai, Hiroshi Tsujino, Shigeki Sugano |
| 2011 | ICASSP | Correlation matrix interpolation in Sound Source Localization for a robot. | Keisuke Nakamura, Kazuhiro Nakadai, Hirofumi Nakajima, Gkhan Ince |
| 2011 | ICRA | Assessment of general applicability of ego noise estimation. | Gkhan Ince, Keisuke Nakamura, Futoshi Asano, Hirofumi Nakajima, Kazuhiro Nakadai |
| 2011 | ICRA | Design and implementation of selectable sound separation on the Texai telepresence system using HARK. | Takeshi Mizumoto, Kazuhiro Nakadai, Takami Yoshida, Ryu Takeda, Takuma Otsuka, Toru Takahashi, Hiroshi G. Okuno |
| 2011 | Interspeech | Robust Intonation Pattern Classification in Human Robot Interaction. | Martin Heckmann, Kazuhiro Nakadai, Hirofumi Nakajima |
| 2011 | Interspeech | Bayesian Extension of MUSIC for Sound Source Localization and Tracking. | Takuma Otsuka, Kazuhiro Nakadai, Tetsuya Ogata, Hiroshi G. Okuno |
| 2011 | IROS | HARK based real-time single pane 3D auditory scene visualizer empowered by Speech Arrow. | Zheng Gong, Kazuhiro Nakadai, Hirofumi Nakajima, Ichiro Hagiwara |
| 2011 | IROS | Assessment of single-channel ego noise estimation methods. | Gkhan Ince, Kazuhiro Nakadai, Tobias Rodemann, Jun-ichi Imura, Keisuke Nakamura, Hirofumi Nakajima |
| 2011 | IROS | Incremental learning for ego noise estimation of a robot. | Gkhan Ince, Kazuhiro Nakadai, Tobias Rodemann, Jun-ichi Imura, Keisuke Nakamura, Hirofumi Nakajima |
| 2011 | IROS | SLAM-based online calibration of asynchronous microphone array for robot audition. | Hiroaki Miura, Takami Yoshida, Keisuke Nakamura, Kazuhiro Nakadai |
| 2011 | IROS | Intelligent sound source localization and its application to multimodal human tracking. | Keisuke Nakamura, Kazuhiro Nakadai, Futoshi Asano, Gkhan Ince |
| 2010 | AAAI | Design and Implementation of Two-level Synchronization for Interactive Music Robot. | Takuma Otsuka, Kazuhiro Nakadai, Toru Takahashi, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2010 | ICRA | A hybrid framework for ego noise cancellation of a robot. | Gkhan Ince, Kazuhiro Nakadai, Tobias Rodemann, Yuji Hasegawa, Hiroshi Tsujino, Jun-ichi Imura |
| 2010 | Interspeech | Applying geometric source separation for improved pitch extraction in human-robot interaction. | Martin Heckmann, Claudius Glser, Frank Joublin, Kazuhiro Nakadai |
| 2010 | Interspeech | A robust speech recognition system against the ego noise of a robot. | Gkhan Ince, Kazuhiro Nakadai, Tobias Rodemann, Hiroshi Tsujino, Jun-ichi Imura |
| 2010 | Interspeech | Two-layered audio-visual integration in voice activity detection and automatic speech recognition for robots. | Takami Yoshida, Kazuhiro Nakadai |
| 2010 | IROS | PROT - An embodied agent for intelligible and user-friendly human-robot interaction. | Ryota Fujimura, Kazuhiro Nakadai, Michita Imai, Ren Ohmura |
| 2010 | IROS | Pitch extraction in Human-Robot interaction. | Martin Heckmann, Frank Joublin, Kazuhiro Nakadai |
| 2010 | IROS | Multi-talker speech recognition under ego-motion noise using Missing Feature Theory. | Gkhan Ince, Kazuhiro Nakadai, Tobias Rodemann, Hiroshi Tsujino, Jun-ichi Imura |
| 2010 | IROS | Human-robot ensemble between robot thereminist and human percussionist using coupled oscillator model. | Takeshi Mizumoto, Takuma Otsuka, Kazuhiro Nakadai, Toru Takahashi, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2010 | IROS | Sound source separation and automatic speech recognition for moving sources. | Kazuhiro Nakadai, Hirofumi Nakajima, Gkhan Ince, Yuji Hasegawa |
| 2010 | IROS | An easily-configurable robot audition system using Histogram-based Recursive Level Estimation. | Hirofumi Nakajima, Gkhan Ince, Kazuhiro Nakadai, Yuji Hasegawa |
| 2010 | IROS | An improvement in automatic speech recognition using soft missing feature masks for robot audition. | Toru Takahashi, Kazuhiro Nakadai, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2010 | IROS | Speedup and performance improvement of ICA-based robot audition by parallel and resampling-based block-wise processing. | Ryu Takeda, Kazuhiro Nakadai, Toru Takahashi, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2010 | IROS | Two-layered audio-visual speech recognition for robots in noisy environments. | Takami Yoshida, Kazuhiro Nakadai, Hiroshi G. Okuno |
| 2010 | ICRA | Improvement in listening capability for humanoid robot HRP-2. | Toru Takahashi, Kazuhiro Nakadai, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2010 | ICRA | Upper-limit evaluation of robot audition based on ICA-BSS in multi-source, barge-in and highly reverberant conditions. | Ryu Takeda, Kazuhiro Nakadai, Toru Takahashi, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2009 | ICASSP | Sound source separation of moving speakers for robot audition. | Kazuhiro Nakadai, Hirofumi Nakajima, Yuji Hasegawa, Hiroshi Tsujino |
| 2009 | ICASSP | ICA-based efficient blind dereverberation and echo cancellation method for barge-in-able robot audition. | Ryu Takeda, Kazuhiro Nakadai, Toru Takahashi, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2009 | IROS | Ego noise suppression of a robot using template subtraction. | Gkhan Ince, Kazuhiro Nakadai, Tobias Rodemann, Yuji Hasegawa, Hiroshi Tsujino, Jun-ichi Imura |
| 2009 | IROS | Real-time sound source orientation estimation using a 96 channel microphone array. | Hirofumi Nakajima, Keiko Kikuchi, Touru Daigo, Yutaka Kaneda, Kazuhiro Nakadai, Yuji Hasegawa |
| 2009 | IROS | Intelligent sound source localization for dynamic environments. | Keisuke Nakamura, Kazuhiro Nakadai, Futoshi Asano, Yuji Hasegawa, Hiroshi Tsujino |
| 2009 | IROS | Incremental polyphonic audio to score alignment using beat tracking for singer robots. | Takuma Otsuka, Toru Takahashi, Hiroshi G. Okuno, Kazunori Komatani, Tetsuya Ogata, Kazumasa Murata, Kazuhiro Nakadai |
| 2009 | IROS | Missing-feature-theory-based robust simultaneous speech recognition system with non-clean speech acoustic model. | Toru Takahashi, Kazuhiro Nakadai, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2009 | IROS | Step-size parameter adaptation of multi-channel semi-blind ICA with piecewise linear model for barge-in-able robot audition. | Ryu Takeda, Kazuhiro Nakadai, Toru Takahashi, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2009 | ISRR | Robot Audition: Missing Feature Theory Approach and Active Audition. | Hiroshi G. Okuno, Kazuhiro Nakadai, Hyun-Don Kim |
| 2008 | ICASSP | Adaptive step-size parameter control for real-world blind source separation. | Hirofumi Nakajima, Kazuhiro Nakadai, Yuji Hasegawa, Hiroshi Tsujino |
| 2008 | ICRA | A robot referee for rock-paper-scissors sound games. | Kazuhiro Nakadai, Shun'ichi Yamamoto, Hiroshi G. Okuno, Hirofumi Nakajima, Yuji Hasegawa, Hiroshi Tsujino |
| 2008 | Interspeech | Soft missing-feature mask generation for simultaneous speech recognition system in robots. | Toru Takahashi, Shun'ichi Yamamoto, Kazuhiro Nakadai, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2008 | IROS | A robot uses its own microphone to synchronize its steps to musical beats while scatting and singing. | Kazumasa Murata, Kazuhiro Nakadai, Kazuyoshi Yoshii, Ryu Takeda, Toyotaka Torii, Hiroshi G. Okuno, Yuji Hasegawa, Hiroshi Tsujino |
| 2008 | IROS | High performance sound source separation adaptable to environmental changes for robot audition. | Hirofumi Nakajima, Kazuhiro Nakadai, Yuji Hasegawa, Hiroshi Tsujino |
| 2008 | IROS | Barge-in-able robot audition based on ICA and missing feature theory under semi-blind situation. | Ryu Takeda, Kazuhiro Nakadai, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2007 | ASRU | Design and implementation of a robot audition system for automatic speech recognition of simultaneous speech. | Shun'ichi Yamamoto, Kazuhiro Nakadai, Mikio Nakano, Hiroshi Tsujino, Jean-Marc Valin, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2007 | HCI | A Navigation System Using Ultrasonic Directional Speaker with Rotating Base. | Kentaro Ishii, Yukiko Yamamoto, Michita Imai, Kazuhiro Nakadai |
| 2007 | IROS | Coarse speech recognition by audio-visual integration based on missing feature theory. | Tomoaki Koiwa, Kazuhiro Nakadai, Jun-ichi Imura |
| 2007 | IROS | Exploiting known sound source signals to improve ICA-based robot audition in speech separation and recognition. | Ryu Takeda, Kazuhiro Nakadai, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2007 | IROS | A biped robot that keeps steps in time with musical beats while listening to music with its own ears. | Kazuyoshi Yoshii, Kazuhiro Nakadai, Toyotaka Torii, Yuji Hasegawa, Hiroshi Tsujino, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2006 | ICASSP | Robust Tracking of Multiple Sound Sources by Spatial Integration of Room And Robot Microphone Arrays. | Kazuhiro Nakadai, Hirofumi Nakajima, Masamitsu Murase, Satoshi Kaijiri, Kentaro Yamada, Takahiro Nakamura, Yuji Hasegawa, Hiroshi G. Okuno, Hiroshi Tsujino |
| 2006 | Interspeech | Speech recognition for a robot under its motor noises by selective application of missing feature theory and MLLR. | Yoshitaka Nishimura, Mikio Nakano, Kazuhiro Nakadai, Hiroshi Tsujino, Mitsuru Ishizuka |
| 2006 | Interspeech | Leak energy based missing feature mask generation for ICA and GSS and its evaluation with simultaneous speech recognition. | Shun'ichi Yamamoto, Ryu Takeda, Kazuhiro Nakadai, Mikio Nakano, Hiroshi Tsujino, Jean-Marc Valin, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2006 | IROS | Real-Time Tracking of Multiple Sound Sources by Integration of In-Room and Robot-Embedded Microphone Arrays. | Kazuhiro Nakadai, Hirofumi Nakajima, Masamitsu Murase, Hiroshi G. Okuno, Yuji Hasegawa, Hiroshi Tsujino |
| 2006 | IROS | Real-Time Robot Audition System That Recognizes Simultaneous Speech in The Real World. | Shun'ichi Yamamoto, Kazuhiro Nakadai, Mikio Nakano, Hiroshi Tsujino, Jean-Marc Valin, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2006 | PRICAI | Recognition of Simultaneous Speech by Estimating Reliability of Separated Signals for Robot Audition. | Shun'ichi Yamamoto, Ryu Takeda, Kazuhiro Nakadai, Mikio Nakano, Hiroshi Tsujino, Jean-Marc Valin, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2006 | SIGdial | Multi-Domain Spoken Dialogue System with Extensibility and Robustness against Speech Recognition Errors. | Kazunori Komatani, Naoyuki Kanda, Mikio Nakano, Kazuhiro Nakadai, Hiroshi Tsujino, Tetsuya Ogata, Hiroshi G. Okuno |
| 2005 | ICRA | Towards New Human-Humanoid Communication: Listening During Speaking by Using Ultrasonic Directional Speaker. | Kazuhiro Nakadai, Hiroshi Tsujino |
| 2005 | Interspeech | Multiple moving speaker tracking by microphone array on mobile robot. | Masamitsu Murase, Shun'ichi Yamamoto, Jean-Marc Valin, Kazuhiro Nakadai, Kentaro Yamada, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2005 | IROS | Implementation of active direction-pass filter on dynamically reconfigurable processor. | Shunsuke Kurotaki, Noriaki Suzuki, Kazuhiro Nakadai, Hiroshi G. Okuno, Hideharu Amano |
| 2005 | IROS | Sound source tracking with directivity pattern estimation using a 64 ch microphone array. | Kazuhiro Nakadai, Hirofumi Nakajima, Kentaro Yamada, Yuji Hasegawa, Takahiro Nakamura, Hiroshi Tsujino |
| 2005 | IROS | A two-layer model for behavior and dialogue planning in conversational service robots. | Mikio Nakano, Yuji Hasegawa, Kazuhiro Nakadai, Takahiro Nakamura, Johane Takeuchi, Toyotaka Torii, Hiroshi Tsujino, Naoyuki Kanda, Hiroshi G. Okuno |
| 2005 | IROS | Making a robot recognize three simultaneous sentences in real-time. | Shun'ichi Yamamoto, Kazuhiro Nakadai, Jean-Marc Valin, Jean Rouat, Franois Michaud, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2005 | ICRA | Enhanced Robot Speech Recognition Based on Microphone Array Source Separation and Missing Feature Theory. | Shun'ichi Yamamoto, Jean-Marc Valin, Kazuhiro Nakadai, Jean Rouat, Franois Michaud, Tetsuya Ogata, Hiroshi G. Okuno |
| 2004 | Interspeech | Multimodal expression for humanoid robots by integration of human speech mimicking and facial color. | Tokitomo Ariyoshi, Kazuhiro Nakadai, Hiroshi Tsujino |
| 2004 | IROS | Assessment of general applicability of robot audition system by recognizing three simultaneous speeches. | Shun'ichi Yamamoto, Kazuhiro Nakadai, Hiroshi Tsujino, Hiroshi G. Okuno |
| 2004 | ICRA | Improvement of Robot Audition by Interfacing Sound Source Separation and Automatic Speech Recognition with Missing Feature Theory. | Shun'ichi Yamamoto, Kazuhiro Nakadai, Hiroshi Tsujino, Toshio Yokoyama, Hiroshi G. Okuno |
| 2003 | ICRA | Robot recognizes three simultaneous speech by active audition. | Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano |
| 2003 | ICRA | Realizing personality in audio-visually triggered non-verbal behaviors. | Hiroshi G. Okuno, Kazuhiro Nakadai, Hiroaki Kitano |
| 2003 | Interspeech | Three simultaneous speech recognition by integration of active audition and face recognition for humanoid. | Kazuhiro Nakadai, Daisuke Matsuura, Hiroshi G. Okuno, Hiroshi Tsujino |
| 2003 | IROS | Applying scattering theory to robot audition system: robust sound source localization and extraction. | Kazuhiro Nakadai, Daisuke Matsuura, Hiroshi G. Okuno, Hiroaki Kitano |
| 2003 | IWANN | Real-Time Sound Source Localization and Separation Based on Active Audio-Visual Integration. | Hiroshi G. Okuno, Kazuhiro Nakadai |
| 2002 | AAAI | Exploiting Auditory Fovea in Humanoid-Human Interaction. | Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano |
| 2002 | ICRA | Real-Time Speaker Localization and Speech Separation by Audio-Visual Integration. | Kazuhiro Nakadai, Ken-ichi Hidai, Hiroshi G. Okuno, Hiroaki Kitano |
| 2002 | Interspeech | Real-time sound source localization and separation for robot audition. | Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano |
| 2002 | Interspeech | Auditory fovea based speech enhancement and its application to human-robot dialog system. | Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano |
| 2002 | IROS | Auditory fovea based speech separation and its application to dialog system. | Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano |
| 2002 | PRICAI | Realizing Audio-Visually Triggered ELIZA-Like Non-verbal Behaviors. | Hiroshi G. Okuno, Kazuhiro Nakadai, Hiroaki Kitano |
| 2001 | ESANN | A computational model of monkey grating cells for oriented repetitive alternating patterns. | Tino Lourens, Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano |
| 2001 | ESANN | Graph extraction from color images. | Tino Lourens, Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano |
| 2001 | IJCAI | Real-Time Auditory and Visual Multiple-Object Tracking for Humanoids. | Kazuhiro Nakadai, Ken-ichi Hidai, Hiroshi Mizoguchi, Hiroshi G. Okuno, Hiroaki Kitano |
| 2001 | Interspeech | Real-time multiple speaker tracking by multi-modal integration for mobile robots. | Kazuhiro Nakadai, Ken-ichi Hidai, Hiroshi G. Okuno, Hiroaki Kitano |
| 2001 | Interspeech | Separating three simultaneous speeches with two microphones by integrating auditory and visual processing. | Hiroshi G. Okuno, Kazuhiro Nakadai, Tino Lourens, Hiroaki Kitano |
| 2001 | IROS | Epipolar geometry based sound localization and extraction for humanoid audition. | Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano |
| 2001 | IROS | Human-robot interaction through real-time auditory and visual multiple-talker tracking. | Hiroshi G. Okuno, Kazuhiro Nakadai, Ken-ichi Hidai, Hiroshi Mizoguchi, Hiroaki Kitano |
| 2000 | AAAI | Active Audition for Humanoid. | Kazuhiro Nakadai, Tino Lourens, Hiroshi G. Okuno, Hiroaki Kitano |
| 2000 | IROS | Design and architecture of SIG the humanoid: an experimental platform for integrated perception in RoboCup humanoid challenge. | Hiroaki Kitano, Hiroshi G. Okuno, Kazuhiro Nakadai, Theo Sabisch, Tatsuya Matsui |
| 2000 | IROS | Active audition system and humanoid exterior design. | Kazuhiro Nakadai, Tatsuya Matsui, Hiroshi G. Okuno, Hiroaki Kitano |
| 2000 | PRICAI | Humanoid Active Audition System Improved by the Cover Acoustics. | Kazuhiro Nakadai, Hiroshi G. Okuno, Hiroaki Kitano |
| 2000 | RoboCup | And the Fans Are Going Wild! SIG plus MIKE. | Ian Frank, Kumiko Tanaka-Ishii, Hiroshi G. Okuno, Junichi Akita, Yukiko Nakagawa, Kazuaki Maeda, Kazuhiro Nakadai, Hiroaki Kitano |
| 1995 | IJCAI | Organization of Hierarchical Perceptual Sounds: Music Scene Analysis with Autonomous Processing Modules and a Quantitative Information Integration Mechanism. | Kunio Kashino, Kazuhiro Nakadai, Tomoyoshi Kinoshita, Hidehiko Tanaka |