| 2025 | ICASSP | Investigation of Spatial Self-Supervised Learning and Its Application to Target Speaker Speech Recognition. | Yoshiaki Bando, Samuele Cornell, Satoru Fukayama, Shinji Watanabe |
| 2025 | ICASSP | Discrete Speech Unit Extraction via Independent Component Analysis. | Tomohiko Nakamura, Kwanghee Choi, Keigo Hojo, Yoshiaki Bando, Satoru Fukayama, Shinji Watanabe |
| 2025 | ICASSP | Source-Aware Spatial Self-Supervision for Sound Event Localization and Detection. | Yuto Nozaki, Yoshiaki Bando, Masaki Onishi |
| 2025 | ICASSP | Formula-Supervised Sound Event Detection: Pre-Training Without Real Data. | Yuto Shibata, Keitaro Tanaka, Yoshiaki Bando, Keisuke Imoto, Hirokatsu Kataoka, Yoshimitsu Aoki |
| 2025 | Interspeech | Training Onset-and-Offset-Aware Sound Event Detection on a Heterogeneous Dataset via Probabilistic Sequential Modeling. | Tomoya Yoshinaga, Yoshiaki Bando, Keitaro Tanaka, Keisuke Imoto, Masaki Onishi, Shigeo Morishima |
| 2024 | ICASSP | Neural Steerer: Novel Steering Vector Synthesis with a Causal Neural Field over Frequency and Direction. | Diego Di Carlo, Aditya Arie Nugraha, Mathieu Fontaine, Yoshiaki Bando, Kazuyoshi Yoshii |
| 2024 | Interspeech | Neural Blind Source Separation and Diarization for Distant Speech Recognition. | Yoshiaki Bando, Tomohiko Nakamura, Shinji Watanabe |
| 2024 | Interspeech | RIR-in-a-Box: Estimating Room Acoustics from 3D Mesh Data through Shoebox Approximation. | Liam Kelley, Diego Di Carlo, Aditya Arie Nugraha, Mathieu Fontaine, Yoshiaki Bando, Kazuyoshi Yoshii |
| 2024 | Interspeech | SaSLaW: Dialogue Speech Corpus with Audio-visual Egocentric Information Toward Environment-adaptive Dialogue Speech Synthesis. | Osamu Take, Shinnosuke Takamichi, Kentaro Seki, Yoshiaki Bando, Hiroshi Saruwatari |
| 2022 | ICASSP | Flow-Based Fast Multichannel Nonnegative Matrix Factorization for Blind Source Separation. | Aditya Arie Nugraha, Kouhei Sekiguchi, Mathieu Fontaine, Yoshiaki Bando, Kazuyoshi Yoshii |
| 2022 | Interspeech | Weakly-Supervised Neural Full-Rank Spatial Covariance Analysis for a Front-End System of Distant Speech Recognition. | Yoshiaki Bando, Takahiro Aizawa, Katsutoshi Itoyama, Kazuhiro Nakadai |
| 2022 | Interspeech | Direction-Aware Joint Adaptation of Neural Speech Enhancement and Recognition in Real Multiparty Conversational Environments. | Yicheng Du, Aditya Arie Nugraha, Kouhei Sekiguchi, Yoshiaki Bando, Mathieu Fontaine, Kazuyoshi Yoshii |
| 2022 | IROS | Direction-Aware Adaptive Online Neural Speech Enhancement with an Augmented Reality Headset in Real Noisy Conversational Environments. | Kouhei Sekiguchi, Aditya Arie Nugraha, Yicheng Du, Yoshiaki Bando, Mathieu Fontaine, Kazuyoshi Yoshii |
| 2021 | ICASSP | Autoregressive Fast Multichannel Nonnegative Matrix Factorization For Joint Blind Source Separation And Dereverberation. | Kouhei Sekiguchi, Yoshiaki Bando, Aditya Arie Nugraha, Mathieu Fontaine, Kazuyoshi Yoshii |
| 2021 | ICASSP | Pitch-Timbre Disentanglement Of Musical Instrument Sounds Based On Vae-Based Metric Learning. | Keitaro Tanaka, Ryo Nishikimi, Yoshiaki Bando, Kazuyoshi Yoshii, Shigeo Morishima |
| 2021 | Interspeech | Alpha-Stable Autoregressive Fast Multichannel Nonnegative Matrix Factorization for Joint Speech Enhancement and Dereverberation. | Mathieu Fontaine, Kouhei Sekiguchi, Aditya Arie Nugraha, Yoshiaki Bando, Kazuyoshi Yoshii |
| 2020 | Interspeech | Adaptive Neural Speech Enhancement with a Denoising Variational Autoencoder. | Yoshiaki Bando, Kouhei Sekiguchi, Kazuyoshi Yoshii |
| 2020 | IROS | Self-supervised Neural Audio-Visual Sound Source Localization via Probabilistic Spatial Modeling. | Yoshiki Masuyama, Yoshiaki Bando, Kohei Yatabe, Yoko Sasaki, Masaki Onishi, Yasuhiro Oikawa |
| 2018 | ICASSP | Statistical Speech Enhancement Based on Probabilistic Integration of Variational Autoencoder and Non-Negative Matrix Factorization. | Yoshiaki Bando, Masato Mimura, Katsutoshi Itoyama, Kazuyoshi Yoshii, Tatsuya Kawahara |
| 2018 | ICASSP | Unsupervised Beamforming Based on Multichannel Nonnegative Matrix Factorization for Noisy Speech Recognition. | Kazuki Shimada, Yoshiaki Bando, Masato Mimura, Katsutoshi Itoyama, Kazuyoshi Yoshii, Tatsuya Kawahara |
| 2017 | ICASSP | Bayesian multichannel nonnegative matrix factorization for audio source separation and localization. | Kousuke Itakura, Yoshiaki Bando, Eita Nakamura, Katsutoshi Itoyama, Kazuyoshi Yoshii, Tatsuya Kawahara |
| 2017 | Interspeech | Combined Multi-Channel NMF-Based Robust Beamforming for Noisy Speech Recognition. | Masato Mimura, Yoshiaki Bando, Kazuki Shimada, Shinsuke Sakai, Kazuyoshi Yoshii, Tatsuya Kawahara |
| 2017 | IROS | Development of microphone-array-embedded UAV for search and rescue task. | Kazuhiro Nakadai, Makoto Kumon, Hiroshi G. Okuno, Kotaro Hoshiba, Mizuho Wakabayashi, Kai Washizaki, Takahiro Ishiki, Daniel Gabriel, Yoshiaki Bando, Takayuki Morito, Ryosuke Kojima, Osamu Sugiyama |
| 2016 | IROS | Online simultaneous localization and mapping of multiple sound sources and asynchronous microphone arrays. | Kouhei Sekiguchi, Yoshiaki Bando, Keisuke Nakamura, Kazuhiro Nakadai, Katsutoshi Itoyama, Kazuyoshi Yoshii |
| 2015 | AAAI | Recognition of In-Field Frog Chorusing Using Bayesian Nonparametric Microphone Array Processing. | Yoshiaki Bando, Takuma Otsuka, Ikkyu Aihara, Hiromitsu Awano, Katsutoshi Itoyama, Kazuyoshi Yoshii, Hiroshi Gitchang Okuno |
| 2015 | ICASSP | Challenges in deploying a microphone array to localize and separate sound sources in real auditory scenes. | Yoshiaki Bando, Takuma Otsuka, Katsutoshi Itoyama, Kazuyoshi Yoshii, Yoko Sasaki, Satoshi Kagami, Hiroshi G. Okuno |
| 2015 | Interspeech | Bayesian integration of sound source separation and speech recognition: a new approach to simultaneous speech recognition. | Kousuke Itakura, Izaya Nishimuta, Yoshiaki Bando, Katsutoshi Itoyama, Kazuyoshi Yoshii |
| 2015 | IROS | Microphone-accelerometer based 3D posture estimation for a hose-shaped rescue robot. | Yoshiaki Bando, Katsutoshi Itoyama, Masashi Konyo, Satoshi Tadokoro, Kazuhiro Nakadai, Kazuyoshi Yoshii, Hiroshi G. Okuno |
| 2015 | IROS | Audio-visual beat tracking based on a state-space model for a music robot dancing with humans. | Misato Ohkita, Yoshiaki Bando, Yukara Ikemiya, Katsutoshi Itoyama, Kazuyoshi Yoshii |
| 2015 | IROS | Optimizing the layout of multiple mobile robots for cooperative sound source separation. | Kouhei Sekiguchi, Yoshiaki Bando, Katsutoshi Itoyama, Kazuyoshi Yoshii |
| 2013 | IROS | Posture estimation of hose-shaped robot using microphone array localization. | Yoshiaki Bando, Takeshi Mizumoto, Katsutoshi Itoyama, Kazuhiro Nakadai, Hiroshi G. Okuno |