| 2025 | ICMI | A Multifaceted Multi-Agent Framework for Zero-Shot Emotion Analysis and Recognition of Symbolic Music. | Jiahao Zhao, Yunjia Li, Kazuyoshi Yoshii |
| 2024 | ICASSP | Neural Steerer: Novel Steering Vector Synthesis with a Causal Neural Field over Frequency and Direction. | Diego Di Carlo, Aditya Arie Nugraha, Mathieu Fontaine, Yoshiaki Bando, Kazuyoshi Yoshii |
| 2024 | Interspeech | RIR-in-a-Box: Estimating Room Acoustics from 3D Mesh Data through Shoebox Approximation. | Liam Kelley, Diego Di Carlo, Aditya Arie Nugraha, Mathieu Fontaine, Yoshiaki Bando, Kazuyoshi Yoshii |
| 2023 | ICASSP | Neural Band-to-Piano Score Arrangement with Stepless Difficulty Control. | Moyu Terao, Eita Nakamura, Kazuyoshi Yoshii |
| 2022 | ICASSP | Flow-Based Fast Multichannel Nonnegative Matrix Factorization for Blind Source Separation. | Aditya Arie Nugraha, Kouhei Sekiguchi, Mathieu Fontaine, Yoshiaki Bando, Kazuyoshi Yoshii |
| 2022 | ICASSP | Difficulty-Aware Neural Band-to-Piano Score Arrangement based on Note- and Statistic-Level Criteria. | Moyu Terao, Yuki Hiramatsu, Ryoto Ishizuka, Yiming Wu, Kazuyoshi Yoshii |
| 2022 | Interspeech | Direction-Aware Joint Adaptation of Neural Speech Enhancement and Recognition in Real Multiparty Conversational Environments. | Yicheng Du, Aditya Arie Nugraha, Kouhei Sekiguchi, Yoshiaki Bando, Mathieu Fontaine, Kazuyoshi Yoshii |
| 2022 | IROS | Direction-Aware Adaptive Online Neural Speech Enhancement with an Augmented Reality Headset in Real Noisy Conversational Environments. | Kouhei Sekiguchi, Aditya Arie Nugraha, Yicheng Du, Yoshiaki Bando, Mathieu Fontaine, Kazuyoshi Yoshii |
| 2021 | ICASSP | Statistical Correction of Transcribed Melody Notes Based on Probabilistic Integration of a Music Language Model and a Transcription Error Model. | Yuki Hiramatsu, Go Shibata, Ryo Nishikimi, Eita Nakamura, Kazuyoshi Yoshii |
| 2021 | ICASSP | Autoregressive Fast Multichannel Nonnegative Matrix Factorization For Joint Blind Source Separation And Dereverberation. | Kouhei Sekiguchi, Yoshiaki Bando, Aditya Arie Nugraha, Mathieu Fontaine, Kazuyoshi Yoshii |
| 2021 | ICASSP | Pitch-Timbre Disentanglement Of Musical Instrument Sounds Based On Vae-Based Metric Learning. | Keitaro Tanaka, Ryo Nishikimi, Yoshiaki Bando, Kazuyoshi Yoshii, Shigeo Morishima |
| 2021 | Interspeech | Alpha-Stable Autoregressive Fast Multichannel Nonnegative Matrix Factorization for Joint Speech Enhancement and Dereverberation. | Mathieu Fontaine, Kouhei Sekiguchi, Aditya Arie Nugraha, Yoshiaki Bando, Kazuyoshi Yoshii |
| 2020 | Interspeech | Unsupervised Robust Speech Enhancement Based on Alpha-Stable Fast Multichannel Nonnegative Matrix Factorization. | Mathieu Fontaine, Kouhei Sekiguchi, Aditya Arie Nugraha, Kazuyoshi Yoshii |
| 2020 | Interspeech | Adaptive Neural Speech Enhancement with a Denoising Variational Autoencoder. | Yoshiaki Bando, Kouhei Sekiguchi, Kazuyoshi Yoshii |
| 2019 | ICASSP | Improved Metrical Alignment of Midi Performance Based on a Repetition-aware Online-adapted Grammar. | Andrew McLeod, Eita Nakamura, Kazuyoshi Yoshii |
| 2019 | ICASSP | Unsupervised Melody Style Conversion. | Eita Nakamura, Kentaro Shibata, Ryo Nishikimi, Kazuyoshi Yoshii |
| 2019 | ICASSP | Automatic Singing Transcription Based on Encoder-decoder Recurrent Neural Networks with a Weakly-supervised Attention Mechanism. | Ryo Nishikimi, Eita Nakamura, Satoru Fukayama, Masataka Goto, Kazuyoshi Yoshii |
| 2019 | ICASSP | A Deep Generative Model of Speech Complex Spectrograms. | Aditya Arie Nugraha, Kouhei Sekiguchi, Kazuyoshi Yoshii |
| 2019 | ICASSP | Joint Transcription of Lead, Bass, and Rhythm Guitars Based on a Factorial Hidden Semi-Markov Model. | Kentaro Shibata, Ryo Nishikimi, Satoru Fukayama, Masataka Goto, Eita Nakamura, Katsutoshi Itoyama, Kazuyoshi Yoshii |
| 2019 | ICASSP | Bayesian Drum Transcription Based on Nonnegative Matrix Factor Decomposition with a Deep Score Prior. | Shun Ueda, Kentaro Shibata, Yusuke Wada, Ryo Nishikimi, Eita Nakamura, Kazuyoshi Yoshii |
| 2019 | RO-MAN | Audio-Visual SLAM towards Human Tracking and Human-Robot Interaction in Indoor Environments. | Aaron Chau, Kouhei Sekiguchi, Aditya Arie Nugraha, Kazuyoshi Yoshii, Kotaro Funakoshi |
| 2018 | ICASSP | Statistical Speech Enhancement Based on Probabilistic Integration of Variational Autoencoder and Non-Negative Matrix Factorization. | Yoshiaki Bando, Masato Mimura, Katsutoshi Itoyama, Kazuyoshi Yoshii, Tatsuya Kawahara |
| 2018 | ICASSP | An End-to-End Approach to Joint Social Signal Detection and Automatic Speech Recognition. | Hirofumi Inaguma, Masato Mimura, Koji Inoue, Kazuyoshi Yoshii, Tatsuya Kawahara |
| 2018 | ICASSP | Towards Complete Polyphonic Music Transcription: Integrating Multi-Pitch Detection and Rhythm Quantization. | Eita Nakamura, Emmanouil Benetos, Kazuyoshi Yoshii, Simon Dixon |
| 2018 | ICASSP | Unsupervised Beamforming Based on Multichannel Nonnegative Matrix Factorization for Noisy Speech Recognition. | Kazuki Shimada, Yoshiaki Bando, Masato Mimura, Katsutoshi Itoyama, Kazuyoshi Yoshii, Tatsuya Kawahara |
| 2018 | ICASSP | Correlated Tensor Factorization for Audio Source Separation. | Kazuyoshi Yoshii |
| 2017 | ICASSP | Bayesian multichannel nonnegative matrix factorization for audio source separation and localization. | Kousuke Itakura, Yoshiaki Bando, Eita Nakamura, Katsutoshi Itoyama, Kazuyoshi Yoshii, Tatsuya Kawahara |
| 2017 | Interspeech | Combined Multi-Channel NMF-Based Robust Beamforming for Noisy Speech Recognition. | Masato Mimura, Yoshiaki Bando, Kazuki Shimada, Shinsuke Sakai, Kazuyoshi Yoshii, Tatsuya Kawahara |
| 2016 | ICASSP | Tree-structured probabilistic model of monophonic written music based on the generative theory of tonal music. | Eita Nakamura, Masatoshi Hamanaka, Keiji Hirata, Kazuyoshi Yoshii |
| 2016 | ICASSP | Student's T nonnegative matrix factorization and positive semidefinite tensor factorization for single-channel audio source separation. | Kazuyoshi Yoshii, Katsutoshi Itoyama, Masataka Goto |
| 2016 | IROS | Online simultaneous localization and mapping of multiple sound sources and asynchronous microphone arrays. | Kouhei Sekiguchi, Yoshiaki Bando, Keisuke Nakamura, Kazuhiro Nakadai, Katsutoshi Itoyama, Kazuyoshi Yoshii |
| 2015 | AAAI | Recognition of In-Field Frog Chorusing Using Bayesian Nonparametric Microphone Array Processing. | Yoshiaki Bando, Takuma Otsuka, Ikkyu Aihara, Hiromitsu Awano, Katsutoshi Itoyama, Kazuyoshi Yoshii, Hiroshi Gitchang Okuno |
| 2015 | ICASSP | Challenges in deploying a microphone array to localize and separate sound sources in real auditory scenes. | Yoshiaki Bando, Takuma Otsuka, Katsutoshi Itoyama, Kazuyoshi Yoshii, Yoko Sasaki, Satoshi Kagami, Hiroshi G. Okuno |
| 2015 | ICASSP | Singing voice analysis and editing based on mutually dependent F0 estimation and source separation. | Yukara Ikemiya, Kazuyoshi Yoshii, Katsutoshi Itoyama |
| 2015 | ICASSP | A feedback framework for improved chord recognition based on NMF-based approximate note transcription. | Satoshi Maruo, Kazuyoshi Yoshii, Katsutoshi Itoyama, Matthias Mauch, Masataka Goto |
| 2015 | Interspeech | Bayesian integration of sound source separation and speech recognition: a new approach to simultaneous speech recognition. | Kousuke Itakura, Izaya Nishimuta, Yoshiaki Bando, Katsutoshi Itoyama, Kazuyoshi Yoshii |
| 2015 | IROS | Microphone-accelerometer based 3D posture estimation for a hose-shaped rescue robot. | Yoshiaki Bando, Katsutoshi Itoyama, Masashi Konyo, Satoshi Tadokoro, Kazuhiro Nakadai, Kazuyoshi Yoshii, Hiroshi G. Okuno |
| 2015 | IROS | Audio-visual beat tracking based on a state-space model for a music robot dancing with humans. | Misato Ohkita, Yoshiaki Bando, Yukara Ikemiya, Katsutoshi Itoyama, Kazuyoshi Yoshii |
| 2015 | IROS | Optimizing the layout of multiple mobile robots for cooperative sound source separation. | Kouhei Sekiguchi, Yoshiaki Bando, Katsutoshi Itoyama, Kazuyoshi Yoshii |
| 2015 | ISM | Songle Widget: Making Animation and Physical Devices Synchronized with Music Videos on the Web. | Masataka Goto, Kazuyoshi Yoshii, Tomoyasu Nakano |
| 2015 | ISM | Musical Similarity and Commonness Estimation Based on Probabilistic Generative Models. | Tomoyasu Nakano, Kazuyoshi Yoshii, Masataka Goto |
| 2015 | SMC | Identification and Localization of One or Two Concurrent Speakers in a Binaural Robotic Context. | Karim Youssef, Katsutoshi Itoyama, Kazuyoshi Yoshii |
| 2014 | ICASSP | Timbre replacement of harmonic and drum components for music audio signals. | Tomohiko Nakamura, Hirokazu Kameoka, Kazuyoshi Yoshii, Masataka Goto |
| 2014 | ICASSP | Vocal timbre analysis using latent Dirichlet allocation and cross-gender vocal timbre similarity. | Tomoyasu Nakano, Kazuyoshi Yoshii, Masataka Goto |
| 2014 | ICASSP | Cultivating vocal activity detection for music audio signals in a circulation-type crowdsourcing ecosystem. | Kazuyoshi Yoshii, Hiromasa Fujihara, Tomoyasu Nakano, Masataka Goto |
| 2013 | ICASSP | Infinite kernel linear prediction for joint estimation of spectral envelope and fundamental frequency. | Kazuyoshi Yoshii, Masataka Goto |
| 2013 | ICML | Infinite Positive Semidefinite Tensor Factorization for Source Separation of Mixture Signals. | Kazuyoshi Yoshii, Ryota Tomioka, Daichi Mochihashi, Masataka Goto |
| 2013 | IROS | Nested iGMM recognition and multiple hypothesis tracking of moving sound sources for mobile robot audition. | Yoko Sasaki, Naotaka Hatao, Kazuyoshi Yoshii, Satoshi Kagami |
| 2012 | ICASSP | Unsupervised music understanding based on nonparametric Bayesian models. | Kazuyoshi Yoshii, Masataka Goto |
| 2012 | ITA | PodCastle and songle: Crowdsourcing-based web services for spoken document retrieval and active music listening. | Masataka Goto, Jun Ogata, Kazuyoshi Yoshii, Hiromasa Fujihara, Matthias Mauch, Tomoyasu Nakano |
| 2012 | WWW | PodCastle and Songle: Crowdsourcing-Based Web Services for Retrieval and Browsing of Speech and Music Content. | Masataka Goto, Jun Ogata, Kazuyoshi Yoshii, Hiromasa Fujihara, Matthias Mauch, Tomoyasu Nakano |
| 2008 | IROS | A robot listens to music and counts its beats aloud by separating music from counting voice. | Takeshi Mizumoto, Ryu Takeda, Kazuyoshi Yoshii, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2008 | IROS | A robot uses its own microphone to synchronize its steps to musical beats while scatting and singing. | Kazumasa Murata, Kazuhiro Nakadai, Kazuyoshi Yoshii, Ryu Takeda, Toyotaka Torii, Hiroshi G. Okuno, Yuji Hasegawa, Hiroshi Tsujino |
| 2007 | IROS | A biped robot that keeps steps in time with musical beats while listening to music with its own ears. | Kazuyoshi Yoshii, Kazuhiro Nakadai, Toyotaka Torii, Yuji Hasegawa, Hiroshi Tsujino, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2006 | ICASSP | An Error Correction Framework Based on Drum Pattern Periodicity for Improving Drum Sound Detection. | Kazuyoshi Yoshii, Masataka Goto, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno |
| 2004 | Interspeech | Drum sound identification for polyphonic music using template adaptation and matching methods. | Kazuyoshi Yoshii, Masataka Goto, Hiroshi G. Okuno |