| 2025 | ICASSP | Collision-less and Balanced Sampling for Language-Queried Audio Source Separation. | Binh Thien Nguyen, Daiki Takeuchi, Masahiro Yasuda, Daisuke Niizumi, Noboru Harada |
| 2025 | ICASSP | Sound Source Distance Estimation Utilizing Physics-informed Prior for Sound Event Localization and Detection. | Nao Sato, Masahiro Yasuda, Shoichiro Saito, Noboru Harada |
| 2025 | ICASSP | Spatial Annotation-free Training for Sound Event Localization and Detection. | Masahiro Yasuda, Shoichiro Saito, Nao Sato, Noboru Harada |
| 2025 | Interspeech | Towards Pre-training an Effective Respiratory Audio Foundation Model. | Daisuke Niizumi, Daiki Takeuchi, Masahiro Yasuda, Binh Thien Nguyen, Yasunori Ohishi, Noboru Harada |
| 2025 | Interspeech | CLAP-ART: Automated Audio Captioning with Semantic-rich Audio Representation Tokenizer. | Daiki Takeuchi, Binh Thien Nguyen, Masahiro Yasuda, Yasunori Ohishi, Daisuke Niizumi, Noboru Harada |
| 2025 | Interspeech | Real-time TSE demonstration via SoundBeam with KD. | Keigo Wakayama, Tomoko Kawase, Takafumi Moriya, Marc Delcroix, Hiroshi Sato, Tsubasa Ochiai, Masahiro Yasuda, Shoko Araki |
| 2024 | ICASSP | Online Target Sound Extraction with Knowledge Distillation from Partially Non-Causal Teacher. | Keigo Wakayama, Tsubasa Ochiai, Marc Delcroix, Masahiro Yasuda, Shoichiro Saito, Shoko Araki, Akira Nakayama |
| 2024 | ICASSP | 6DoF SELD: Sound Event Localization and Detection Using Microphones and Motion Tracking Sensors on Self-Motioning Human. | Masahiro Yasuda, Shoichiro Saito, Akira Nakayama, Noboru Harada |
| 2024 | Interspeech | M2D-CLAP: Masked Modeling Duo Meets CLAP for Learning General-purpose Audio-Language Representation. | Daisuke Niizumi, Daiki Takeuchi, Yasunori Ohishi, Noboru Harada, Masahiro Yasuda, Shunsuke Tsubaki, Keisuke Imoto |
| 2022 | ICASSP | Wearable Seld Dataset: Dataset For Sound Event Localization And Detection Using Wearable Devices Around Head. | Kento Nagatomo, Masahiro Yasuda, Kohei Yatabe, Shoichiro Saito, Yasuhiro Oikawa |
| 2022 | ICASSP | APPLADE: Adjustable Plug-and-Play Audio Declipper Combining DNN with Sparse Optimization. | Tomoro Tanaka, Kohei Yatabe, Masahiro Yasuda, Yasuhiro Oikawa |
| 2022 | ICASSP | Echo-Aware Adaptation of Sound Event Localization and Detection in Unknown Environments. | Masahiro Yasuda, Yasunori Ohishi, Shoichiro Saito |
| 2022 | ICASSP | Multi-View And Multi-Modal Event Detection Utilizing Transformer-Based Multi-Sensor Fusion. | Masahiro Yasuda, Yasunori Ohishi, Shoichiro Saito, Noboru Harada |
| 2020 | ICASSP | Sound Event Detection by Multitask Learning of Sound Events and Scenes with Soft Scene Labels. | Keisuke Imoto, Noriyuki Tonami, Yuma Koizumi, Masahiro Yasuda, Ryosuke Yamanishi, Yoichi Yamashita |
| 2020 | ICASSP | SPIDERnet: Attention Network For One-Shot Anomaly Detection In Sounds. | Yuma Koizumi, Masahiro Yasuda, Shin Murata, Shoichiro Saito, Hisashi Uematsu, Noboru Harada |
| 2020 | ICASSP | Sound Event Localization Based on Sound Intensity Vector Refined by Dnn-Based Denoising and Source Separation. | Masahiro Yasuda, Yuma Koizumi, Shoichiro Saito, Hisashi Uematsu, Keisuke Imoto |
| 2020 | Interspeech | A Transformer-Based Audio Captioning Model with Keyword Estimation. | Yuma Koizumi, Ryo Masumura, Kyosuke Nishida, Masahiro Yasuda, Shoichiro Saito |
| 2020 | Interspeech | Crossmodal Sound Retrieval Based on Specific Target Co-Occurrence Denoted with Weak Labels. | Masahiro Yasuda, Yasunori Ohishi, Yuma Koizumi, Noboru Harada |
| 2016 | ETRA | Relationships between EEGs and eye movements in response to facial expressions. | Minoru Nakayama, Masahiro Yasuda |