Skip to content

Daisuke Niizumi

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

10

Venues

3

Active years

2021–2025

Best venue rank

A

Where they publish

Papers

10 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPSoundBeam meets M2D: Target Sound Extraction with Audio Foundation Model.Carlos Hernandez-Olivan, Marc Delcroix, Tsubasa Ochiai, Daisuke Niizumi, Naohiro Tawara, Tomohiro Nakatani, Shoko Araki
2025ICASSPCollision-less and Balanced Sampling for Language-Queried Audio Source Separation.Binh Thien Nguyen, Daiki Takeuchi, Masahiro Yasuda, Daisuke Niizumi, Noboru Harada
2025InterspeechTowards Pre-training an Effective Respiratory Audio Foundation Model.Daisuke Niizumi, Daiki Takeuchi, Masahiro Yasuda, Binh Thien Nguyen, Yasunori Ohishi, Noboru Harada
2025InterspeechCLAP-ART: Automated Audio Captioning with Semantic-rich Audio Representation Tokenizer.Daiki Takeuchi, Binh Thien Nguyen, Masahiro Yasuda, Yasunori Ohishi, Daisuke Niizumi, Noboru Harada
2024ICASSPLight Gated Multi Mini-Patch Extractor for Audio Classification.Bo He, Shiqi Zhang, Xianrui Wang, Zheng Qiu, Daiki Takeuchi, Daisuke Niizumi, Noboru Harada, Shoji Makino
2024InterspeechM2D-CLAP: Masked Modeling Duo Meets CLAP for Learning General-purpose Audio-Language Representation.Daisuke Niizumi, Daiki Takeuchi, Yasunori Ohishi, Noboru Harada, Masahiro Yasuda, Shunsuke Tsubaki, Keisuke Imoto
2023ICASSPMasked Modeling Duo: Learning Representations by Encouraging Both Networks to Model the Input.Daisuke Niizumi, Daiki Takeuchi, Yasunori Ohishi, Noboru Harada, Kunio Kashino
2023InterspeechMasked Modeling Duo for Speech: Specializing General-Purpose Audio Representation to Speech using Denoising Distillation.Daisuke Niizumi, Daiki Takeuchi, Yasunori Ohishi, Noboru Harada, Kunio Kashino
2022InterspeechIntroducing Auxiliary Text Query-modifier to Content-based Audio Retrieval.Daiki Takeuchi, Yasunori Ohishi, Daisuke Niizumi, Noboru Harada, Kunio Kashino
2021IJCNNBYOL for Audio: Self-Supervised Learning for General-Purpose Audio Representation.Daisuke Niizumi, Daiki Takeuchi, Yasunori Ohishi, Noboru Harada, Kunio Kashino