| 2025 | ICASSP | Aligned Contrastive Learning for Text-to-Music Retrieval. | Tatsuya Komatsu, Hokuto Munakata, Takuya Hasumi, Yusuke Fujita |
| 2025 | ICASSP | Language-based Audio Moment Retrieval. | Hokuto Munakata, Taichi Nishimura, Shota Nakada, Tatsuya Komatsu |
| 2025 | ICASSP | DETECLAP: Enhancing Audio-Visual Representation Learning with Object Information. | Shota Nakada, Taichi Nishimura, Hokuto Munakata, Masayoshi Kondo, Tatsuya Komatsu |
| 2025 | Interspeech | Language-Guided Contrastive Audio-Visual Masked Autoencoder with Automatically Generated Audio-Visual-Text Triplets from Videos. | Yuchi Ishikawa, Shota Nakada, Hokuto Munakata, Kazuhiro Saito, Tatsuya Komatsu, Yoshimitsu Aoki |
| 2025 | Interspeech | Leveraging Unlabeled Audio for Audio-Text Contrastive Learning via Audio-Composed Text Features. | Tatsuya Komatsu, Hokuto Munakata, Yuchi Ishikawa |
| 2024 | EMNLP | Lighthouse: A User-Friendly Library for Reproducible Video Moment Retrieval and Highlight Detection. | Taichi Nishimura, Shota Nakada, Hokuto Munakata, Tatsuya Komatsu |
| 2024 | Interspeech | Song Data Cleansing for End-to-End Neural Singer Diarization Using Neural Analysis and Synthesis Framework. | Hokuto Munakata, Ryo Terashima, Yusuke Fujita |
| 2023 | Interspeech | Recursive Sound Source Separation with Deep Learning-based Beamforming for Unknown Number of Sources. | Hokuto Munakata, Ryu Takeda, Kazunori Komatani |
| 2022 | Interspeech | Training Data Generation with DOA-based Selecting and Remixing for Unsupervised Training of Deep Separation Models. | Hokuto Munakata, Ryu Takeda, Kazunori Komatani |