Skip to content

Tatsuya Komatsu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

36

Venues

5

Active years

2013–2025

Best venue rank

A*

Where they publish

Papers

36 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPMusic Tagging with Classifier Group Chains.Takuya Hasumi, Tatsuya Komatsu, Yusuke Fujita
2025ICASSPPre-training with Synthetic Patterns for Audio.Yuchi Ishikawa, Tatsuya Komatsu, Yoshimitsu Aoki
2025ICASSPAligned Contrastive Learning for Text-to-Music Retrieval.Tatsuya Komatsu, Hokuto Munakata, Takuya Hasumi, Yusuke Fujita
2025ICASSPLanguage-based Audio Moment Retrieval.Hokuto Munakata, Taichi Nishimura, Shota Nakada, Tatsuya Komatsu
2025ICASSPDETECLAP: Enhancing Audio-Visual Representation Learning with Object Information.Shota Nakada, Taichi Nishimura, Hokuto Munakata, Masayoshi Kondo, Tatsuya Komatsu
2025InterspeechLanguage-Guided Contrastive Audio-Visual Masked Autoencoder with Automatically Generated Audio-Visual-Text Triplets from Videos.Yuchi Ishikawa, Shota Nakada, Hokuto Munakata, Kazuhiro Saito, Tatsuya Komatsu, Yoshimitsu Aoki
2025InterspeechLeveraging Unlabeled Audio for Audio-Text Contrastive Learning via Audio-Composed Text Features.Tatsuya Komatsu, Hokuto Munakata, Yuchi Ishikawa
2024EMNLPLighthouse: A User-Friendly Library for Reproducible Video Moment Retrieval and Highlight Detection.Taichi Nishimura, Shota Nakada, Hokuto Munakata, Tatsuya Komatsu
2024ICASSPKeep Decoding Parallel With Effective Knowledge Distillation From Language Models To End-To-End Speech Recognisers.Michael Hentschel, Yuta Nishikawa, Tatsuya Komatsu, Yusuke Fujita
2024ICASSPAudio Difference Learning for Audio Captioning.Tatsuya Komatsu, Yusuke Fujita, Kazuya Takeda, Tomoki Toda
2024ICASSPPromptTTS++: Controlling Speaker Identity in Prompt-Based Text-To-Speech Using Natural Language Descriptions.Reo Shimizu, Ryuichi Yamamoto, Masaya Kawamura, Yuma Shirahata, Hironori Doi, Tatsuya Komatsu, Kentaro Tachibana
2024InterspeechAudio Fingerprinting with Holographic Reduced Representations.Yusuke Fujita, Tatsuya Komatsu
2024InterspeechUniversal Score-based Speech Enhancement with High Content Preservation.Robin Scheibler, Yusuke Fujita, Yuma Shirahata, Tatsuya Komatsu
2023ICASSPNeural Diarization with Non-Autoregressive Intermediate Attractors.Yusuke Fujita, Tatsuya Komatsu, Robin Scheibler, Yusuke Kida, Tetsuji Ogawa
2023InterspeechTarget Vocabulary Recognition Based on Multi-Task Learning with Decomposed Teacher Sequences.Aoi Ito, Tatsuya Komatsu, Yusuke Fujita, Yusuke Kida
2023IECONAnalysis of Biological Data of Cows and Development of Detection Systems for Calving Phase.Hiroto Noma, Tatsuya Komatsu, Kansei Matsumoto, Hidetoshi Oya, Ryotaro Miura, Koji Yoshioka, Yoshikatsu Hoshi
2022ICASSPNon-Autoregressive ASR with Self-Conditioned Folded Encoders.Tatsuya Komatsu
2022ICASSPSelf-Supervised Learning Method Using Multiple Sampling Strategies for General-Purpose Audio Representation.Ibuki Kuroyanagi, Tatsuya Komatsu
2022InterspeechBetter Intermediates Improve CTC Inference.Tatsuya Komatsu, Yusuke Fujita, Jaesong Lee, Lukas Lee, Shinji Watanabe, Yusuke Kida
2022InterspeechInterAug: Augmenting Noisy Intermediate Predictions for CTC-based ASR.Yu Nakagome, Tatsuya Komatsu, Yusuke Fujita, Shuta Ichimura, Yusuke Kida
2021ASRUA Comparative Study on Non-Autoregressive Modelings for Speech-to-Text Generation.Yosuke Higuchi, Nanxin Chen, Yuya Fujita, Hirofumi Inaguma, Tatsuya Komatsu, Jaesong Lee, Jumon Nozaki, Tianzi Wang, Shinji Watanabe
2021ICASSPDisentangled Speaker and Language Representations Using Mutual Information Minimization and Domain Adaptation for Cross-Lingual TTS.Detai Xin, Tatsuya Komatsu, Shinnosuke Takamichi, Hiroshi Saruwatari
2021InterspeechAcoustic Event Detection with Classifier Chains.Tatsuya Komatsu, Shinji Watanabe, Koichi Miyazaki, Tomoki Hayashi
2021InterspeechRelaxing the Conditional Independence Assumption of CTC-Based ASR by Conditioning on Intermediate Predictions.Jumon Nozaki, Tatsuya Komatsu
2020ICASSPScene-Dependent Acoustic Event Detection with Scene Conditioning and Fake-Scene-Conditioned Loss.Tatsuya Komatsu, Keisuke Imoto, Masahito Togami
2020ICASSPConsistency-Aware Multi-Channel Speech Enhancement Using Deep Neural Networks.Yoshiki Masuyama, Masahito Togami, Tatsuya Komatsu
2020ICASSPWeakly-Supervised Sound Event Detection with Self-Attention.Koichi Miyazaki, Tatsuya Komatsu, Tomoki Hayashi, Shinji Watanabe, Tomoki Toda, Kazuya Takeda
2020ICASSPUnsupervised Training for Deep Speech Source Separation with Kullback-Leibler Divergence Based Probabilistic Loss Function.Masahito Togami, Yoshiki Masuyama, Tatsuya Komatsu, Yu Nakagome
2019ICASSPScene-dependent Anomalous Acoustic-event Detection Based on Conditional Wavenet and I-vector.Tatsuya Komatsu, Tomoki Hayashi, Reishi Kondo, Tomoki Toda, Kazuya Takeda
2019ICASSPBayesian Non-parametric Multi-source Modelling Based Determined Blind Source Separation.Chaitanya Narisetty, Tatsuya Komatsu, Reishi Kondo
2019InterspeechMultichannel Loss Function for Supervised Speech Source Separation by Mask-Based Beamforming.Yoshiki Masuyama, Masahito Togami, Tatsuya Komatsu
2019InterspeechVariational Bayesian Multi-Channel Speech Dereverberation Under Noisy Environments with Probabilistic Convolutive Transfer Function.Masahito Togami, Tatsuya Komatsu
2017ICASSPDetection of anomaly acoustic scenes based on a temporal dissimilarity model.Tatsuya Komatsu, Reishi Kondo
2016ICASSPAcoustic event detection based on non-negative matrix factorization with mixtures of local dictionaries and activation aggregation.Tatsuya Komatsu, Yuzo Senda, Reishi Kondo
2013ICASSPModeling head-related transfer functions via spatial-temporal Gaussian process.Tatsuya Komatsu, Takanori Nishino, Gareth W. Peters, Tomoko Matsui, Kazuya Takeda
2013ICASSPComputationally efficient single channel dereverberation based on complementary wiener filter.Kazunobu Kondo, Yu Takahashi, Tatsuya Komatsu, Takanori Nishino, Kazuya Takeda