| 2024 | Interspeech | SilentCipher: Deep Audio Watermarking. | Mayank Kumar Singh, Naoya Takahashi, Wei-Hsiang Liao, Yuki Mitsufuji |
| 2023 | ICASSP | Diffroll: Diffusion-Based Generative Music Transcription with Unsupervised Pretraining Capability. | Kin Wai Cheuk, Ryosuke Sawata, Toshimitsu Uesaka, Naoki Murata, Naoya Takahashi, Shusuke Takahashi, Dorien Herremans, Yuki Mitsufuji |
| 2023 | ICASSP | Nonparallel Emotional Voice Conversion for Unseen Speaker-Emotion Pairs Using Dual Domain Adversarial Network & Virtual Domain Pairing. | Nirmesh Shah, Mayank Kumar Singh, Naoya Takahashi, Naoyuki Onoe |
| 2023 | ICASSP | Hierarchical Diffusion Models for Singing Voice Neural Vocoder. | Naoya Takahashi, Mayank Kumar Singh, Yuki Mitsufuji |
| 2023 | ICCS | Numerical Simulation of the Octorotor Flying Car in Sudden Rotor Stop. | Naoya Takahashi, Ritsuka Gomi, Ayato Takii, Masashi Yamakawa, Shinichi Asao, Seiichi Takeuchi |
| 2023 | ICLR | CLIPSep: Learning Text-queried Sound Separation with Noisy Unlabeled Videos. | Hao-Wen Dong, Naoya Takahashi, Yuki Mitsufuji, Julian J. McAuley, Taylor Berg-Kirkpatrick |
| 2023 | Interspeech | Iteratively Improving Speech Recognition and Voice Conversion. | Mayank Kumar Singh, Naoya Takahashi, Naoyuki Onoe |
| 2022 | ICASSP | Spatial Data Augmentation with Simulated Room Impulse Responses for Sound Event Localization and Detection. | Yuichiro Koyama, Kazuhide Shigemi, Masafumi Takahashi, Kazuki Shimada, Naoya Takahashi, Emiru Tsunoo, Shusuke Takahashi, Yuki Mitsufuji |
| 2022 | ICASSP | Multi-ACCDOA: Localizing And Detecting Overlapping Sounds From The Same Class With Auxiliary Duplicating Permutation Invariant Training. | Kazuki Shimada, Yuichiro Koyama, Shusuke Takahashi, Naoya Takahashi, Emiru Tsunoo, Yuki Mitsufuji |
| 2022 | ICASSP | Amicable Examples for Informed Source Separation. | Naoya Takahashi, Yuki Mitsufuji |
| 2022 | ICASSP | Amicable Examples for Informed Source Separation. | Naoya Takahashi, Yuki Mitsufuji |
| 2022 | Interspeech | Leveraging Symmetrical Convolutional Transformer Networks for Speech to Singing Voice Style Transfer. | Shrutina Agarwal, Naoya Takahashi, Sriram Ganapathy |
| 2021 | CVPR | Densely Connected Multi-Dilated Convolutional Networks for Dense Prediction Tasks. | Naoya Takahashi, Yuki Mitsufuji |
| 2021 | ICASSP | End-to-End Lyrics Recognition with Voice to Singing Style Transfer. | Sakya Basak, Shrutina Agarwal, Sriram Ganapathy, Naoya Takahashi |
| 2021 | ICASSP | Accdoa: Activity-Coupled Cartesian Direction of Arrival Representation for Sound Event Localization And Detection. | Kazuki Shimada, Yuichiro Koyama, Naoya Takahashi, Shusuke Takahashi, Yuki Mitsufuji |
| 2021 | ICASSP | Adversarial Attacks on Audio Source Separation. | Naoya Takahashi, Shota Inoue, Yuki Mitsufuji |
| 2021 | IJCNN | Hierarchical disentangled representation learning for singing voice conversion. | Naoya Takahashi, Mayank Kumar Singh, Yuki Mitsufuji |
| 2020 | ICASSP | Improving Voice Separation by Incorporating End-To-End Speech Recognition. | Naoya Takahashi, Mayank Kumar Singh, Sakya Basak, Sudarsanam Parthasaarathy, Sriram Ganapathy, Yuki Mitsufuji |
| 2019 | COMPSAC | A Teaching Assistant Robot Design Tool Based on Knowledge Chunks Reuse. | Takeshi Morita, Naoya Takahashi, Mizuki Kosuda, Takahira Yamaguchi |
| 2019 | IC3K | A Knowledge Chunk Reuse Support Tool based on Heterogeneous Ontologies. | Takeshi Morita, Naoya Takahashi, Mizuki Kosuda, Takahira Yamaguchi |
| 2019 | Interspeech | Recursive Speech Separation for Unknown Number of Speakers. | Naoya Takahashi, Sudarsanam Parthasaarathy, Nabarun Goswami, Yuki Mitsufuji |
| 2018 | Interspeech | PhaseNet: Discretized Phase Modeling with Deep Neural Networks for Audio Source Separation. | Naoya Takahashi, Purvi Agrawal, Nabarun Goswami, Yuki Mitsufuji |
| 2017 | ICASSP | Improving music source separation based on deep neural networks through data augmentation and network blending. | Stefan Uhlich, Marcello Porcu, Franck Giron, Michael Enenkl, Thomas Kemp, Naoya Takahashi, Yuki Mitsufuji |
| 2017 | KES | Implementation of Teacher-Robot Collaboration Lesson Application in PRINTEPS. | Shunsuke Akashiba, Chihiro Nishimoto, Naoya Takahashi, Takeshi Morita, Reiji Kukihara, Misae Kuwayama, Takahira Yamaguchi |
| 2016 | Interspeech | Deep Convolutional Neural Networks and Data Augmentation for Acoustic Event Recognition. | Naoya Takahashi, Michael Gygli, Beat Pfister, Luc Van Gool |
| 2016 | Interspeech | Automatic Pronunciation Generation by Utilizing a Semi-Supervised Deep Neural Networks. | Naoya Takahashi, Tofigh Naghibi, Beat Pfister |