Skip to content

Shusuke Takahashi

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

17

Venues

6

Active years

2021–2025

Best venue rank

A*

Where they publish

Papers

17 indexed papers, newest first.

YearVenueTitleAuthors
2025CVPRMoLA: Motion Generation and Editing with Latent Diffusion Enhanced by Adversarial Training.Kengo Uchida, Takashi Shibuya, Yuhta Takida, Naoki Murata, Julian Tanke, Shusuke Takahashi, Yuki Mitsufuji
2025ICCVTITAN-Guide: Taming Inference-Time Alignment for Guided Text-to-Video Diffusion Models.Christian Simon, Masato Ishii, Akio Hayakawa, Zhi Zhong, Shusuke Takahashi, Takashi Shibuya, Yuki Mitsufuji
2025ICLRMining your own secrets: Diffusion Classifier Scores for Continual Personalization of Text-to-Image Diffusion Models.Saurav Jha, Shiqi Yang, Masato Ishii, Mengjie Zhao, Christian Simon, Muhammad Jehanzeb Mirza, Dong Gong, Lina Yao, Shusuke Takahashi, Yuki Mitsufuji
2024ICASSPZero- and Few-Shot Sound Event Localization and Detection.Kazuki Shimada, Kengo Uchida, Yuichiro Koyama, Takashi Shibuya, Shusuke Takahashi, Yuki Mitsufuji, Tatsuya Kawahara
2024ICASSPDiffusion-Based Speech Enhancement with Joint Generative and Predictive Decoders.Hao Shi, Kazuki Shimada, Masato Hirano, Takashi Shibuya, Yuichiro Koyama, Zhi Zhong, Shusuke Takahashi, Tatsuya Kawahara, Yuki Mitsufuji
2023ICASSPDiffroll: Diffusion-Based Generative Music Transcription with Unsupervised Pretraining Capability.Kin Wai Cheuk, Ryosuke Sawata, Toshimitsu Uesaka, Naoki Murata, Naoya Takahashi, Shusuke Takahashi, Dorien Herremans, Yuki Mitsufuji
2023ICASSPAn Attention-Based Approach to Hierarchical Multi-Label Music Instrument Classification.Zhi Zhong, Masato Hirano, Kazuki Shimada, Kazuya Tateishi, Shusuke Takahashi, Yuki Mitsufuji
2023InterspeechDiffiner: A Versatile Diffusion-based Generative Refiner for Speech Enhancement.Ryosuke Sawata, Naoki Murata, Yuhta Takida, Toshimitsu Uesaka, Takashi Shibuya, Shusuke Takahashi, Yuki Mitsufuji
2022ICASSPMusic Source Separation With Deep Equilibrium Models.Yuichiro Koyama, Naoki Murata, Stefan Uhlich, Giorgio Fabbro, Shusuke Takahashi, Yuki Mitsufuji
2022ICASSPSpatial Data Augmentation with Simulated Room Impulse Responses for Sound Event Localization and Detection.Yuichiro Koyama, Kazuhide Shigemi, Masafumi Takahashi, Kazuki Shimada, Naoya Takahashi, Emiru Tsunoo, Shusuke Takahashi, Yuki Mitsufuji
2022ICASSPSpatial Mixup: Directional Loudness Modification as Data Augmentation for Sound Event Localization and Detection.Ricardo Falcn Prez, Kazuki Shimada, Yuichiro Koyama, Shusuke Takahashi, Yuki Mitsufuji
2022ICASSPImproving Character Error Rate is Not Equal to Having Clean Speech: Speech Enhancement for ASR Systems with Black-Box Acoustic Models.Ryosuke Sawata, Yosuke Kashiwagi, Shusuke Takahashi
2022ICASSPMulti-ACCDOA: Localizing And Detecting Overlapping Sounds From The Same Class With Auxiliary Duplicating Permutation Invariant Training.Kazuki Shimada, Yuichiro Koyama, Shusuke Takahashi, Naoya Takahashi, Emiru Tsunoo, Yuki Mitsufuji
2022ICMLSQ-VAE: Variational Bayes on Discrete Representation with Self-annealed Stochastic Quantization.Yuhta Takida, Takashi Shibuya, Wei-Hsiang Liao, Chieh-Hsin Lai, Junki Ohmura, Toshimitsu Uesaka, Naoki Murata, Shusuke Takahashi, Toshiyuki Kumakura, Yuki Mitsufuji
2021ICASSPAll For One And One For All: Improving Music Separation By Bridging Networks.Ryosuke Sawata, Stefan Uhlich, Shusuke Takahashi, Yuki Mitsufuji
2021ICASSPAccdoa: Activity-Coupled Cartesian Direction of Arrival Representation for Sound Event Localization And Detection.Kazuki Shimada, Yuichiro Koyama, Naoya Takahashi, Shusuke Takahashi, Yuki Mitsufuji
2021InterspeechManifold-Aware Deep Clustering: Maximizing Angles Between Embedding Vectors Based on Regular Simplex.Keitaro Tanaka, Ryosuke Sawata, Shusuke Takahashi