Skip to content

Yuki Mitsufuji

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

82

Venues

13

Active years

2013–2026

Best venue rank

A*

Where they publish

Papers

82 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAISteerMusic: Enhanced Musical Consistency for Zero-shot Text-Guided and Personalized Music Editing.Xinlei Niu, Kin Wai Cheuk, Jing Zhang, Naoki Murata, Chieh-Hsin Lai, Michele Mancusi, Woosung Choi, Giorgio Fabbro, Wei-Hsiang Liao, Charles Patrick Martin, Yuki Mitsufuji
2026AAAIVideo Camera Trajectory Editing with Generative Rendering from Estimated Geometry.Junyoung Seo, Jisang Han, Jaewoo Jung, Siyoon Jin, Joungbin Lee, Takuya Narihira, Kazumi Fukuda, Takashi Shibuya, Donghoon Ahn, Shoukang Hu, Seungryong Kim, Yuki Mitsufuji
2026CHIEmergent, not Immanent: A Baradian Reading of Explainable AI.Fabio Morreale, Joan Serr, Yuki Mitsufuji
2025CVPRClassifier-Free Guidance Inside the Attraction Basin May Cause Memorization.Anubhav Jain, Yuya Kobayashi, Takashi Shibuya, Yuhta Takida, Nasir D. Memon, Julian Togelius, Yuki Mitsufuji
2025CVPRMMAudio: Taming Multimodal Joint Training for High-Quality Video-to-Audio Synthesis.Ho Kei Cheng, Masato Ishii, Akio Hayakawa, Takashi Shibuya, Alexander G. Schwing, Yuki Mitsufuji
2025CVPRVinaBench: Benchmark for Faithful and Consistent Visual Narratives.Silin Gao, Sheryl Mathew, Li Mi, Sepideh Mamooler, Mengjie Zhao, Hiromi Wakaki, Yuki Mitsufuji, Syrielle Montariol, Antoine Bosselut
2025CVPRDyadic Mamba: Long-term Dyadic Human Motion Synthesis.Julian Tanke, Takashi Shibuya, Kengo Uchida, Koichi Saito, Yuki Mitsufuji
2025CVPRMoLA: Motion Generation and Editing with Latent Diffusion Enhanced by Adversarial Training.Kengo Uchida, Takashi Shibuya, Yuhta Takida, Naoki Murata, Julian Tanke, Shusuke Takahashi, Yuki Mitsufuji
2025EMNLPCARE: Multilingual Human Preference Learning for Cultural Awareness.Geyang Guo, Tarek Naous, Hiromi Wakaki, Yukiko Nishimura, Yuki Mitsufuji, Alan Ritter, Wei Xu
2025EMNLPDeepResonance: Enhancing Multimodal Music Understanding via Music-centric Multi-way Instruction Tuning.Zhuoyuan Mao, Mengjie Zhao, Qiyu Wu, Hiromi Wakaki, Yuki Mitsufuji
2025ICASSP30+ Years of Source Separation Research: Achievements and Future Challenges.Shoko Araki, Nobutaka Ito, Reinhold Haeb-Umbach, Gordon Wichern, Zhong-Qiu Wang, Yuki Mitsufuji
2025ICASSPVariable Bitrate Residual Vector Quantization for Audio Coding.Yunkee Chae, Woosung Choi, Yuhta Takida, Junghyun Koo, Yukara Ikemiya, Zhi Zhong, Kin Wai Cheuk, Marco A. Martnez Ramrez, Kyogu Lee, Wei-Hsiang Liao, Yuki Mitsufuji
2025ICASSPLatent Diffusion Bridges for Unsupervised Musical Audio Timbre Transfer.Michele Mancusi, Yurii Halychanskyi, Kin Wai Cheuk, Eloi Moliner, Chieh-Hsin Lai, Stefan Uhlich, Junghyun Koo, Marco A. Martnez Ramrez, Wei-Hsiang Liao, Giorgio Fabbro, Yuki Mitsufuji
2025ICASSPTwenty-Five Years of MIR Research: Achievements, Practices, Evaluations, and Future Challenges.Geoffroy Peeters, Zafar Rafii, Magdalena Fuentes, Zhiyao Duan, Emmanouil Benetos, Juhan Nam, Yuki Mitsufuji
2025ICCVTITAN-Guide: Taming Inference-Time Alignment for Guided Text-to-Video Diffusion Models.Christian Simon, Masato Ishii, Akio Hayakawa, Zhi Zhong, Shusuke Takahashi, Takashi Shibuya, Yuki Mitsufuji
2025ICCVTransformed Low-rank Adaptation via Tensor Decomposition and Its Applications to Text-to-image Models.Zerui Tao, Yuhta Takida, Naoki Murata, Qibin Zhao, Yuki Mitsufuji
2025ICCVTowards Reporting Bias in Visual-Language Datasets: Bi-Modal Data Augmentation by Decoupling Object-Attribute Association.Qiyu Wu, Mengjie Zhao, Yutong He, Lang Huang, Junya Ono, Hiromi Wakaki, Yuki Mitsufuji
2025ICLRMMDisCo: Multi-Modal Discriminator-Guided Cooperative Diffusion for Joint Audio and Video Generation.Akio Hayakawa, Masato Ishii, Takashi Shibuya, Yuki Mitsufuji
2025ICLRHERO: Human-Feedback Efficient Reinforcement Learning for Online Diffusion Model Finetuning.Ayano Hiranaka, Shang-Fu Chen, Chieh-Hsin Lai, Dongjun Kim, Naoki Murata, Takashi Shibuya, Wei-Hsiang Liao, Shao-Hua Sun, Yuki Mitsufuji
2025ICLRMining your own secrets: Diffusion Classifier Scores for Continual Personalization of Text-to-Image Diffusion Models.Saurav Jha, Shiqi Yang, Masato Ishii, Mengjie Zhao, Christian Simon, Muhammad Jehanzeb Mirza, Dong Gong, Lina Yao, Shusuke Takahashi, Yuki Mitsufuji
2025ICLRJump Your Steps: Optimizing Sampling Schedule of Discrete Diffusion Models.Yong-Hyun Park, Chieh-Hsin Lai, Satoshi Hayakawa, Yuhta Takida, Yuki Mitsufuji
2025ICLRSoundCTM: Unifying Score-based and Consistency Models for Full-band Text-to-Sound Generation.Koichi Saito, Dongjun Kim, Takashi Shibuya, Chieh-Hsin Lai, Zhi Zhong, Yuhta Takida, Yuki Mitsufuji
2025ICLRWeighted Point Set Embedding for Multimodal Contrastive Learning Toward Optimal Similarity Metric.Toshimitsu Uesaka, Taiji Suzuki, Yuhta Takida, Chieh-Hsin Lai, Naoki Murata, Yuki Mitsufuji
2025ICMLDistillation of Discrete Diffusion through Dimensional Correlations.Satoshi Hayakawa, Yuhta Takida, Masaaki Imaizumi, Hiromi Wakaki, Yuki Mitsufuji
2025ICMLSupervised Contrastive Learning from Weakly-Labeled Audio Segments for Musical Version Matching.Joan Serr, Recep Oguz Araz, Dmitry Bogdanov, Yuki Mitsufuji
2025ICMLVCT: Training Consistency Models with Variational Noise Coupling.Gianluigi Silvestri, Luca Ambrogioni, Chieh-Hsin Lai, Yuhta Takida, Yuki Mitsufuji
2025IJCNNA Simple but Strong Baseline for Sounding Video Generation: Effective Adaptation of Audio and Video Diffusion Models for Joint Generation.Masato Ishii, Akio Hayakawa, Takashi Shibuya, Yuki Mitsufuji
2025IJCNNEfficiency without Compromise: CLIP-aided Text-to-Image GANs with Increased Diversity.Yuya Kobayashi, Yuhta Takida, Takashi Shibuya, Yuki Mitsufuji
2025IJCNNStereoSync: Spatially-Aware Stereo Audio Generation from Video.Christian Marinoni, Riccardo F. Gramaccioni, Kazuki Shimada, Takashi Shibuya, Yuki Mitsufuji, Danilo Comminiello
2025IJCNNImproving Vector-Quantized Image Modeling with Latent Consistency-Matching Diffusion.Bac Nguyen, Chieh-Hsin Lai, Yuhta Takida, Naoki Murata, Toshimitsu Uesaka, Stefano Ermon, Yuki Mitsufuji
2025InterspeechA Comprehensive Real-World Assessment of Audio Watermarking Algorithms: Will They Survive Neural Codecs?Yigitcan zer, Woosung Choi, Joan Serr, Mayank Kumar Singh, Wei-Hsiang Liao, Yuki Mitsufuji
2024ACLDiffuCOMET: Contextual Commonsense Knowledge Diffusion.Silin Gao, Mete Ismayilzada, Mengjie Zhao, Hiromi Wakaki, Yuki Mitsufuji, Antoine Bosselut
2024ACLOn the Language Encoder of Contrastive Cross-modal Models.Mengjie Zhao, Junya Ono, Zhi Zhong, Chieh-Hsin Lai, Yuhta Takida, Naoki Murata, Wei-Hsiang Liao, Takashi Shibuya, Hiromi Wakaki, Yuki Mitsufuji
2024ICASSPBIGVSAN: Enhancing Gan-Based Neural Vocoders with Slicing Adversarial Network.Takashi Shibuya, Yuhta Takida, Yuki Mitsufuji
2024ICASSPTimbre-Trap: A Low-Resource Framework for Instrument-Agnostic Music Transcription.Frank Cwitkowitz, Kin Wai Cheuk, Woosung Choi, Marco A. Martnez Ramrez, Keisuke Toyama, Wei-Hsiang Liao, Yuki Mitsufuji
2024ICASSPEnhancing Semantic Communication with Deep Generative Models: An Overview.Eleonora Grassucci, Yuki Mitsufuji, Ping Zhang, Danilo Comminiello
2024ICASSPVRDMG: Vocal Restoration via Diffusion Posterior Sampling with Multiple Guidance.Carlos Hernandez-Olivan, Koichi Saito, Naoki Murata, Chieh-Hsin Lai, Marco A. Martnez Ramrez, Wei-Hsiang Liao, Yuki Mitsufuji
2024ICASSPZero- and Few-Shot Sound Event Localization and Detection.Kazuki Shimada, Kengo Uchida, Yuichiro Koyama, Takashi Shibuya, Shusuke Takahashi, Yuki Mitsufuji, Tatsuya Kawahara
2024ICASSPDiffusion-Based Speech Enhancement with Joint Generative and Predictive Decoders.Hao Shi, Kazuki Shimada, Masato Hirano, Takashi Shibuya, Yuichiro Koyama, Zhi Zhong, Shusuke Takahashi, Tatsuya Kawahara, Yuki Mitsufuji
2024ICLRManifold Preserving Guided Diffusion.Yutong He, Naoki Murata, Chieh-Hsin Lai, Yuhta Takida, Toshimitsu Uesaka, Dongjun Kim, Wei-Hsiang Liao, Yuki Mitsufuji, J. Zico Kolter, Ruslan Salakhutdinov, Stefano Ermon
2024ICLRConsistency Trajectory Models: Learning Probability Flow ODE Trajectory of Diffusion.Dongjun Kim, Chieh-Hsin Lai, Wei-Hsiang Liao, Naoki Murata, Yuhta Takida, Toshimitsu Uesaka, Yutong He, Yuki Mitsufuji, Stefano Ermon
2024ICLRSAN: Inducing Metrizability of GAN with Discriminative Normalized Linear Layer.Yuhta Takida, Masaaki Imaizumi, Takashi Shibuya, Chieh-Hsin Lai, Toshimitsu Uesaka, Naoki Murata, Yuki Mitsufuji
2024IJCAIMusicMagus: Zero-Shot Text-to-Music Editing via Diffusion Models.Yixiao Zhang, Yukara Ikemiya, Gus Xia, Naoki Murata, Marco A. Martnez Ramrez, Wei-Hsiang Liao, Yuki Mitsufuji, Simon Dixon
2024InterspeechSilentCipher: Deep Audio Watermarking.Mayank Kumar Singh, Naoya Takahashi, Wei-Hsiang Liao, Yuki Mitsufuji
2023ACLPeaCoK: Persona Commonsense Knowledge for Consistent and Engaging Narratives.Silin Gao, Beatriz Borges, Soyoung Oh, Deniz Bayazit, Saya Kanno, Hiromi Wakaki, Yuki Mitsufuji, Antoine Bosselut
2023ICASSPDiffroll: Diffusion-Based Generative Music Transcription with Unsupervised Pretraining Capability.Kin Wai Cheuk, Ryosuke Sawata, Toshimitsu Uesaka, Naoki Murata, Naoya Takahashi, Shusuke Takahashi, Dorien Herremans, Yuki Mitsufuji
2023ICASSPMusic Mixing Style Transfer: A Contrastive Learning Approach to Disentangle Audio Effects.Junghyun Koo, Marco A. Martnez Ramrez, Wei-Hsiang Liao, Stefan Uhlich, Kyogu Lee, Yuki Mitsufuji
2023ICASSPUnsupervised Vocal Dereverberation with Diffusion-Based Generative Models.Koichi Saito, Naoki Murata, Toshimitsu Uesaka, Chieh-Hsin Lai, Yuhta Takida, Takao Fukui, Yuki Mitsufuji
2023ICASSPHierarchical Diffusion Models for Singing Voice Neural Vocoder.Naoya Takahashi, Mayank Kumar Singh, Yuki Mitsufuji
2023ICASSPAn Attention-Based Approach to Hierarchical Multi-Label Music Instrument Classification.Zhi Zhong, Masato Hirano, Kazuki Shimada, Kazuya Tateishi, Shusuke Takahashi, Yuki Mitsufuji
2023ICLRCLIPSep: Learning Text-queried Sound Separation with Noisy Unlabeled Videos.Hao-Wen Dong, Naoya Takahashi, Yuki Mitsufuji, Julian J. McAuley, Taylor Berg-Kirkpatrick
2023ICMLFP-Diffusion: Improving Score-based Diffusion Models by Enforcing the Underlying Score Fokker-Planck Equation.Chieh-Hsin Lai, Yuhta Takida, Naoki Murata, Toshimitsu Uesaka, Yuki Mitsufuji, Stefano Ermon
2023ICMLGibbsDDRM: A Partially Collapsed Gibbs Sampler for Solving Blind Inverse Problems with Denoising Diffusion Restoration.Naoki Murata, Koichi Saito, Chieh-Hsin Lai, Yuhta Takida, Toshimitsu Uesaka, Yuki Mitsufuji, Stefano Ermon
2023InterspeechDiffiner: A Versatile Diffusion-based Generative Refiner for Speech Enhancement.Ryosuke Sawata, Naoki Murata, Yuhta Takida, Toshimitsu Uesaka, Takashi Shibuya, Shusuke Takahashi, Yuki Mitsufuji
2022EMNLPComFact: A Benchmark for Linking Contextual Commonsense Knowledge.Silin Gao, Jena D. Hwang, Saya Kanno, Hiromi Wakaki, Yuki Mitsufuji, Antoine Bosselut
2022ICASSPAutomatic DJ Transitions with Differentiable Audio Effects and Generative Adversarial Networks.Bo-Yu Chen, Wei-Han Hsu, Wei-Hsiang Liao, Marco A. Martnez Ramrez, Yuki Mitsufuji, Yi-Hsuan Yang
2022ICASSPMusic Source Separation With Deep Equilibrium Models.Yuichiro Koyama, Naoki Murata, Stefan Uhlich, Giorgio Fabbro, Shusuke Takahashi, Yuki Mitsufuji
2022ICASSPSpatial Data Augmentation with Simulated Room Impulse Responses for Sound Event Localization and Detection.Yuichiro Koyama, Kazuhide Shigemi, Masafumi Takahashi, Kazuki Shimada, Naoya Takahashi, Emiru Tsunoo, Shusuke Takahashi, Yuki Mitsufuji
2022ICASSPSpatial Mixup: Directional Loudness Modification as Data Augmentation for Sound Event Localization and Detection.Ricardo Falcn Prez, Kazuki Shimada, Yuichiro Koyama, Shusuke Takahashi, Yuki Mitsufuji
2022ICASSPMulti-ACCDOA: Localizing And Detecting Overlapping Sounds From The Same Class With Auxiliary Duplicating Permutation Invariant Training.Kazuki Shimada, Yuichiro Koyama, Shusuke Takahashi, Naoya Takahashi, Emiru Tsunoo, Yuki Mitsufuji
2022ICASSPAmicable Examples for Informed Source Separation.Naoya Takahashi, Yuki Mitsufuji
2022ICASSPAmicable Examples for Informed Source Separation.Naoya Takahashi, Yuki Mitsufuji
2022ICMLSQ-VAE: Variational Bayes on Discrete Representation with Self-annealed Stochastic Quantization.Yuhta Takida, Takashi Shibuya, Wei-Hsiang Liao, Chieh-Hsin Lai, Junki Ohmura, Toshimitsu Uesaka, Naoki Murata, Shusuke Takahashi, Toshiyuki Kumakura, Yuki Mitsufuji
2021ACIIPsychophysiological Effect of Immersive Spatial Audio Experience Enhanced Using Sound Field Synthesis.Yasuhide Hyodo, Chihiro Sugai, Junya Suzuki, Masafumi Takahashi, Masahiko Koizumi, Asako Tomura, Yuki Mitsufuji, Yota Komoriya
2021CVPRDensely Connected Multi-Dilated Convolutional Networks for Dense Prediction Tasks.Naoya Takahashi, Yuki Mitsufuji
2021ICASSPAll For One And One For All: Improving Music Separation By Bridging Networks.Ryosuke Sawata, Stefan Uhlich, Shusuke Takahashi, Yuki Mitsufuji
2021ICASSPAccdoa: Activity-Coupled Cartesian Direction of Arrival Representation for Sound Event Localization And Detection.Kazuki Shimada, Yuichiro Koyama, Naoya Takahashi, Shusuke Takahashi, Yuki Mitsufuji
2021ICASSPAdversarial Attacks on Audio Source Separation.Naoya Takahashi, Shota Inoue, Yuki Mitsufuji
2021IJCNNHierarchical disentangled representation learning for singing voice conversion.Naoya Takahashi, Mayank Kumar Singh, Yuki Mitsufuji
2020ICASSPArray-Geometry-Aware Spatial Active Noise Control Based on Direction-of-Arrival Weighting.Yu Maeno, Yuhta Takida, Naoki Murata, Yuki Mitsufuji
2020ICASSPImproving Voice Separation by Incorporating End-To-End Speech Recognition.Naoya Takahashi, Mayank Kumar Singh, Sakya Basak, Sudarsanam Parthasaarathy, Sriram Ganapathy, Yuki Mitsufuji
2019ICASSPGlobal and Local Mode-domain Adaptive Algorithms for Spatial Active Noise Control Using Higher-order Sources.Naoki Murata, Jihui Zhang, Yu Maeno, Yuki Mitsufuji
2019InterspeechRecursive Speech Separation for Unknown Number of Speakers.Naoya Takahashi, Sudarsanam Parthasaarathy, Nabarun Goswami, Yuki Mitsufuji
2018ICASSPMode Domain Spatial Active Noise Control Using Sparse Signal Representation.Yu Maeno, Yuki Mitsufuji, Thushara D. Abhayapala
2018InterspeechPhaseNet: Discretized Phase Modeling with Deep Neural Networks for Audio Source Separation.Naoya Takahashi, Purvi Agrawal, Nabarun Goswami, Yuki Mitsufuji
2017ICASSPSupervised monaural source separation based on autoencoders.Keiichi Osako, Yuki Mitsufuji, Rita Singh, Bhiksha Raj
2017ICASSPImproving music source separation based on deep neural networks through data augmentation and network blending.Stefan Uhlich, Marcello Porcu, Franck Giron, Michael Enenkl, Thomas Kemp, Naoya Takahashi, Yuki Mitsufuji
2016ICASSPMultichannel blind source separation based on non-negative tensor factorization in wavenumber domain.Yuki Mitsufuji, Shoichi Koyama, Hiroshi Saruwatari
2015ICASSPNMF-based blind source separation using a linear predictive coding error clustering criterion.Xin Guo, Stefan Uhlich, Yuki Mitsufuji
2015ICASSPDeep neural network based instrument extraction from music.Stefan Uhlich, Franck Giron, Yuki Mitsufuji
2014ICASSPOnline NON-negative Tensor Deconvolution for source detection in 3DTV audio.Yuki Mitsufuji, Marco Liuni, Alex Baker, Axel Roebel
2013ICASSPSound source separation based on non-negative tensor factorization incorporating spatial cue as prior knowledge.Yuki Mitsufuji, Axel Roebel