| 2026 | AAAI | Aligning Generative Music AI with Human Preferences: Methods and Challenges. | Dorien Herremans, Abhinaba Roy |
| 2026 | CHI | Scaffolded Vulnerability: Chatbot-Mediated Reciprocal Self-Disclosure and Need-Supportive Interaction in Couples. | Zhuoqun Jiang, ShunYi Yeo, Dorien Herremans, Simon Tangi Perrault |
| 2026 | ICPR | Towards Unified Music Emotion Recognition Across Dimensional and Categorical Models. | Jaeyong Kang, Dorien Herremans |
| 2025 | AAAI | Text2midi: Generating Symbolic Music from Captions. | Keshav Bhandari, Abhinaba Roy, Kyra Wang, Geeta Puri, Simon Colton, Dorien Herremans |
| 2025 | ICASSP | Coarse-to-Fine Text-to-Music Latent Diffusion. | Luca A. Lanzendrfer, Tongyu Lu, Nathanal Perraudin, Dorien Herremans, Roger Wattenhofer |
| 2025 | IJCNN | ImprovNet - Generating Controllable Musical Improvisations with Iterative Corruption Refinement. | Keshav Bhandari, Sungkyun Chang, Tongyu Lu, Fareza R. Enus, Louis Bradshaw, Dorien Herremans, Simon Colton |
| 2025 | IJCNN | JamendoMaxCaps: A Large Scale Music-caption Dataset with Imputed Metadata. | Abhinaba Roy, Renhang Liu, Tongyu Lu, Dorien Herremans |
| 2025 | IJCNN | End-to-End Text-to-SQL with Dataset Selection: Leveraging LLMs for Adaptive Query Generation. | Anurag Tripathi, Vaibhav Patle, Abhinav Jain, Ayush Pundir, Sairam Menon, Ajeet Kumar Singh, Dorien Herremans |
| 2024 | NAACL | Mustango: Toward Controllable Text-to-Music Generation. | Jan Melechovsk, Zixun Guo, Deepanway Ghosal, Navonil Majumder, Dorien Herremans, Soujanya Poria |
| 2024 | Tencon | SNIPER Training: Single-Shot Sparse Training for Text-to-Speech. | Perry Lam, Huayun Zhang, Nancy F. Chen, Berrak Sisman, Dorien Herremans |
| 2024 | Tencon | Accented Text-to-Speech Synthesis with a Conditional Variational Autoencoder. | Jan Melechovsk, Ambuj Mehrish, Berrak Sisman, Dorien Herremans |
| 2024 | Tencon | Accent Conversion in Text-to-Speech Using Multi-Level VAE and Adversarial Training. | Jan Melechovsk, Ambuj Mehrish, Berrak Sisman, Dorien Herremans |
| 2024 | Tencon | DisfluencySpeech - Single-Speaker Conversational Speech Dataset with Paralanguage. | Kyra Wang, Dorien Herremans |
| 2023 | AAAI | A Domain-Knowledge-Inspired Music Embedding Space and a Novel Attention Mechanism for Symbolic Music Modeling. | Zixun Guo, Jaeyong Kang, Dorien Herremans |
| 2023 | ICASSP | Diffroll: Diffusion-Based Generative Music Transcription with Unsupervised Pretraining Capability. | Kin Wai Cheuk, Ryosuke Sawata, Toshimitsu Uesaka, Naoki Murata, Naoya Takahashi, Shusuke Takahashi, Dorien Herremans, Yuki Mitsufuji |
| 2021 | IJCNN | Revisiting the Onsets and Frames Model with Additive Attention. | Kin Wai Cheuk, Yin-Jyun Luo, Emmanouil Benetos, Dorien Herremans |
| 2021 | IJCNN | Hierarchical Recurrent Neural Networks for Conditional Melody Generation with Long-term Structure. | Zixun Guo, Dimos Makris, Dorien Herremans |
| 2021 | IJCNN | Generating Lead Sheets with Affect: A Novel Conditional seq2seq Framework. | Dimos Makris, Kat R. Agres, Dorien Herremans |
| 2020 | ICASSP | Singing Voice Conversion with Disentangled Representations of Singer and Vocal Technique Using Variational Autoencoders. | Yin-Jyun Luo, Chin-Cheng Hsu, Kat Agres, Dorien Herremans |
| 2020 | ICPR | The Effect of Spectrogram Reconstruction on Automatic Music Transcription: An Alternative Approach to Improve Transcription Accuracy. | Kin Wai Cheuk, Yin-Jyun Luo, Emmanouil Benetos, Dorien Herremans |
| 2020 | IJCNN | The Impact of Audio Input Representations on Neural Network based Music Transcription. | Kin Wai Cheuk, Kat Agres, Dorien Herremans |
| 2020 | IJCNN | Regression-based Music Emotion Prediction using Triplet Neural Networks. | Kin Wai Cheuk, Yin-Jyun Luo, Balamurali B. T., Gemma Roig, Dorien Herremans |
| 2020 | ICPR | AttendAffectNet: Self-Attention based Networks for Predicting Affective Responses from Movies. | Ha Thi Phuong Thao, Balamurali B. T., Dorien Herremans, Gemma Roig |
| 2019 | ASRU | Latent Space Representation for Multi-Target Speaker Detection and Identification with a Sparse Dataset Using Triplet Neural Networks. | Kin Wai Cheuk, Balamurali B. T., Gemma Roig, Dorien Herremans |
| 2019 | CogSci | Towards emotion based music generation: A tonal tension model based on the spiral array. | Dorien Herremans, Elaine Chew |
| 2019 | CogSci | Untangling indices of emotion in music using neural networks. | Dorien Herremans, Kin Wai Cheuk, Yin-Jyun Luo, Kat Agres |
| 2019 | VTC | A Hybrid Fuzzy Logic-Neural Network Approach for Multi-Path Separation of Underwater Acoustic Signals. | Abigail Lee-Leon, Chau Yuen, Dorien Herremans |
| 2018 | AAAI | Modeling Temporal Tonal Relations in Polyphonic Music Through Deep Networks With a Novel Image-Based Representation. | Ching-Hua Chuan, Dorien Herremans |