Skip to content

Oriol Nieto

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

20

Venues

10

Active years

2013–2026

Best venue rank

A*

Where they publish

Papers

20 indexed papers, newest first.

YearVenueTitleAuthors
2026CHISoundStager: Interactive Design of Story-Driven GenAI Soundscapes for Video.Suhyeon Yoo, Adolfo Hernandez Santisteban, Prem Seetharaman, Justin Salamon, Oriol Nieto, Anh Truong
2025CVPRVideo-Guided Foley Sound Generation with Multimodal Controls.Ziyang Chen, Prem Seetharaman, Bryan C. Russell, Oriol Nieto, David Bourgin, Andrew Owens, Justin Salamon
2025ICASSPSketch2Sound: Controllable Audio Generation via Time-Varying Signals and Sonic Imitations.Hugo Flores Garca, Oriol Nieto, Justin Salamon, Bryan Pardo, Prem Seetharaman
2025ICASSPReCLAP: Improving Zero Shot Audio Classification by Describing Sounds.Sreyan Ghosh, Sonal Kumar, Chandra Kiran Reddy Evuru, Oriol Nieto, Ramani Duraiswami, Dinesh Manocha
2025ICLRVisual Description Grounding Reduces Hallucinations and Boosts Reasoning in LVLMs.Sreyan Ghosh, Chandra Kiran Reddy Evuru, Sonal Kumar, Utkarsh Tyagi, Oriol Nieto, Zeyu Jin, Dinesh Manocha
2025ICLRMMAU: A Massive Multi-Task Audio Understanding and Reasoning Benchmark.S. Sakshi, Utkarsh Tyagi, Sonal Kumar, Ashish Seth, Ramaneswaran Selvakumar, Oriol Nieto, Ramani Duraiswami, Sreyan Ghosh, Dinesh Manocha
2025ICMLFLAM: Frame-Wise Language-Audio Modeling.Yusong Wu, Christos Tsirigotis, Ke Chen, Cheng-Zhi Anna Huang, Aaron C. Courville, Oriol Nieto, Prem Seetharaman, Justin Salamon
2024EMNLPGAMA: A Large Audio-Language Model with Advanced Audio Understanding and Complex Reasoning Abilities.Sreyan Ghosh, Sonal Kumar, Ashish Seth, Chandra Kiran Reddy Evuru, Utkarsh Tyagi, S. Sakshi, Oriol Nieto, Ramani Duraiswami, Dinesh Manocha
2024ICLRCompA: Addressing the Gap in Compositional Reasoning in Audio-Language Models.Sreyan Ghosh, Ashish Seth, Sonal Kumar, Utkarsh Tyagi, Chandra Kiran Reddy Evuru, Ramaneswaran S., Sakshi Singh, Oriol Nieto, Ramani Duraiswami, Dinesh Manocha
2023CVPRLanguage-Guided Audio-Visual Source Separation via Trimodal Consistency.Reuben Tan, Arijit Ray, Andrea Burns, Bryan A. Plummer, Justin Salamon, Oriol Nieto, Bryan C. Russell, Kate Saenko
2023ICASSPAudio-Text Models Do Not Yet Leverage Natural Language.Ho-Hsiang Wu, Oriol Nieto, Juan Pablo Bello, Justin Salamon
2023InterspeechEfficient Spoken Language Recognition via Multilabel Classification.Oriol Nieto, Zeyu Jin, Franck Dernoncourt, Justin Salamon
2022ICASSPMusic Enhancement via Image Translation and Vocoding.Nikhil Kandpal, Oriol Nieto, Zeyu Jin
2021ICASSPMultimodal Metric Learning for Tag-Based Music Retrieval.Minz Won, Sergio Oramas, Oriol Nieto, Fabien Gouyon, Xavier Serra
2020ICASSPData-Driven Harmonic Filters for Audio Representation Learning.Minz Won, Sanghyuk Chun, Oriol Nieto, Xavier Serra
2018WSDMPredicting Audio Advertisement Quality.Samaneh Ebrahimi, Hossein Vahabi, Matthew Prockup, Oriol Nieto
2017RecSysA Deep Multimodal Approach for Cold-start Music Recommendation.Sergio Oramas, Oriol Nieto, Mohamed Sordo, Xavier Serra
2014CogSciEmbodying Theoretical Research in Music Cognition: Four Proposals for Theory-Driven Experimentation.Andreu Ballus, Eric Arnau, Oriol Nieto, Frederic Font, Alba Torrents
2014ICASSPMusic segment similarity using 2D-Fourier Magnitude Coefficients.Oriol Nieto, Juan Pablo Bello
2013ICASSPConvex non-negative matrix factorization for automatic music structure identification.Oriol Nieto, Tristan Jehan