Oriol Nieto
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
20
Venues
10
Active years
2013–2026
Best venue rank
A*
Where they publish
Papers
20 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | CHI | SoundStager: Interactive Design of Story-Driven GenAI Soundscapes for Video. | Suhyeon Yoo, Adolfo Hernandez Santisteban, Prem Seetharaman, Justin Salamon, Oriol Nieto, Anh Truong |
| 2025 | CVPR | Video-Guided Foley Sound Generation with Multimodal Controls. | Ziyang Chen, Prem Seetharaman, Bryan C. Russell, Oriol Nieto, David Bourgin, Andrew Owens, Justin Salamon |
| 2025 | ICASSP | Sketch2Sound: Controllable Audio Generation via Time-Varying Signals and Sonic Imitations. | Hugo Flores Garca, Oriol Nieto, Justin Salamon, Bryan Pardo, Prem Seetharaman |
| 2025 | ICASSP | ReCLAP: Improving Zero Shot Audio Classification by Describing Sounds. | Sreyan Ghosh, Sonal Kumar, Chandra Kiran Reddy Evuru, Oriol Nieto, Ramani Duraiswami, Dinesh Manocha |
| 2025 | ICLR | Visual Description Grounding Reduces Hallucinations and Boosts Reasoning in LVLMs. | Sreyan Ghosh, Chandra Kiran Reddy Evuru, Sonal Kumar, Utkarsh Tyagi, Oriol Nieto, Zeyu Jin, Dinesh Manocha |
| 2025 | ICLR | MMAU: A Massive Multi-Task Audio Understanding and Reasoning Benchmark. | S. Sakshi, Utkarsh Tyagi, Sonal Kumar, Ashish Seth, Ramaneswaran Selvakumar, Oriol Nieto, Ramani Duraiswami, Sreyan Ghosh, Dinesh Manocha |
| 2025 | ICML | FLAM: Frame-Wise Language-Audio Modeling. | Yusong Wu, Christos Tsirigotis, Ke Chen, Cheng-Zhi Anna Huang, Aaron C. Courville, Oriol Nieto, Prem Seetharaman, Justin Salamon |
| 2024 | EMNLP | GAMA: A Large Audio-Language Model with Advanced Audio Understanding and Complex Reasoning Abilities. | Sreyan Ghosh, Sonal Kumar, Ashish Seth, Chandra Kiran Reddy Evuru, Utkarsh Tyagi, S. Sakshi, Oriol Nieto, Ramani Duraiswami, Dinesh Manocha |
| 2024 | ICLR | CompA: Addressing the Gap in Compositional Reasoning in Audio-Language Models. | Sreyan Ghosh, Ashish Seth, Sonal Kumar, Utkarsh Tyagi, Chandra Kiran Reddy Evuru, Ramaneswaran S., Sakshi Singh, Oriol Nieto, Ramani Duraiswami, Dinesh Manocha |
| 2023 | CVPR | Language-Guided Audio-Visual Source Separation via Trimodal Consistency. | Reuben Tan, Arijit Ray, Andrea Burns, Bryan A. Plummer, Justin Salamon, Oriol Nieto, Bryan C. Russell, Kate Saenko |
| 2023 | ICASSP | Audio-Text Models Do Not Yet Leverage Natural Language. | Ho-Hsiang Wu, Oriol Nieto, Juan Pablo Bello, Justin Salamon |
| 2023 | Interspeech | Efficient Spoken Language Recognition via Multilabel Classification. | Oriol Nieto, Zeyu Jin, Franck Dernoncourt, Justin Salamon |
| 2022 | ICASSP | Music Enhancement via Image Translation and Vocoding. | Nikhil Kandpal, Oriol Nieto, Zeyu Jin |
| 2021 | ICASSP | Multimodal Metric Learning for Tag-Based Music Retrieval. | Minz Won, Sergio Oramas, Oriol Nieto, Fabien Gouyon, Xavier Serra |
| 2020 | ICASSP | Data-Driven Harmonic Filters for Audio Representation Learning. | Minz Won, Sanghyuk Chun, Oriol Nieto, Xavier Serra |
| 2018 | WSDM | Predicting Audio Advertisement Quality. | Samaneh Ebrahimi, Hossein Vahabi, Matthew Prockup, Oriol Nieto |
| 2017 | RecSys | A Deep Multimodal Approach for Cold-start Music Recommendation. | Sergio Oramas, Oriol Nieto, Mohamed Sordo, Xavier Serra |
| 2014 | CogSci | Embodying Theoretical Research in Music Cognition: Four Proposals for Theory-Driven Experimentation. | Andreu Ballus, Eric Arnau, Oriol Nieto, Frederic Font, Alba Torrents |
| 2014 | ICASSP | Music segment similarity using 2D-Fourier Magnitude Coefficients. | Oriol Nieto, Juan Pablo Bello |
| 2013 | ICASSP | Convex non-negative matrix factorization for automatic music structure identification. | Oriol Nieto, Tristan Jehan |