| 2025 | ICASSP | Mind the Prompt: Prompting Strategies in Audio Generations for Improving Sound Classification. | Francesca Ronchini, Ho-Hsiang Wu, Wei-Cheng Lin, Fabio Antonacci |
| 2025 | Interspeech | Towards Few-Shot Training-Free Anomaly Sound Detection. | Ho-Hsiang Wu, Wei-Cheng Lin, Abinaya Kumar, Luca Bondi, Shabnam Ghaffarzadegan, Juan Pablo Bello |
| 2024 | ICASSP | Multi-Modal Continual Pre-Training For Audio Encoders. | Gyuhak Kim, Ho-Hsiang Wu, Luca Bondi, Bing Liu |
| 2024 | ICASSP | CLAP4Emo: ChatGPT-Assisted Speech Emotion Retrieval with Natural Language Supervision. | Wei-Cheng Lin, Shabnam Ghaffarzadegan, Luca Bondi, Abinaya Kumar, Samarjit Das, Ho-Hsiang Wu |
| 2024 | ICASSP | Learning Audio Concepts from Counterfactual Natural Language. | Ali Vosoughi, Luca Bondi, Ho-Hsiang Wu, Chenliang Xu |
| 2024 | Interspeech | Sound of Traffic: A Dataset for Acoustic Traffic Identification and Counting. | Shabnam Ghaffarzadegan, Luca Bondi, Wei-Cheng Lin, Abinaya Kumar, Ho-Hsiang Wu, Hans-Georg Horst, Samarjit Das |
| 2024 | ICRA | MOSAIC: Learning Unified Multi-Sensory Object Property Representations for Robot Learning via Interactive Perception. | Gyan Tatiya, Jonathan Francis, Ho-Hsiang Wu, Yonatan Bisk, Jivko Sinapov |
| 2023 | ICASSP | Audio-Text Models Do Not Yet Leverage Natural Language. | Ho-Hsiang Wu, Oriol Nieto, Juan Pablo Bello, Justin Salamon |
| 2023 | Interspeech | Active Learning for Abnormal Lung Sound Data Curation and Detection in Asthma. | Shabnam Ghaffarzadegan, Luca Bondi, Ho-Hsiang Wu, Sirajum Munir, Kelly J. Shields, Samarjit Das, Joseph Aracri |
| 2022 | ICASSP | Wav2CLIP: Learning Robust Audio Representations from Clip. | Ho-Hsiang Wu, Prem Seetharaman, Kundan Kumar, Juan Pablo Bello |
| 2022 | Interspeech | How to Listen? Rethinking Visual Sound Localization. | Ho-Hsiang Wu, Magdalena Fuentes, Prem Seetharaman, Juan Pablo Bello |
| 2021 | ICASSP | Multi-Task Self-Supervised Pre-Training for Music Classification. | Ho-Hsiang Wu, Chieh-Chi Kao, Qingming Tang, Ming Sun, Brian McFee, Juan Pablo Bello, Chao Wang |
| 2019 | ICASSP | Look, Listen, and Learn More: Design Choices for Deep Audio Embeddings. | Jason Cramer, Ho-Hsiang Wu, Justin Salamon, Juan Pablo Bello |
| 2009 | ICMLA | Towards a Class-Based Representation of Perceptual Tempo for Music Retrieval. | Ching-Wei Chen, Kyogu Lee, Ho-Hsiang Wu |