| 2025 | ICASSP | Effective Techniques for Scaling Audio Encoder Pretraining. | Byeonggeun Kim, Andrew Bydlon, Qingming Tang, Huy Phan, Chieh-Chi Kao, Tao Zhang, Chao Wang |
| 2025 | ICML | IMPACT: Iterative Mask-based Parallel Decoding for Text-to-Audio Generation with Diffusion Modeling. | Kuan-Po Huang, Shu-Wen Yang, Huy Phan, Bo-Ru Lu, Byeonggeun Kim, Sashank Macha, Qingming Tang, Shalini Ghosh, Hung-yi Lee, Chieh-Chi Kao, Chao Wang |
| 2025 | ICML | Generative Audio Language Modeling with Continuous-valued Tokens and Masked Next-Token Prediction. | Shu-Wen Yang, Byeonggeun Kim, Kuan-Po Huang, Qingming Tang, Huy Phan, Bo-Ru Lu, Harshavardhan Sundar, Shalini Ghosh, Hung-yi Lee, Chieh-Chi Kao, Chao Wang |
| 2024 | ICASSP | Cross-Triggering Issue in Audio Event Detection and Mitigation. | Huy Phan, Byeonggeun Kim, Vu Nguyen, Andrew Bydlon, Qingming Tang, Chieh-Chi Kao, Chao Wang |
| 2023 | ICASSP | FedRPO: Federated Relaxed Pareto Optimization for Acoustic Event Classification. | Meng Feng, Chieh-Chi Kao, Qingming Tang, Amit Solomon, Viktor Rozgic, Chao Wang |
| 2023 | ICASSP | Weight-Sharing Supernet for Searching Specialized Acoustic Event Classification Networks Across Device Constraints. | Guan-Ting Lin, Qingming Tang, Chieh-Chi Kao, Viktor Rozgic, Chao Wang |
| 2022 | ICASSP | Federated Self-Supervised Learning for Acoustic Event Classification. | Meng Feng, Chieh-Chi Kao, Qingming Tang, Ming Sun, Viktor Rozgic, Spyros Matsoukas, Chao Wang |
| 2022 | ICASSP | Wikitag: Wikipedia-Based Knowledge Embeddings Towards Improved Acoustic Event Classification. | Qin Zhang, Qingming Tang, Chieh-Chi Kao, Ming Sun, Yang Liu, Chao Wang |
| 2022 | ICASSP | Improved Representation Learning For Acoustic Event Classification Using Tree-Structured Ontology. | Arman Zharmagambetov, Qingming Tang, Chieh-Chi Kao, Qin Zhang, Ming Sun, Viktor Rozgic, Jasha Droppo, Chao Wang |
| 2021 | ICASSP | Multi-Task Self-Supervised Pre-Training for Music Classification. | Ho-Hsiang Wu, Chieh-Chi Kao, Qingming Tang, Ming Sun, Brian McFee, Juan Pablo Bello, Chao Wang |
| 2020 | ICASSP | A Comparison of Pooling Methods on LSTM Models for Rare Acoustic Event Classification. | Chieh-Chi Kao, Ming Sun, Weiran Wang, Chao Wang |
| 2020 | ICASSP | Few-Shot Acoustic Event Detection Via Meta Learning. | Bowen Shi, Ming Sun, Krishna C. Puvvada, Chieh-Chi Kao, Spyros Matsoukas, Chao Wang |
| 2020 | Interspeech | Intra-Utterance Similarity Preserving Knowledge Distillation for Audio Tagging. | Chun-Chieh Chang, Chieh-Chi Kao, Ming Sun, Chao Wang |
| 2020 | Interspeech | On Front-End Gain Invariant Modeling for Wake Word Spotting. | Yixin Gao, Noah D. Stein, Chieh-Chi Kao, Yunliang Cai, Ming Sun, Tao Zhang, Shiv Naga Prasad Vitaladevuni |
| 2020 | Interspeech | A Joint Framework for Audio Tagging and Weakly Supervised Acoustic Event Detection Using DenseNet with Global Average Pooling. | Chieh-Chi Kao, Bowen Shi, Ming Sun, Chao Wang |
| 2019 | ICASSP | Semi-supervised Acoustic Event Detection Based on Tri-training. | Bowen Shi, Ming Sun, Chieh-Chi Kao, Viktor Rozgic, Spyros Matsoukas, Chao Wang |
| 2019 | ICASSP | Hierarchical Residual-pyramidal Model for Large Context Based Media Presence Detection. | Qingming Tang, Ming Sun, Chieh-Chi Kao, Viktor Rozgic, Chao Wang |
| 2019 | Interspeech | Sub-Band Convolutional Neural Networks for Small-Footprint Spoken Term Classification. | Chieh-Chi Kao, Ming Sun, Yixin Gao, Shiv Vitaladevuni, Chao Wang |
| 2019 | Interspeech | Compression of Acoustic Event Detection Models with Quantized Distillation. | Bowen Shi, Ming Sun, Chieh-Chi Kao, Viktor Rozgic, Spyros Matsoukas, Chao Wang |
| 2018 | ACCV | Localization-Aware Active Learning for Object Detection. | Chieh-Chi Kao, Teng-Yok Lee, Pradeep Sen, Ming-Yu Liu |
| 2018 | Interspeech | R-CRNN: Region-based Convolutional Recurrent Neural Network for Audio Event Detection. | Chieh-Chi Kao, Weiran Wang, Ming Sun, Chao Wang |
| 2018 | Interspeech | A Simple Model for Detection of Rare Sound Events. | Weiran Wang, Chieh-Chi Kao, Chao Wang |