| 2025 | Interspeech | GLCLAP: A Novel Contrastive Learning Pre-trained Model for Contextual Biasing in ASR. | Yuxiang Kong, Fan Cui, Liyong Guo, Heinrich Dinkel, Lichun Fan, Junbo Zhang, Jian Luan |
| 2025 | Interspeech | Efficient Speech Enhancement via Embeddings from Pre-trained Generative Audioencoders. | Xingwei Sun, Heinrich Dinkel, Yadong Niu, Linzhang Wang, Junbo Zhang, Jian Luan |
| 2025 | Interspeech | X-ARES: A Comprehensive Framework for Assessing Audio Encoder Performance. | Junbo Zhang, Heinrich Dinkel, Yadong Niu, Chenyu Liu, Si Cheng, Anbei Zhao, Jian Luan |
| 2024 | ICASSP | CED: Consistent Ensemble Distillation for Audio Tagging. | Heinrich Dinkel, Yongqing Wang, Zhiyong Yan, Junbo Zhang, Yujun Wang |
| 2024 | Interspeech | Scaling up masked audio encoder learning for general audio classification. | Heinrich Dinkel, Zhiyong Yan, Yongqing Wang, Junbo Zhang, Yujun Wang, Bin Wang |
| 2024 | Interspeech | Streaming Audio Transformers for Online Audio Tagging. | Heinrich Dinkel, Zhiyong Yan, Yongqing Wang, Junbo Zhang, Yujun Wang, Bin Wang |
| 2024 | Interspeech | Enhancing Automated Audio Captioning via Large Language Models with Optimized Audio Encoding. | Jizhong Liu, Gang Li, Junbo Zhang, Heinrich Dinkel, Yongqing Wang, Zhiyong Yan, Yujun Wang, Bin Wang |
| 2024 | Interspeech | Bridging Language Gaps in Audio-Text Retrieval. | Zhiyong Yan, Heinrich Dinkel, Yongqing Wang, Jizhong Liu, Junbo Zhang, Yujun Wang, Bin Wang |
| 2023 | ICASSP | Unified Keyword Spotting and Audio Tagging on Mobile Devices with Transformers. | Heinrich Dinkel, Yongqing Wang, Zhiyong Yan, Junbo Zhang, Yujun Wang |
| 2023 | ICASSP | Av-Sepformer: Cross-Attention Sepformer for Audio-Visual Target Speaker Extraction. | Jiuxin Lin, Xinyu Cai, Heinrich Dinkel, Jun Chen, Zhiyong Yan, Yongqing Wang, Junbo Zhang, Zhiyong Wu, Yujun Wang, Helen Meng |
| 2023 | Interspeech | Focus on the Sound around You: Monaural Target Speaker Extraction via Distance and Speaker Information. | Jiuxin Lin, Peng Wang, Heinrich Dinkel, Jun Chen, Zhiyong Wu, Zhiyong Yan, Yongqing Wang, Junbo Zhang, Yujun Wang |
| 2022 | ICASSP | Pseudo Strong Labels for Large Scale Weakly Supervised Audio Tagging. | Heinrich Dinkel, Zhiyong Yan, Yongqing Wang, Junbo Zhang, Yujun Wang |
| 2022 | ICASSP | Category-Adapted Sound Event Enhancement with Weakly Labeled Data. | Guangwei Li, Xuenan Xu, Heinrich Dinkel, Mengyue Wu, Kai Yu |
| 2022 | Interspeech | UniKW-AT: Unified Keyword Spotting and Audio Tagging. | Heinrich Dinkel, Yongqing Wang, Zhiyong Yan, Junbo Zhang, Yujun Wang |
| 2021 | ICASSP | Text-to-Audio Grounding: Building Correspondence Between Captions and Sound Events. | Xuenan Xu, Heinrich Dinkel, Mengyue Wu, Kai Yu |
| 2021 | ICASSP | Investigating Local and Global Information for Automated Audio Captioning with Transfer Learning. | Xuenan Xu, Heinrich Dinkel, Mengyue Wu, Zeyu Xie, Kai Yu |
| 2021 | Interspeech | A Lightweight Framework for Online Voice Activity Detection in the Wild. | Xuenan Xu, Heinrich Dinkel, Mengyue Wu, Kai Yu |
| 2020 | ECCV | Multiple Sound Sources Localization from Coarse to Fine. | Rui Qian, Di Hu, Heinrich Dinkel, Mengyue Wu, Ning Xu, Weiyao Lin |
| 2020 | ICASSP | Duration Robust Weakly Supervised Sound Event Detection. | Heinrich Dinkel, Kai Yu |
| 2020 | Interspeech | Voice Activity Detection in the Wild via Weakly Supervised Sound Event Detection. | Yefei Chen, Heinrich Dinkel, Mengyue Wu, Kai Yu |
| 2020 | Interspeech | Dual-Adversarial Domain Adaptation for Generalized Replay Attack Detection. | Hongji Wang, Heinrich Dinkel, Shuai Wang, Yanmin Qian, Kai Yu |
| 2019 | ICASSP | Audio Caption: Listen and Tell. | Mengyue Wu, Heinrich Dinkel, Kai Yu |
| 2019 | Interspeech | Cross-Domain Replay Spoofing Attack Detection Using Domain Adversarial Training. | Hongji Wang, Heinrich Dinkel, Shuai Wang, Yanmin Qian, Kai Yu |
| 2019 | Interspeech | The SJTU Robust Anti-Spoofing System for the ASVspoof 2019 Challenge. | Yexin Yang, Hongji Wang, Heinrich Dinkel, Zhengyang Chen, Shuai Wang, Yanmin Qian, Kai Yu |
| 2017 | ICASSP | End-to-end spoofing detection with raw waveform CLDNNS. | Heinrich Dinkel, Nanxin Chen, Yanmin Qian, Kai Yu |
| 2017 | IJCNN | Small-footprint convolutional neural network for spoofing detection. | Heinrich Dinkel, Yanmin Qian, Kai Yu |
| 2015 | Interspeech | Robust deep feature for spoofing detection - the SJTU system for ASVspoof 2015 challenge. | Nanxin Chen, Yanmin Qian, Heinrich Dinkel, Bo Chen, Kai Yu |