| 2025 | ICASSP | Detecting and Defending Against Adversarial Attacks on Automatic Speech Recognition via Diffusion Models. | Nikolai Lund Khne, Astrid H. F. Kitchena, Marie S. Jensen, Mikkel S. L. Brndt, Martin Gonzalez, Christophe A. N. Biscio, Zheng-Hua Tan |
| 2025 | ICASSP | Deep Feedback Cancellation for Hearing Aids with Improved System Stability and Sound Quality. | Eleftheria Lydaki, Zheng-Hua Tan, Jesper Jensen, Meng Guo |
| 2025 | ICML | Optimal Sensor Scheduling and Selection for Continuous-Discrete Kalman Filtering with Auxiliary Dynamics. | Mohamad Al Ahdab, John Leth, Zheng-Hua Tan |
| 2025 | Interspeech | xLSTM-SENet: xLSTM for Single-Channel Speech Enhancement. | Nikolai Lund Khne, Jan stergaard, Jesper Jensen, Zheng-Hua Tan |
| 2025 | Interspeech | Analysis and Extension of a Near-End Listening Enhancement Method Based on Long-Term Fractile Noise Statistics. | Filippo Villani, Wai-Yip Chan, Zheng-Hua Tan, Jan stergaard, Jesper Jensen |
| 2025 | Interspeech | AxLSTMs: learning self-supervised audio representations with xLSTMs. | Sarthak Yadav, Sergios Theodoridis, Zheng-Hua Tan |
| 2024 | AAAI | PAC-Bayes Generalisation Bounds for Dynamical Systems including Stable RNNs. | Deividas Eringis, John Leth, Zheng-Hua Tan, Rafael Wisniewski, Mihly Petreczky |
| 2024 | ICASSP | Self-Supervised Pretraining for Robust Personalized Voice Activity Detection in Adverse Conditions. | Holger Severin Bovbjerg, Jesper Jensen, Jan stergaard, Zheng-Hua Tan |
| 2024 | ICASSP | Joint Minimum Processing Beamforming and Near-End Listening Enhancement. | Andreas Jonas Fuglsig, Jesper Jensen, Zheng-Hua Tan, Lars Sndergaard Bertelsen, Jens Christian Lindof, Jan stergaard |
| 2024 | ICASSP | Diffusion-Based Speech Enhancement in Matched and Mismatched Conditions Using a Heun-Based Sampler. | Philippe Gonzalez, Zheng-Hua Tan, Jan stergaard, Jesper Jensen, Tommy Sonne Alstrm, Tobias May |
| 2024 | ICLR | Masked Autoencoders with Multi-Window Local-Global Attention Are Better Audio Learners. | Sarthak Yadav, Sergios Theodoridis, Lars Kai Hansen, Zheng-Hua Tan |
| 2024 | ICML | PAC-Bayesian Error Bound, via Rnyi Divergence, for a Class of Linear Time-Invariant State-Space Models. | Deividas Eringis, John Leth, Zheng-Hua Tan, Rafal Wisniewski, Mihly Petreczky |
| 2024 | IJCNN | Complex Recurrent Variational Autoencoder for Speech Resynthesis and Enhancement. | Yuying Xie, Thomas Arildsen, Zheng-Hua Tan |
| 2024 | Interspeech | Audio Mamba: Selective State Spaces for Self-Supervised Audio Representations. | Sarthak Yadav, Zheng-Hua Tan |
| 2023 | ICASSP | Improving Label-Deficient Keyword Spotting Through Self-Supervised Pretraining. | Holger Severin Bovbjerg, Zheng-Hua Tan |
| 2023 | ICASSP | Filterbank Learning for Noise-Robust Small-Footprint Keyword Spotting. | Ivn Lpez-Espejo, Ram C. M. C. Shekar, Zheng-Hua Tan, Jesper Jensen, John H. L. Hansen |
| 2023 | ICASSP | A Vision-Assisted Hearing Aid System Based on Deep Learning. | Daniel Michelsanti, Zheng-Hua Tan, Sergi Rotger-Griful, Jesper Jensen |
| 2023 | ICASSP | Radio Sensing with Large Intelligent Surface for 6G. | Cristian J. Vaca-Rubio, Pablo Ramirez-Espinosa, Kimmo Kansanen, Zheng-Hua Tan, Elisabeth de Carvalho |
| 2023 | Interspeech | Speech inpainting: Context-based speech synthesis guided by video. | Juan Felipe Montesinos, Daniel Michelsanti, Gloria Haro, Zheng-Hua Tan, Jesper Jensen |
| 2022 | ICASSP | Joint Far- and Near-End Speech Intelligibility Enhancement Based on the Approximated Speech Intelligibility Index. | Andreas Jonas Fuglsig, Jan stergaard, Jesper Jensen, Lars Sndergaard Bertelsen, Peter Mariager, Zheng-Hua Tan |
| 2022 | ICASSP | Summary on the ICASSP 2022 Multi-Channel Multi-Party Meeting Transcription Grand Challenge. | Fan Yu, Shiliang Zhang, Pengcheng Guo, Yihui Fu, Zhihao Du, Siqi Zheng, Weilong Huang, Lei Xie, Zheng-Hua Tan, DeLiang Wang, Yanmin Qian, Kong Aik Lee, Zhijie Yan, Bin Ma, Xin Xu, Hui Bu |
| 2022 | Interspeech | Adversarial Multi-Task Deep Learning for Noise-Robust Voice Activity Detection with Low Algorithmic Delay. | Claus M. Larsen, Peter Koch, Zheng-Hua Tan |
| 2022 | VTC | AoI and Throughput Optimization for Hybrid Traffic in Cellular Uplink Using Reinforcement Learning. | Chien-Cheng Wu, Zheng-Hua Tan, Cedomir Stefanovic |
| 2021 | ASRU | Conferencingspeech Challenge: Towards Far-Field Multi-Channel Speech Enhancement for Video Conferencing. | Wei Rao, Yihui Fu, Yanxin Hu, Xin Xu, Yvkai Jv, Jiangyu Han, Zhongjie Jiang, Lei Xie, Yannan Wang, Shinji Watanabe, Zheng-Hua Tan, Hui Bu, Tao Yu, Shidong Shang |
| 2021 | ICASSP | Joint Maximum Likelihood Estimation of Power Spectral Densities and Relative Acoustic Transfer Functions for Acoustic Beamforming. | Poul Hoang, Zheng-Hua Tan, Jan Mark de Haan, Jesper Jensen |
| 2021 | ICASSP | Audio-Visual Speech Inpainting with Deep Learning. | Giovanni Morrone, Daniel Michelsanti, Zheng-Hua Tan, Jesper Jensen |
| 2020 | ICASSP | Maximum Likelihood Estimation of the Interference-Plus-Noise Cross Power Spectral Density Matrix for Own Voice Retrieval. | Poul Hoang, Zheng-Hua Tan, Thomas Lunner, Jan Mark de Haan, Jesper Jensen |
| 2020 | ICASSP | Adversarial Example Detection by Classification for Deep Speech Recognition. | Saeid Samizade, Zheng-Hua Tan, Chao Shen, Xiaohong Guan |
| 2020 | ICPR | CC-Loss: Channel Correlation Loss for Image Classification. | Zeyu Song, Dongliang Chang, Zhanyu Ma, Xiaoxu Li, Zheng-Hua Tan |
| 2020 | Interspeech | Vocoder-Based Speech Synthesis from Silent Videos. | Daniel Michelsanti, Olga Slizovskaia, Gloria Haro, Emilia Gmez, Zheng-Hua Tan, Jesper Jensen |
| 2019 | ICASSP | Effects of Lombard Reflex on the Performance of Deep-learning-based Audio-visual Speech Enhancement Systems. | Daniel Michelsanti, Zheng-Hua Tan, Sigurdur Sigurdsson, Jesper Jensen |
| 2019 | ICASSP | On Training Targets and Objective Functions for Deep-learning-based Audio-visual Speech Enhancement. | Daniel Michelsanti, Zheng-Hua Tan, Sigurdur Sigurdsson, Jesper Jensen |
| 2019 | Interspeech | Keyword Spotting for Hearing Assistive Devices Robust to External Speakers. | Ivn Lpez-Espejo, Zheng-Hua Tan, Jesper Jensen |
| 2018 | ICASSP | Monaural Speech Enhancement Using Deep Neural Networks by Maximizing a Short-Time Objective Intelligibility Measure. | Morten Kolbk, Zheng-Hua Tan, Jesper Jensen |
| 2018 | Interspeech | Effectiveness of Single-Channel BLSTM Enhancement for Language Identification. | Peter Sibbern Frederiksen, Jess Villalba, Shinji Watanabe, Zheng-Hua Tan, Najim Dehak |
| 2018 | IROS | Public perception of android robots: Indications from an analysis of YouTube comments. | Evgenios Vlachos, Zheng-Hua Tan |
| 2018 | RO-MAN | The Sound or Silence: Investigating the Influence of Robot Noise on Proxemics. | Gabriele Trovato, Renato Paredes, Javier Balvin, Francisco Cullar, Nicolai Bk Thomsen, Sren Bech, Zheng-Hua Tan |
| 2017 | ICASSP | A non-intrusive Short-Time Objective Intelligibility measure. | Asger Heidemann Andersen, Jan Mark de Haan, Zheng-Hua Tan, Jesper Jensen |
| 2017 | ICASSP | RedDots replayed: A new replay spoofing attack corpus for text-dependent speaker verification research. | Tomi Kinnunen, Md. Sahidullah, Mauro Falcone, Luca Costantini, Rosa Gonzlez Hautamki, Dennis Alexander Lehmann Thomsen, Achintya Kumar Sarkar, Zheng-Hua Tan, Hctor Delgado, Massimiliano Todisco, Nicholas W. D. Evans, Ville Hautamki, Kong-Aik Lee |
| 2017 | ICASSP | Permutation invariant training of deep models for speaker-independent multi-talker speech separation. | Dong Yu, Morten Kolbk, Zheng-Hua Tan, Jesper Jensen |
| 2017 | Interspeech | On the Use of Band Importance Weighting in the Short-Time Objective Intelligibility Measure. | Asger Heidemann Andersen, Jan Mark de Haan, Zheng-Hua Tan, Jesper Jensen |
| 2017 | Interspeech | The I4U Mega Fusion and Collaboration for NIST Speaker Recognition Evaluation 2016. | Kong-Aik Lee, Ville Hautamki, Tomi Kinnunen, Anthony Larcher, Chunlei Zhang, Andreas Nautsch, Themos Stafylakis, Gang Liu, Mickal Rouvier, Wei Rao, Federico Alegre, J. Ma, Man-Wai Mak, Achintya Kumar Sarkar, Hctor Delgado, Rahim Saeidi, Hagai Aronowitz, Aleksandr Sizov, Hanwu Sun, Trung Hieu Nguyen, Guangsen Wang, Bin Ma, Ville Vestman, Md. Sahidullah, M. Halonen, Anssi Kanervisto, Gal Le Lan, Fahimeh Bahmaninezhad, Sergey Isadskiy, Christian Rathgeb, Christoph Busch, Georgios Tzimiropoulos, Q. Qian, Z. Wang, Q. Zhao, T. Wang, H. Li, J. Xue, S. Zhu, R. Jin, T. Zhao, Pierre-Michel Bousquet, Moez Ajili, Waad Ben Kheder, Driss Matrouf, Zhi Hao Lim, Chenglin Xu, Haihua Xu, Xiong Xiao, Eng Siong Chng, Benoit G. B. Fauve, Kaavya Sriskandaraja, Vidhyasaharan Sethu, W. W. Lin, Dennis Alexander Lehmann Thomsen, Zheng-Hua Tan, Massimiliano Todisco, Nicholas W. D. Evans, Haizhou Li, John H. L. Hansen, Jean-Franois Bonastre, Eliathamby Ambikairajah |
| 2017 | Interspeech | Conditional Generative Adversarial Networks for Speech Enhancement and Noise-Robust Speaker Verification. | Daniel Michelsanti, Zheng-Hua Tan |
| 2017 | Interspeech | Improving Speaker Verification Performance in Presence of Spoofing Attacks Using Out-of-Domain Spoofed Data. | Achintya Kumar Sarkar, Md. Sahidullah, Zheng-Hua Tan, Tomi Kinnunen |
| 2017 | Interspeech | Adversarial Network Bottleneck Features for Noise Robust Speaker Verification. | Hong Yu, Zheng-Hua Tan, Zhanyu Ma, Jun Guo |
| 2017 | ICTAI | Weighted Score Based Fast Converging CO-training with Application to Audio-Visual Person Identification. | Xiaodong Duan, Nicolai Bk Thomsen, Zheng-Hua Tan, Brge Lindberg, Sren Holdt Jensen |
| 2016 | FUSION | Concurrent localization of sound sources and dual-microphone sub-arrays using TOFs. | Mojtaba Farmani, Richard Heusdens, Michael Syskind Pedersen, Zheng-Hua Tan, Jesper Jensen |
| 2016 | ICASSP | A method for predicting the intelligibility of noisy and non-linearly enhanced binaural speech. | Asger Heidemann Andersen, Jan Mark de Haan, Zheng-Hua Tan, Jesper Jensen |
| 2016 | ICASSP | Informed Direction of Arrival estimation using a spherical-head model for Hearing Aid applications. | Mojtaba Farmani, Michael Syskind Pedersen, Zheng-Hua Tan, Jesper Jensen |
| 2016 | Interspeech | Utterance Verification for Text-Dependent Speaker Recognition: A Comparative Assessment Using the RedDots Corpus. | Tomi Kinnunen, Md. Sahidullah, Ivan Kukanov, Hctor Delgado, Massimiliano Todisco, Achintya Kumar Sarkar, Nicolai Bk Thomsen, Ville Hautamki, Nicholas W. D. Evans, Zheng-Hua Tan |
| 2016 | Interspeech | HAPPY Team Entry to NIST OpenSAD Challenge: A Fusion of Short-Term Unsupervised and Segment i-Vector Based Speech Activity Detectors. | Tomi Kinnunen, Alexey Sholokhov, Elie Khoury, Dennis Alexander Lehmann Thomsen, Md. Sahidullah, Zheng-Hua Tan |
| 2016 | Interspeech | Integrated Spoofing Countermeasures and Automatic Speaker Verification: An Evaluation on ASVspoof 2015. | Md. Sahidullah, Hctor Delgado, Massimiliano Todisco, Hong Yu, Tomi Kinnunen, Nicholas W. D. Evans, Zheng-Hua Tan |
| 2016 | Interspeech | Robust Speaker Recognition with Combined Use of Acoustic and Throat Microphone Speech. | Md. Sahidullah, Rosa Gonzlez Hautamki, Dennis Alexander Lehmann Thomsen, Tomi Kinnunen, Zheng-Hua Tan, Ville Hautamki, Robert Parts, Martti Pitknen |
| 2016 | Interspeech | Text Dependent Speaker Verification Using Un-Supervised HMM-UBM and Temporal GMM-UBM. | Achintya Kumar Sarkar, Zheng-Hua Tan |
| 2016 | Interspeech | Speaker-Dependent Dictionary-Based Speech Enhancement for Text-Dependent Speaker Verification. | Nicolai Bk Thomsen, Dennis Alexander Lehmann Thomsen, Zheng-Hua Tan, Brge Lindberg, Sren Holdt Jensen |
| 2016 | IECON | Adaptive overcurrent protection for microgrids in extensive distribution systems. | Hengwei Lin, Josep M. Guerrero, Chenxi Jia, Zheng-Hua Tan, Juan C. Vasquez, Chengxi Liu |
| 2015 | ICASSP | Maximum likelihood approach to "informed" Sound Source Localization for Hearing Aid applications. | Mojtaba Farmani, Michael Syskind Pedersen, Zheng-Hua Tan, Jesper Jensen |
| 2015 | ICASSP | On the influence of microphone array geometry on HRTF-based Sound Source Localization. | Mojtaba Farmani, Michael Syskind Pedersen, Zheng-Hua Tan, Jesper Jensen |
| 2015 | ICASSP | Source-specific informative prior for i-vector extraction. | Sven Ewan Shepstone, Kong-Aik Lee, Haizhou Li, Zheng-Hua Tan, Sren Holdt Jensen |
| 2015 | ICIP | A feature subtraction method for image based kinship verification under uncontrolled environments. | Xiaodong Duan, Zheng-Hua Tan |
| 2015 | ICIP | Local feature learning for face recognition under varying poses. | Xiaodong Duan, Zheng-Hua Tan |
| 2015 | Interspeech | A binaural short time objective intelligibility measure for noisy and enhanced speech. | Asger Heidemann Andersen, Jan Mark de Haan, Zheng-Hua Tan, Jesper Jensen |
| 2015 | Interspeech | Comparison of forced-alignment speech recognition and humans for generating reference VAD. | Ivan Kraljevski, Zheng-Hua Tan, Maria Paola Bissiri |
| 2015 | IROS | A heuristic approach for a social robot to navigate to a person based on audio and range information. | Nicolai Bk Thomsen, Zheng-Hua Tan, Brge Lindberg, Sren Holdt Jensen |
| 2015 | ISVC | Neighbors Based Discriminative Feature Difference Learning for Kinship Verification. | Xiaodong Duan, Zheng-Hua Tan |
| 2014 | Interspeech | Improving Robustness Against Environmental Sounds for Directing Attention of Social Robots. | Nicolai Bk Thomsen, Zheng-Hua Tan, Brge Lindberg, Sren Holdt Jensen |
| 2013 | ICASSP | Developing a speaker identification system for the DARPA RATS project. | Oldrich Plchot, Spyros Matsoukas, Pavel Matejka, Najim Dehak, Jeff Z. Ma, Sandro Cumani, Ondrej Glembek, Hynek Hermansky, Sri Harish Reddy Mallidi, Nima Mesgarani, Richard M. Schwartz, Mehdi Soufifar, Zheng-Hua Tan, Samuel Thomas, Bing Zhang, Xinhui Zhou |
| 2013 | Interspeech | Demographic recommendation by means of group profile elicitation using speaker age and gender recognition. | Sven Ewan Shepstone, Zheng-Hua Tan, Sren Holdt Jensen |
| 2013 | VCIP | Perceptual grouping via untangling Gestalt principles. | Yonggang Qi, Jun Guo, Yi Li, Honggang Zhang, Tao Xiang, Yi-Zhe Song, Zheng-Hua Tan |
| 2012 | ICPRAM | PubSearch - A Hierarchical Heuristic Scheme for Ranking Academic Search Results. | Emmanouil Amolochitis, Ioannis T. Christou, Zheng-Hua Tan |
| 2011 | Interspeech | Sinusoidal Approach for the Single-Channel Speech Separation and Recognition Challenge. | Pejman Mowlaee, Rahim Saeidi, Zheng-Hua Tan, Mads Grsbll Christensen, Tomi Kinnunen, Pasi Frnti, Sren Holdt Jensen |
| 2011 | Interspeech | Multi-Sensor Voice Activity Detection Based on Multiple Observation Hypothesis Testing. | Theodore Petsatodis, Fotios Talantzis, Christos Boukis, Zheng-Hua Tan, Ramjee Prasad |
| 2010 | ICASSP | Joint single-channel speech separation and speaker identification. | Pejman Mowlaee, Rahim Saeidi, Zheng-Hua Tan, Mads Grsbll Christensen, Pasi Frnti, Sren Holdt Jensen |
| 2010 | ICPR | Signal-to-Signal Ratio Independent Speaker Identification for Co-channel Speech Signals. | Rahim Saeidi, Pejman Mowlaee, Tomi Kinnunen, Zheng-Hua Tan, Mads Grsbll Christensen, Sren Holdt Jensen, Pasi Frnti |
| 2010 | Interspeech | Improving monaural speaker identification by double-talk detection. | Rahim Saeidi, Pejman Mowlaee, Tomi Kinnunen, Zheng-Hua Tan, Mads Grsbll Christensen, Sren Holdt Jensen, Pasi Frnti |
| 2009 | Interspeech | A system for detecting miscues in dyslexic read speech. | Morten Hjfeldt Rasmussen, Zheng-Hua Tan, Brge Lindberg, Sren Holdt Jensen |
| 2009 | Interspeech | High-accuracy, low-complexity voice activity detection based on a posteriori SNR weighted energy. | Zheng-Hua Tan, Brge Lindberg |
| 2008 | ICPR | Speech Recognition on Mobile Devices. | Zheng-Hua Tan, Brge Lindberg |
| 2008 | Interspeech | A posteriori SNR weighted energy based variable frame rate analysis for speech recognition. | Zheng-Hua Tan, Brge Lindberg |
| 2006 | ICASSP | Robust Speech Recognition From Noise-Type Based Feature Compensation and Model Interpolation in a Multiple Model Framework. | Haitian Xu, Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg |
| 2006 | Interspeech | Robust speech recognition over mobile networks using combined weighted viterbi decoding and subvector based error concealment. | Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg |
| 2005 | Interspeech | Robust speech recognition in ubiquitous networking and context-aware computing. | Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg, Haitian Xu |
| 2005 | Interspeech | Robust speech recognition based on noise and SNR classification - a multiple-model framework. | Haitian Xu, Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg |
| 2005 | MMSP | Adaptive Multi-Frame-Rate Scheme for Distributed Speech Recognition Based on a Half Frame-Rate Front-End. | Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg |
| 2004 | ICASSP | A subvector-based error concealment algorithm for speech recognition over mobile networks. | Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg |
| 2004 | Interspeech | On the integration of speech recognition into personal networks. | Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg |
| 2004 | Interspeech | Spectral subtraction with full-wave rectification and likelihood controlled instantaneous noise estimation for robust speech recognition. | Haitian Xu, Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg |
| 2003 | ICASSP | OOV-detection and channel error protection for distributed speech recognition over wireless networks. | Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg |
| 2002 | Interspeech | Channel error protection scheme for distributed speech recognition. | Zheng-Hua Tan, Paul Dalsgaard |