Skip to content

Zheng-Hua Tan

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

89

Venues

19

Active years

2002–2025

Best venue rank

A*

Where they publish

Papers

89 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPDetecting and Defending Against Adversarial Attacks on Automatic Speech Recognition via Diffusion Models.Nikolai Lund Khne, Astrid H. F. Kitchena, Marie S. Jensen, Mikkel S. L. Brndt, Martin Gonzalez, Christophe A. N. Biscio, Zheng-Hua Tan
2025ICASSPDeep Feedback Cancellation for Hearing Aids with Improved System Stability and Sound Quality.Eleftheria Lydaki, Zheng-Hua Tan, Jesper Jensen, Meng Guo
2025ICMLOptimal Sensor Scheduling and Selection for Continuous-Discrete Kalman Filtering with Auxiliary Dynamics.Mohamad Al Ahdab, John Leth, Zheng-Hua Tan
2025InterspeechxLSTM-SENet: xLSTM for Single-Channel Speech Enhancement.Nikolai Lund Khne, Jan stergaard, Jesper Jensen, Zheng-Hua Tan
2025InterspeechAnalysis and Extension of a Near-End Listening Enhancement Method Based on Long-Term Fractile Noise Statistics.Filippo Villani, Wai-Yip Chan, Zheng-Hua Tan, Jan stergaard, Jesper Jensen
2025InterspeechAxLSTMs: learning self-supervised audio representations with xLSTMs.Sarthak Yadav, Sergios Theodoridis, Zheng-Hua Tan
2024AAAIPAC-Bayes Generalisation Bounds for Dynamical Systems including Stable RNNs.Deividas Eringis, John Leth, Zheng-Hua Tan, Rafael Wisniewski, Mihly Petreczky
2024ICASSPSelf-Supervised Pretraining for Robust Personalized Voice Activity Detection in Adverse Conditions.Holger Severin Bovbjerg, Jesper Jensen, Jan stergaard, Zheng-Hua Tan
2024ICASSPJoint Minimum Processing Beamforming and Near-End Listening Enhancement.Andreas Jonas Fuglsig, Jesper Jensen, Zheng-Hua Tan, Lars Sndergaard Bertelsen, Jens Christian Lindof, Jan stergaard
2024ICASSPDiffusion-Based Speech Enhancement in Matched and Mismatched Conditions Using a Heun-Based Sampler.Philippe Gonzalez, Zheng-Hua Tan, Jan stergaard, Jesper Jensen, Tommy Sonne Alstrm, Tobias May
2024ICLRMasked Autoencoders with Multi-Window Local-Global Attention Are Better Audio Learners.Sarthak Yadav, Sergios Theodoridis, Lars Kai Hansen, Zheng-Hua Tan
2024ICMLPAC-Bayesian Error Bound, via Rnyi Divergence, for a Class of Linear Time-Invariant State-Space Models.Deividas Eringis, John Leth, Zheng-Hua Tan, Rafal Wisniewski, Mihly Petreczky
2024IJCNNComplex Recurrent Variational Autoencoder for Speech Resynthesis and Enhancement.Yuying Xie, Thomas Arildsen, Zheng-Hua Tan
2024InterspeechAudio Mamba: Selective State Spaces for Self-Supervised Audio Representations.Sarthak Yadav, Zheng-Hua Tan
2023ICASSPImproving Label-Deficient Keyword Spotting Through Self-Supervised Pretraining.Holger Severin Bovbjerg, Zheng-Hua Tan
2023ICASSPFilterbank Learning for Noise-Robust Small-Footprint Keyword Spotting.Ivn Lpez-Espejo, Ram C. M. C. Shekar, Zheng-Hua Tan, Jesper Jensen, John H. L. Hansen
2023ICASSPA Vision-Assisted Hearing Aid System Based on Deep Learning.Daniel Michelsanti, Zheng-Hua Tan, Sergi Rotger-Griful, Jesper Jensen
2023ICASSPRadio Sensing with Large Intelligent Surface for 6G.Cristian J. Vaca-Rubio, Pablo Ramirez-Espinosa, Kimmo Kansanen, Zheng-Hua Tan, Elisabeth de Carvalho
2023InterspeechSpeech inpainting: Context-based speech synthesis guided by video.Juan Felipe Montesinos, Daniel Michelsanti, Gloria Haro, Zheng-Hua Tan, Jesper Jensen
2022ICASSPJoint Far- and Near-End Speech Intelligibility Enhancement Based on the Approximated Speech Intelligibility Index.Andreas Jonas Fuglsig, Jan stergaard, Jesper Jensen, Lars Sndergaard Bertelsen, Peter Mariager, Zheng-Hua Tan
2022ICASSPSummary on the ICASSP 2022 Multi-Channel Multi-Party Meeting Transcription Grand Challenge.Fan Yu, Shiliang Zhang, Pengcheng Guo, Yihui Fu, Zhihao Du, Siqi Zheng, Weilong Huang, Lei Xie, Zheng-Hua Tan, DeLiang Wang, Yanmin Qian, Kong Aik Lee, Zhijie Yan, Bin Ma, Xin Xu, Hui Bu
2022InterspeechAdversarial Multi-Task Deep Learning for Noise-Robust Voice Activity Detection with Low Algorithmic Delay.Claus M. Larsen, Peter Koch, Zheng-Hua Tan
2022VTCAoI and Throughput Optimization for Hybrid Traffic in Cellular Uplink Using Reinforcement Learning.Chien-Cheng Wu, Zheng-Hua Tan, Cedomir Stefanovic
2021ASRUConferencingspeech Challenge: Towards Far-Field Multi-Channel Speech Enhancement for Video Conferencing.Wei Rao, Yihui Fu, Yanxin Hu, Xin Xu, Yvkai Jv, Jiangyu Han, Zhongjie Jiang, Lei Xie, Yannan Wang, Shinji Watanabe, Zheng-Hua Tan, Hui Bu, Tao Yu, Shidong Shang
2021ICASSPJoint Maximum Likelihood Estimation of Power Spectral Densities and Relative Acoustic Transfer Functions for Acoustic Beamforming.Poul Hoang, Zheng-Hua Tan, Jan Mark de Haan, Jesper Jensen
2021ICASSPAudio-Visual Speech Inpainting with Deep Learning.Giovanni Morrone, Daniel Michelsanti, Zheng-Hua Tan, Jesper Jensen
2020ICASSPMaximum Likelihood Estimation of the Interference-Plus-Noise Cross Power Spectral Density Matrix for Own Voice Retrieval.Poul Hoang, Zheng-Hua Tan, Thomas Lunner, Jan Mark de Haan, Jesper Jensen
2020ICASSPAdversarial Example Detection by Classification for Deep Speech Recognition.Saeid Samizade, Zheng-Hua Tan, Chao Shen, Xiaohong Guan
2020ICPRCC-Loss: Channel Correlation Loss for Image Classification.Zeyu Song, Dongliang Chang, Zhanyu Ma, Xiaoxu Li, Zheng-Hua Tan
2020InterspeechVocoder-Based Speech Synthesis from Silent Videos.Daniel Michelsanti, Olga Slizovskaia, Gloria Haro, Emilia Gmez, Zheng-Hua Tan, Jesper Jensen
2019ICASSPEffects of Lombard Reflex on the Performance of Deep-learning-based Audio-visual Speech Enhancement Systems.Daniel Michelsanti, Zheng-Hua Tan, Sigurdur Sigurdsson, Jesper Jensen
2019ICASSPOn Training Targets and Objective Functions for Deep-learning-based Audio-visual Speech Enhancement.Daniel Michelsanti, Zheng-Hua Tan, Sigurdur Sigurdsson, Jesper Jensen
2019InterspeechKeyword Spotting for Hearing Assistive Devices Robust to External Speakers.Ivn Lpez-Espejo, Zheng-Hua Tan, Jesper Jensen
2018ICASSPMonaural Speech Enhancement Using Deep Neural Networks by Maximizing a Short-Time Objective Intelligibility Measure.Morten Kolbk, Zheng-Hua Tan, Jesper Jensen
2018InterspeechEffectiveness of Single-Channel BLSTM Enhancement for Language Identification.Peter Sibbern Frederiksen, Jess Villalba, Shinji Watanabe, Zheng-Hua Tan, Najim Dehak
2018IROSPublic perception of android robots: Indications from an analysis of YouTube comments.Evgenios Vlachos, Zheng-Hua Tan
2018RO-MANThe Sound or Silence: Investigating the Influence of Robot Noise on Proxemics.Gabriele Trovato, Renato Paredes, Javier Balvin, Francisco Cullar, Nicolai Bk Thomsen, Sren Bech, Zheng-Hua Tan
2017ICASSPA non-intrusive Short-Time Objective Intelligibility measure.Asger Heidemann Andersen, Jan Mark de Haan, Zheng-Hua Tan, Jesper Jensen
2017ICASSPRedDots replayed: A new replay spoofing attack corpus for text-dependent speaker verification research.Tomi Kinnunen, Md. Sahidullah, Mauro Falcone, Luca Costantini, Rosa Gonzlez Hautamki, Dennis Alexander Lehmann Thomsen, Achintya Kumar Sarkar, Zheng-Hua Tan, Hctor Delgado, Massimiliano Todisco, Nicholas W. D. Evans, Ville Hautamki, Kong-Aik Lee
2017ICASSPPermutation invariant training of deep models for speaker-independent multi-talker speech separation.Dong Yu, Morten Kolbk, Zheng-Hua Tan, Jesper Jensen
2017InterspeechOn the Use of Band Importance Weighting in the Short-Time Objective Intelligibility Measure.Asger Heidemann Andersen, Jan Mark de Haan, Zheng-Hua Tan, Jesper Jensen
2017InterspeechThe I4U Mega Fusion and Collaboration for NIST Speaker Recognition Evaluation 2016.Kong-Aik Lee, Ville Hautamki, Tomi Kinnunen, Anthony Larcher, Chunlei Zhang, Andreas Nautsch, Themos Stafylakis, Gang Liu, Mickal Rouvier, Wei Rao, Federico Alegre, J. Ma, Man-Wai Mak, Achintya Kumar Sarkar, Hctor Delgado, Rahim Saeidi, Hagai Aronowitz, Aleksandr Sizov, Hanwu Sun, Trung Hieu Nguyen, Guangsen Wang, Bin Ma, Ville Vestman, Md. Sahidullah, M. Halonen, Anssi Kanervisto, Gal Le Lan, Fahimeh Bahmaninezhad, Sergey Isadskiy, Christian Rathgeb, Christoph Busch, Georgios Tzimiropoulos, Q. Qian, Z. Wang, Q. Zhao, T. Wang, H. Li, J. Xue, S. Zhu, R. Jin, T. Zhao, Pierre-Michel Bousquet, Moez Ajili, Waad Ben Kheder, Driss Matrouf, Zhi Hao Lim, Chenglin Xu, Haihua Xu, Xiong Xiao, Eng Siong Chng, Benoit G. B. Fauve, Kaavya Sriskandaraja, Vidhyasaharan Sethu, W. W. Lin, Dennis Alexander Lehmann Thomsen, Zheng-Hua Tan, Massimiliano Todisco, Nicholas W. D. Evans, Haizhou Li, John H. L. Hansen, Jean-Franois Bonastre, Eliathamby Ambikairajah
2017InterspeechConditional Generative Adversarial Networks for Speech Enhancement and Noise-Robust Speaker Verification.Daniel Michelsanti, Zheng-Hua Tan
2017InterspeechImproving Speaker Verification Performance in Presence of Spoofing Attacks Using Out-of-Domain Spoofed Data.Achintya Kumar Sarkar, Md. Sahidullah, Zheng-Hua Tan, Tomi Kinnunen
2017InterspeechAdversarial Network Bottleneck Features for Noise Robust Speaker Verification.Hong Yu, Zheng-Hua Tan, Zhanyu Ma, Jun Guo
2017ICTAIWeighted Score Based Fast Converging CO-training with Application to Audio-Visual Person Identification.Xiaodong Duan, Nicolai Bk Thomsen, Zheng-Hua Tan, Brge Lindberg, Sren Holdt Jensen
2016FUSIONConcurrent localization of sound sources and dual-microphone sub-arrays using TOFs.Mojtaba Farmani, Richard Heusdens, Michael Syskind Pedersen, Zheng-Hua Tan, Jesper Jensen
2016ICASSPA method for predicting the intelligibility of noisy and non-linearly enhanced binaural speech.Asger Heidemann Andersen, Jan Mark de Haan, Zheng-Hua Tan, Jesper Jensen
2016ICASSPInformed Direction of Arrival estimation using a spherical-head model for Hearing Aid applications.Mojtaba Farmani, Michael Syskind Pedersen, Zheng-Hua Tan, Jesper Jensen
2016InterspeechUtterance Verification for Text-Dependent Speaker Recognition: A Comparative Assessment Using the RedDots Corpus.Tomi Kinnunen, Md. Sahidullah, Ivan Kukanov, Hctor Delgado, Massimiliano Todisco, Achintya Kumar Sarkar, Nicolai Bk Thomsen, Ville Hautamki, Nicholas W. D. Evans, Zheng-Hua Tan
2016InterspeechHAPPY Team Entry to NIST OpenSAD Challenge: A Fusion of Short-Term Unsupervised and Segment i-Vector Based Speech Activity Detectors.Tomi Kinnunen, Alexey Sholokhov, Elie Khoury, Dennis Alexander Lehmann Thomsen, Md. Sahidullah, Zheng-Hua Tan
2016InterspeechIntegrated Spoofing Countermeasures and Automatic Speaker Verification: An Evaluation on ASVspoof 2015.Md. Sahidullah, Hctor Delgado, Massimiliano Todisco, Hong Yu, Tomi Kinnunen, Nicholas W. D. Evans, Zheng-Hua Tan
2016InterspeechRobust Speaker Recognition with Combined Use of Acoustic and Throat Microphone Speech.Md. Sahidullah, Rosa Gonzlez Hautamki, Dennis Alexander Lehmann Thomsen, Tomi Kinnunen, Zheng-Hua Tan, Ville Hautamki, Robert Parts, Martti Pitknen
2016InterspeechText Dependent Speaker Verification Using Un-Supervised HMM-UBM and Temporal GMM-UBM.Achintya Kumar Sarkar, Zheng-Hua Tan
2016InterspeechSpeaker-Dependent Dictionary-Based Speech Enhancement for Text-Dependent Speaker Verification.Nicolai Bk Thomsen, Dennis Alexander Lehmann Thomsen, Zheng-Hua Tan, Brge Lindberg, Sren Holdt Jensen
2016IECONAdaptive overcurrent protection for microgrids in extensive distribution systems.Hengwei Lin, Josep M. Guerrero, Chenxi Jia, Zheng-Hua Tan, Juan C. Vasquez, Chengxi Liu
2015ICASSPMaximum likelihood approach to "informed" Sound Source Localization for Hearing Aid applications.Mojtaba Farmani, Michael Syskind Pedersen, Zheng-Hua Tan, Jesper Jensen
2015ICASSPOn the influence of microphone array geometry on HRTF-based Sound Source Localization.Mojtaba Farmani, Michael Syskind Pedersen, Zheng-Hua Tan, Jesper Jensen
2015ICASSPSource-specific informative prior for i-vector extraction.Sven Ewan Shepstone, Kong-Aik Lee, Haizhou Li, Zheng-Hua Tan, Sren Holdt Jensen
2015ICIPA feature subtraction method for image based kinship verification under uncontrolled environments.Xiaodong Duan, Zheng-Hua Tan
2015ICIPLocal feature learning for face recognition under varying poses.Xiaodong Duan, Zheng-Hua Tan
2015InterspeechA binaural short time objective intelligibility measure for noisy and enhanced speech.Asger Heidemann Andersen, Jan Mark de Haan, Zheng-Hua Tan, Jesper Jensen
2015InterspeechComparison of forced-alignment speech recognition and humans for generating reference VAD.Ivan Kraljevski, Zheng-Hua Tan, Maria Paola Bissiri
2015IROSA heuristic approach for a social robot to navigate to a person based on audio and range information.Nicolai Bk Thomsen, Zheng-Hua Tan, Brge Lindberg, Sren Holdt Jensen
2015ISVCNeighbors Based Discriminative Feature Difference Learning for Kinship Verification.Xiaodong Duan, Zheng-Hua Tan
2014InterspeechImproving Robustness Against Environmental Sounds for Directing Attention of Social Robots.Nicolai Bk Thomsen, Zheng-Hua Tan, Brge Lindberg, Sren Holdt Jensen
2013ICASSPDeveloping a speaker identification system for the DARPA RATS project.Oldrich Plchot, Spyros Matsoukas, Pavel Matejka, Najim Dehak, Jeff Z. Ma, Sandro Cumani, Ondrej Glembek, Hynek Hermansky, Sri Harish Reddy Mallidi, Nima Mesgarani, Richard M. Schwartz, Mehdi Soufifar, Zheng-Hua Tan, Samuel Thomas, Bing Zhang, Xinhui Zhou
2013InterspeechDemographic recommendation by means of group profile elicitation using speaker age and gender recognition.Sven Ewan Shepstone, Zheng-Hua Tan, Sren Holdt Jensen
2013VCIPPerceptual grouping via untangling Gestalt principles.Yonggang Qi, Jun Guo, Yi Li, Honggang Zhang, Tao Xiang, Yi-Zhe Song, Zheng-Hua Tan
2012ICPRAMPubSearch - A Hierarchical Heuristic Scheme for Ranking Academic Search Results.Emmanouil Amolochitis, Ioannis T. Christou, Zheng-Hua Tan
2011InterspeechSinusoidal Approach for the Single-Channel Speech Separation and Recognition Challenge.Pejman Mowlaee, Rahim Saeidi, Zheng-Hua Tan, Mads Grsbll Christensen, Tomi Kinnunen, Pasi Frnti, Sren Holdt Jensen
2011InterspeechMulti-Sensor Voice Activity Detection Based on Multiple Observation Hypothesis Testing.Theodore Petsatodis, Fotios Talantzis, Christos Boukis, Zheng-Hua Tan, Ramjee Prasad
2010ICASSPJoint single-channel speech separation and speaker identification.Pejman Mowlaee, Rahim Saeidi, Zheng-Hua Tan, Mads Grsbll Christensen, Pasi Frnti, Sren Holdt Jensen
2010ICPRSignal-to-Signal Ratio Independent Speaker Identification for Co-channel Speech Signals.Rahim Saeidi, Pejman Mowlaee, Tomi Kinnunen, Zheng-Hua Tan, Mads Grsbll Christensen, Sren Holdt Jensen, Pasi Frnti
2010InterspeechImproving monaural speaker identification by double-talk detection.Rahim Saeidi, Pejman Mowlaee, Tomi Kinnunen, Zheng-Hua Tan, Mads Grsbll Christensen, Sren Holdt Jensen, Pasi Frnti
2009InterspeechA system for detecting miscues in dyslexic read speech.Morten Hjfeldt Rasmussen, Zheng-Hua Tan, Brge Lindberg, Sren Holdt Jensen
2009InterspeechHigh-accuracy, low-complexity voice activity detection based on a posteriori SNR weighted energy.Zheng-Hua Tan, Brge Lindberg
2008ICPRSpeech Recognition on Mobile Devices.Zheng-Hua Tan, Brge Lindberg
2008InterspeechA posteriori SNR weighted energy based variable frame rate analysis for speech recognition.Zheng-Hua Tan, Brge Lindberg
2006ICASSPRobust Speech Recognition From Noise-Type Based Feature Compensation and Model Interpolation in a Multiple Model Framework.Haitian Xu, Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg
2006InterspeechRobust speech recognition over mobile networks using combined weighted viterbi decoding and subvector based error concealment.Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg
2005InterspeechRobust speech recognition in ubiquitous networking and context-aware computing.Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg, Haitian Xu
2005InterspeechRobust speech recognition based on noise and SNR classification - a multiple-model framework.Haitian Xu, Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg
2005MMSPAdaptive Multi-Frame-Rate Scheme for Distributed Speech Recognition Based on a Half Frame-Rate Front-End.Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg
2004ICASSPA subvector-based error concealment algorithm for speech recognition over mobile networks.Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg
2004InterspeechOn the integration of speech recognition into personal networks.Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg
2004InterspeechSpectral subtraction with full-wave rectification and likelihood controlled instantaneous noise estimation for robust speech recognition.Haitian Xu, Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg
2003ICASSPOOV-detection and channel error protection for distributed speech recognition over wireless networks.Zheng-Hua Tan, Paul Dalsgaard, Brge Lindberg
2002InterspeechChannel error protection scheme for distributed speech recognition.Zheng-Hua Tan, Paul Dalsgaard