| 2025 | ICASSP | Continual Unsupervised Domain Adaptation for Audio Deepfake Detection. | Xiaohuan Chen, Wenhuan Lu, Ruiteng Zhang, Junhai Xu, Xugang Lu, Lin Zhang, Jianguo Wei |
| 2025 | Interspeech | Cross-modal Knowledge Transfer Learning as Graph Matching Based on Optimal Transport for ASR. | Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai |
| 2024 | ICASSP | Evaluation of an Improved Ultrasonic Imaging Helmet for Observing Articulatory Data. | Yuxuan Li, Jianguo Wei, Qiang Fang, Xugang Lu |
| 2024 | ICASSP | Hierarchical Cross-Modality Knowledge Transfer with Sinkhorn Attention for CTC-Based ASR. | Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai |
| 2024 | ICASSP | Self-Supervised Domain Exploration with an Optimal Transport Regularization for Open Set Cross-Domain Speech Emotion Recognition. | Ruiteng Zhang, Jianguo Wei, Xugang Lu, Yongwei Li, Wenhuan Lu, Di Jin, Junhai Xu |
| 2023 | ASRU | Cross-Modal Alignment With Optimal Transport For CTC-Based ASR. | Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai |
| 2023 | ICASSP | Optimal Transport with a Diversified Memory Bank for Cross-Domain Speaker Verification. | Ruiteng Zhang, Jianguo Wei, Xugang Lu, Wenhuan Lu, Di Jin, Lin Zhang, Junhai Xu |
| 2023 | Interspeech | Multi-Level Knowledge Distillation for Speech Emotion Recognition in Noisy Conditions. | Yang Liu, Haoqin Sun, Geng Chen, Qingyue Wang, Zhen Zhao, Xugang Lu, Longbiao Wang |
| 2023 | Interspeech | SOT: Self-supervised Learning-Assisted Optimal Transport for Unsupervised Adaptive Speech Emotion Recognition. | Ruiteng Zhang, Jianguo Wei, Xugang Lu, Yongwei Li, Junhai Xu, Di Jin, Jianhua Tao |
| 2022 | ICASSP | CS-REP: Making Speaker Verification Networks Embracing Re-Parameterization. | Ruiteng Zhang, Jianguo Wei, Wenhuan Lu, Lin Zhang, Yantao Ji, Junhai Xu, Xugang Lu |
| 2022 | Interspeech | Perceptual Contrast Stretching on Target Feature for Speech Enhancement. | Rong Chao, Cheng Yu, Szu-Wei Fu, Xugang Lu, Yu Tsao |
| 2022 | Interspeech | Data Augmentation Using McAdams-Coefficient-Based Speaker Anonymization for Fake Audio Detection. | Kai Li, Sheng Li, Xugang Lu, Masato Akagi, Meng Liu, Lin Zhang, Chang Zeng, Longbiao Wang, Jianwu Dang, Masashi Unoki |
| 2022 | Interspeech | Transducer-based language embedding for spoken language identification. | Peng Shen, Xugang Lu, Hisashi Kawai |
| 2021 | ICASSP | Unsupervised Neural Adaptation Model Based on Optimal Transport for Spoken Language Identification. | Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai |
| 2021 | Interspeech | MetricGAN+: An Improved Version of MetricGAN for Speech Enhancement. | Szu-Wei Fu, Cheng Yu, Tsun-An Hsieh, Peter Plantinga, Mirco Ravanelli, Xugang Lu, Yu Tsao |
| 2021 | Interspeech | Improving Perceptual Quality by Phone-Fortified Perceptual Loss Using Wasserstein Distance for Speech Enhancement. | Tsun-An Hsieh, Cheng Yu, Szu-Wei Fu, Xugang Lu, Yu Tsao |
| 2021 | ISCAS | EMA2S: An End-to-End Multimodal Articulatory-to-Speech System. | Yu-Wen Chen, Kuo-Hsuan Hung, Shang-Yi Chuang, Jonathan Sherman, Wen-Chin Huang, Xugang Lu, Yu Tsao |
| 2020 | COLING | Robust Unsupervised Neural Machine Translation with Adversarial Denoising Training. | Haipeng Sun, Rui Wang, Kehai Chen, Xugang Lu, Masao Utiyama, Eiichiro Sumita, Tiejun Zhao |
| 2020 | ICASSP | Self-Supervised Denoising Autoencoder with Linear Regression Decoder for Speech Enhancement. | Ryandhimas E. Zezario, Tassadaq Hussain, Xugang Lu, Hsin-Min Wang, Yu Tsao |
| 2020 | Interspeech | Incorporating Broad Phonetic Information for Speech Enhancement. | Yen-Ju Lu, Chien-Feng Liao, Xugang Lu, Jeih-weih Hung, Yu Tsao |
| 2020 | Interspeech | Investigation of NICT Submission for Short-Duration Speaker Verification Challenge 2020. | Peng Shen, Xugang Lu, Hisashi Kawai |
| 2019 | ICASSP | Interactive Learning of Teacher-student Model for Short Utterance Spoken Language Identification. | Peng Shen, Xugang Lu, Sheng Li, Hisashi Kawai |
| 2019 | Interspeech | End-to-End Articulatory Attribute Modeling for Low-Resource Multilingual Speech Recognition. | Sheng Li, Chenchen Ding, Xugang Lu, Peng Shen, Tatsuya Kawahara, Hisashi Kawai |
| 2019 | Interspeech | Incorporating Symbolic Sequential Modeling for Speech Enhancement. | Chien-Feng Liao, Yu Tsao, Xugang Lu, Hisashi Kawai |
| 2019 | Interspeech | Investigating Radical-Based End-to-End Speech Recognition Systems for Chinese Dialects and Japanese. | Sheng Li, Xugang Lu, Chenchen Ding, Peng Shen, Tatsuya Kawahara, Hisashi Kawai |
| 2019 | Interspeech | Improving Transformer-Based Speech Recognition Systems with Compressed Structure and Speech Attributes Augmentation. | Sheng Li, Raj Dabre, Xugang Lu, Peng Shen, Tatsuya Kawahara, Hisashi Kawai |
| 2019 | Interspeech | Class-Wise Centroid Distance Metric Learning for Acoustic Event Detection. | Xugang Lu, Peng Shen, Sheng Li, Yu Tsao, Hisashi Kawai |
| 2019 | Interspeech | Specialized Speech Enhancement Model Selection Based on Learned Non-Intrusive Quality Assessment Metric. | Ryandhimas E. Zezario, Szu-Wei Fu, Xugang Lu, Hsin-Min Wang, Yu Tsao |
| 2018 | ICASSP | Speech Dereverberation Based on Integrated Deep and Ensemble Learning Algorithm. | Wei-Jen Lee, Syu-Siang Wang, Fei Chen, Xugang Lu, Shao-Yi Chien, Yu Tsao |
| 2018 | Interspeech | Improving CTC-based Acoustic Model with Very Deep Residual Time-delay Neural Networks. | Sheng Li, Xugang Lu, Ryoichi Takashima, Peng Shen, Tatsuya Kawahara, Hisashi Kawai |
| 2018 | Interspeech | Temporal Attentive Pooling for Acoustic Event Detection. | Xugang Lu, Peng Shen, Sheng Li, Yu Tsao, Hisashi Kawai |
| 2018 | Interspeech | Feature Representation of Short Utterances Based on Knowledge Distillation for Spoken Language Identification. | Peng Shen, Xugang Lu, Sheng Li, Hisashi Kawai |
| 2017 | ASRU | Incremental training and constructing the very deep convolutional residual network acoustic models. | Sheng Li, Xugang Lu, Peng Shen, Ryoichi Takashima, Tatsuya Kawahara, Hisashi Kawai |
| 2017 | ICASSP | Minimum Bayes risk training of CTC acoustic models in maximum a posteriori based decoding framework. | Naoyuki Kanda, Xugang Lu, Hisashi Kawai |
| 2017 | ICASSP | Semi-supervised ensemble DNN acoustic model training. | Sheng Li, Xugang Lu, Shinsuke Sakai, Masato Mimura, Tatsuya Kawahara |
| 2017 | Interspeech | Conditional Generative Adversarial Nets Classifier for Spoken Language Identification. | Peng Shen, Xugang Lu, Sheng Li, Hisashi Kawai |
| 2016 | ICASSP | Bottleneck linear transformation network adaptation for speaker adaptive training-based hybrid DNN-HMM speech recognizer. | Tsubasa Ochiai, Shigeki Matsuda, Hideyuki Watanabe, Xugang Lu, Hisashi Kawai, Shigeru Katagiri |
| 2016 | ICASSP | Local fisher discriminant analysis for spoken language identification. | Peng Shen, Xugang Lu, Lemao Liu, Hisashi Kawai |
| 2016 | Interspeech | SNR-Aware Convolutional Neural Network Modeling for Speech Enhancement. | Szu-Wei Fu, Yu Tsao, Xugang Lu |
| 2016 | Interspeech | Investigation of Semi-Supervised Acoustic Model Training Based on the Committee of Heterogeneous Neural Networks. | Naoyuki Kanda, Shoji Harada, Xugang Lu, Hisashi Kawai |
| 2016 | Interspeech | Maximum a posteriori Based Decoding for CTC Acoustic Models. | Naoyuki Kanda, Xugang Lu, Hisashi Kawai |
| 2016 | Interspeech | Pair-Wise Distance Metric Learning of Neural Network Model for Spoken Language Identification. | Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai |
| 2016 | Interspeech | F | Xiaoyun Wang, Xugang Lu, Hisashi Kawai, Seiichi Yamamoto |
| 2015 | ASRU | Training data pseudo-shuffling and direct decoding framework for recurrent neural network based acoustic modeling. | Naoyuki Kanda, Mitsuyoshi Tachimori, Xugang Lu, Hisashi Kawai |
| 2015 | ICASSP | Speaker adaptive training for deep neural networks embedding linear transformation networks. | Tsubasa Ochiai, Shigeki Matsuda, Hideyuki Watanabe, Xugang Lu, Chiori Hori, Shigeru Katagiri |
| 2015 | Interspeech | Ensemble speaker modeling using speaker adaptive training deep neural network for speaker adaptation. | Sheng Li, Xugang Lu, Yuya Akita, Tatsuya Kawahara |
| 2015 | Interspeech | Sparse representation with temporal max-smoothing for acoustic event detection. | Xugang Lu, Peng Shen, Yu Tsao, Chiori Hori, Hisashi Kawai |
| 2014 | ICASSP | Speech enhancement using segmental nonnegative matrix factorization. | Hao-Teng Fan, Jeih-weih Hung, Xugang Lu, Syu-Siang Wang, Yu Tsao |
| 2014 | ICASSP | Sparse representation based on a bag of spectral exemplars for acoustic event detection. | Xugang Lu, Yu Tsao, Shigeki Matsuda, Chiori Hori |
| 2014 | ICASSP | Speaker Adaptive Training using Deep Neural Networks. | Tsubasa Ochiai, Shigeki Matsuda, Xugang Lu, Chiori Hori, Shigeru Katagiri |
| 2014 | Interspeech | Ensemble modeling of denoising autoencoder for speech spectrum restoration. | Xugang Lu, Yu Tsao, Shigeki Matsuda, Chiori Hori |
| 2013 | ICASSP | Automatic localization of a language-independent sub-network on deep neural networks trained by multi-lingual speech. | Shigeki Matsuda, Xugang Lu, Hideki Kashioka |
| 2013 | Interspeech | Speech spectrum restoration based on conditional restricted boltzmann machine. | Xugang Lu, Shigeki Matsuda, Chiori Hori |
| 2013 | Interspeech | Speech enhancement based on deep denoising autoencoder. | Xugang Lu, Yu Tsao, Shigeki Matsuda, Chiori Hori |
| 2012 | COLING | Factored Language Model based on Recurrent Neural Network. | Youzheng Wu, Xugang Lu, Hitoshi Yamamoto, Shigeki Matsuda, Chiori Hori, Hideki Kashioka |
| 2012 | ICASSP | Noise estimation using a constrained sequential HMM IN log-spectral domain. | Dongwen Ying, Xugang Lu, Junfeng Li, Yonghong Yan, Jianwu Dang, Frank K. Soong |
| 2012 | Interspeech | Speech restoration based on deep learning autoencoder with layer-wised pretraining. | Xugang Lu, Shigeki Matsuda, Chiori Hori, Hideki Kashioka |
| 2011 | Interspeech | Adaptive Regularization Framework for Robust Voice Activity Detection. | Xugang Lu, Masashi Unoki, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2011 | Interspeech | Voice Activity Detection in MTF-Based Power Envelope Restoration. | Masashi Unoki, Xugang Lu, Rico Petrick, Shota Morita, Masato Akagi, Rdiger Hoffmann |
| 2010 | Interspeech | Voice activity detection in a reguarized reproducing kernel hilbert space. | Xugang Lu, Masashi Unoki, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2009 | ICASSP | Temporal contrast normalization and edge-preserved smoothing on temporal modulation structure for robust speech recognition. | Xugang Lu, Shigeki Matsuda, Masashi Unoki, Tohru Shimizu, Satoshi Nakamura |
| 2009 | Interspeech | Subband temporal modulation spectrum normalization for automatic speech recognition in reverberant environments. | Xugang Lu, Masashi Unoki, Satoshi Nakamura |
| 2008 | Interspeech | A model based investigation of activation patterns of the tongue muscles for vowel production. | Qiang Fang, Satoru Fujita, Xugang Lu, Jianwu Dang |
| 2008 | Interspeech | Robust front end processing for speech recognition in reverberant environments: utilization of speech characteristics. | Rico Petrick, Xugang Lu, Masashi Unoki, Masato Akagi, Rdiger Hoffmann |
| 2007 | ICASSP | Physiological Feature Extraction for Text Independent Speaker Identification using Non-Uniform Subband Processing. | Xugang Lu, Jianwu Dang |
| 2007 | Interspeech | Dimension reduction for speaker identification based on mutual information. | Xugang Lu, Jianwu Dang |
| 2006 | Interspeech | A robust feature extraction based on the MTF concept for speech recognition in reverberant environment. | Xugang Lu, Masashi Unoki, Masato Akagi |
| 2006 | Interspeech | A simulation based parameter optimization for a coarticulation model. | Jianguo Wei, Xugang Lu, Jianwu Dang |
| 2005 | ICASSP | A noise reduction system in arbitrary noise environments and its applications to speech enhancement and speech recognition. | Junfeng Li, Xugang Lu, Masato Akagi |
| 2000 | Interspeech | Dominant subspace analysis for auditory spectrum. | Xugang Lu, Gang Li, Lipo Wang |
| 1999 | IJCNN | Integrating spatial and temporal mechanisms in auditory neural fiber's computational model. | Xugang Lu, Daowen Chen |
| 1999 | IWANN | A New Cochlear Model Based on Adaptive Gain Mechanism. | Xugang Lu, Daowen Chen |