Skip to content

Lei Xie

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

392

Venues

40

Active years

2005–2026

Best venue rank

A*

Where they publish

Papers

Showing the 300 most recent indexed papers.

YearVenueTitleAuthors
2026AAAIWenetSpeech-Yue: A Large-Scale Cantonese Speech Corpus with Multi-dimensional Annotation.Longhao Li, Zhao Guo, Hongjie Chen, Yuhang Dai, Ziyu Zhang, Hongfei Xue, Tianlun Zuo, Chengyou Wang, Shuiyuan Wang, Xin Xu, Hui Bu, Jie Li, Jian Kang, Binbin Zhang, Ruibin Yuan, Ziya Zhou, Wei Xue, Lei Xie
2026AAAIHearing More with Less: Multi-Modal Retrieval-and-Selection Augmented Conversational LLM-Based ASR.Bingshen Mu, Hexin Liu, Hongfei Xue, Kun Wei, Lei Xie
2026AAAIKALL-E: Autoregressive Speech Synthesis with Next-Distribution Prediction.Kangxiang Xia, Xinfa Zhu, Jixun Yao, Wenjie Tian, Wenhao Li, Lei Xie
2026ACLLLM-ForcedAligner: A Non-Autoregressive and Accurate LLM-Based Forced Aligner for Multilingual and Long-Form Speech.Bingshen Mu, Xian Shi, Xiong Wang, Hexin Liu, Jin Xu, Lei Xie
2026ACLWenetSpeech-Wu: Datasets, Benchmarks, and Models for a Unified Chinese Wu Dialect Speech Processing Ecosystem.Chengyou Wang, Mingchen Shao, Jingbin Hu, Zeyu Zhu, Hongfei Xue, Bingshen Mu, Xin Xu, Xingyi Duan, Binbin Zhang, Pengcheng Zhu, Chuang Ding, Xiaojun Zhang, Hui Bu, Lei Xie
2026ICDCSTackling the Runtime Context Fluctuation: Steady Scheduling in Data Stream Analytics for Industrial Internet of Things.Shuyu Cao, Wenhui Zhou, Jingyi Ning, Lei Xie
2026INFOCOMRF-Gaussmeter: Noninvasive μT-level Magnetic Field Sensing using TMR-based RFID Tag.Shiyuan Ma, Lei Xie, Chuyu Wang, Wei Wang, Yu He, Sanglu Lu
2026INFOCOMLarge-Field-of-View Measurement of Fabric Density Based on Moir Pattern for Industrial IoT.Zhaowei Wu, Jingyi Ning, Zhihao Yan, Jialu Xu, Lei Xie
2026INFOCOMTackling the Imbalance in Video Analytics Pipelines with Hierarchical Embodied Intelligence.Wenhui Zhou, Lei Xie, Jingyi Ning, Shuyu Cao, Hao Wu, Qinghua Peng, Long Fan
2025AAAIDrop the Beat! Freestyler for Accompaniment Conditioned Rapping Voice Generation.Ziqian Ning, Shuai Wang, Yuepeng Jiang, Jixun Yao, Lei He, Shifeng Pan, Jie Ding, Lei Xie
2025AAAIStableVC: Style Controllable Zero-Shot Voice Conversion with Conditional Flow Matching.Jixun Yao, Yuguang Yang, Yu Pan, Ziqian Ning, Jianhao Ye, Hongbin Zhou, Lei Xie
2025ACLTakin-VC: Expressive Zero-Shot Voice Conversion via Adaptive Hybrid Content Encoding and Enhanced Timbre Modeling.Yuguang Yang, Yu Pan, Jixun Yao, Xiang Zhang, Jianhao Ye, Hongbin Zhou, Lei Xie, Lei Ma, Jianjun Zhao
2025ACLLLaSE-G1: Incentivizing Generalization Capability for LLaMA-based Speech Enhancement.Boyi Kang, Xinfa Zhu, Zihan Zhang, Zhen Ye, Mingshuai Liu, Ziqian Wang, Yike Zhu, Guobin Ma, Jun Chen, Longshuai Xiao, Chao Weng, Wei Xue, Lei Xie
2025ASRUDiffRhythm+: Controllable and Flexible Full-Length Song Generation with Preference Optimization.Huakang Chen, Yuepeng Jiang, Guobin Ma, Chunbo Hao, Shuai Wang, Jixun Yao, Ziqian Ning, Meng Meng, Jian Luan, Lei Xie
2025ASRUREF-VC: Robust, Expressive and Fast Zero-Shot Voice Conversion with Diffusion Transformers.Yuepeng Jiang, Ziqian Ning, Shuai Wang, Chengjia Wang, Mengxiao Bi, Pengcheng Zhu, Zhonghua Fu, Lei Xie
2025ASRUEfficient Scaling for LLM-based ASR.Bingshen Mu, Yiwen Shao, Kun Wei, Dong Yu, Lei Xie
2025ASRULlasa+: Free Lunch for Accelerated and Streaming Llama-Based Speech Synthesis.Wenjie Tian, Xinfa Zhu, Hanke Xie, Zhen Ye, Wei Xue, Lei Xie
2025ASRUXEmoRAG: Cross-Lingual Emotion Transfer with Controllable Intensity Using Retrieval-Augmented Generation.Tianlun Zuo, Jingbin Hu, Yuke Li, Xinfa Zhu, Hai Li, Ying Yan, Junhui Liu, Danming Xie, Lei Xie
2025CVPRMobileMamba: Lightweight Multi-Receptive Visual Mamba Network.Haoyang He, Jiangning Zhang, Yuxuan Cai, Hongxu Chen, Xiaobin Hu, Zhenye Gan, Yabiao Wang, Chengjie Wang, Yunsheng Wu, Lei Xie
2025EMNLPPVTNL: Prompting Vision Transformers with Natural Language for Generalizable Person Re-identification.Ning Wang, Lei Xie, Sanglu Lu, Shiwei Gan
2025ICASSPCAMEL: Cross-Attention Enhanced Mixture-of-Experts and Language Bias for Code-Switching Speech Recognition.He Wang, Xucheng Wan, Naijun Zheng, Kai Liu, Huan Zhou, Guojian Li, Lei Xie
2025ICASSPHDMoLE: Mixture of LoRA Experts with Hierarchical Routing and Dynamic Thresholds for Fine-Tuning LLM-based ASR Models.Bingshen Mu, Kun Wei, Qijie Shao, Yong Xu, Lei Xie
2025ICASSPDiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification.Qing Wang, Jixun Yao, Zhaokai Sun, Pengcheng Guo, Lei Xie, John H. L. Hansen
2025ICASSPZSVC: Zero-shot Style Voice Conversion with Disentangled Latent Diffusion Models and Adversarial Training.Xinfa Zhu, Lei He, Yujia Xiao, Xi Wang, Xu Tan, Sheng Zhao, Lei Xie
2025ICCVA Comprehensive Library for Benchmarking Multi-Class Visual Anomaly Detection.Jiangning Zhang, Haoyang He, Zhenye Gan, Qingdong He, Yuxuan Cai, Zhucun Xue, Yabiao Wang, Chengjie Wang, Lei Xie, Yong Liu
2025ICDCSTowards Visual-Inertial Integration: Multi-Modal Collaboration-based Video Stabilization.Chaoran Li, Yanling Bu, Lei Xie
2025ICDCSmmUAVsense: mmWave Radar-based UAV Detection via Fine-grained Rotary Sensing.Wenhao Xu, Chuyu Wang, Qiancheng Jin, Yanling Bu, Lei Xie, Sanglu Lu
2025ICLRGenSE: Generative Speech Enhancement via Language Models using Hierarchical Modeling.Jixun Yao, Hexin Liu, Chen Chen, Yuchen Hu, Eng Siong Chng, Lei Xie
2025ICMLFreeze-Omni: A Smart and Low Latency Speech-to-speech Dialogue Model with Frozen LLM.Xiong Wang, Yangze Li, Chaoyou Fu, Yike Zhang, Yunhang Shen, Lei Xie, Ke Li, Xing Sun, Long Ma
2025ICPADSIMUWatermark: A Blind and Robust Backdoor Watermark via Frequency-Domain Injection.Lei Xie, Xiulong Liu, Xin Xie, Kaixuan Zhang, Qixuan Cai, Xinyu Tong, Zheng Gong, Keqiu Li
2025ICRARLPP: A Residual Method for Zero-Shot Real-World Autonomous Racing on Scaled Platforms.Edoardo Ghignone, Nicolas Baumann, Cheng Hu, Jonathan Wang, Lei Xie, Andrea Carron, Michele Magno
2025ICRAA Data-Driven Aggressive Autonomous Racing Framework Utilizing Local Trajectory Planning with Velocity Prediction.Zhouheng Li, Bei Zhou, Cheng Hu, Lei Xie, Hongye Su
2025IJCNNTSDA: A Temporal-Spatial Data Augmentation for Human Pose Recognition in Point Cloud.Ning Wang, Lei Xie, Chuyu Wang, Sanglu Lu, Long Fan
2025INFOCOMSweaTag: Fine-Grained Sweat Amount Sensing with COTS RFID Tags.Zhongkang Qiao, Chuyu Wang, Lei Xie, Yuanmin Chen, Sanglu Lu
2025InterspeechAISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition.Yuhang Dai, He Wang, Xingchen Li, Zihan Zhang, Shuiyuan Wang, Lei Xie, Xin Xu, Hongxiao Guo, Shaoji Zhang, Hui Bu, Wei Chen
2025InterspeechCabinSep: IR-Augmented Mask-Based MVDR for Real-Time In-car Speech Separation with Distributed Heterogeneous Arrays.Runduo Han, Yanxin Hu, Yihui Fu, Zihan Zhang, Yukai Jv, Li Chen, Lei Xie
2025InterspeechDelayed-KD: Delayed Knowledge Distillation based CTC for Low-Latency Streaming ASR.Longhao Li, Yangze Li, Hongfei Xue, Jie Liu, Shuai Fang, Kai Wang, Lei Xie
2025InterspeechContextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation.Zhennan Lin, Kaixun Huang, Wei Ren, Linju Yang, Lei Xie
2025InterspeechWeakly Supervised Data Refinement and Flexible Sequence Compression for Efficient Thai LLM-based ASR.Mingchen Shao, Xinfa Zhu, Chengyou Wang, Bingshen Mu, Hai Li, Ying Yan, Junhui Liu, Danming Xie, Lei Xie
2025InterspeechTowards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM.Zhaokai Sun, Li Zhang, Qing Wang, Pan Zhou, Lei Xie
2025InterspeechFlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching.Ziqian Wang, Zikai Liu, Xinfa Zhu, Yike Zhu, Mingshuai Liu, Jun Chen, Longshuai Xiao, Chao Weng, Lei Xie
2025InterspeechU-SAM: An Audio Language Model for Unified Speech, Audio, and Music Understanding.Ziqian Wang, Xianjun Xia, Xinfa Zhu, Lei Xie
2025InterspeechLeveraging LLM and Self-Supervised Training Models for Speech Recognition in Chinese Dialects: A Comparative Analysis.Tianyi Xu, Hongjie Chen, Qing Wang, Hang Lv, Jian Kang, Jie Li, Zhennan Lin, Yongxiang Li, Lei Xie
2025InterspeechSelective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty.Hongfei Xue, Yufeng Tang, Jun Zhang, Xuelong Geng, Lei Xie
2025InterspeechEASY: Emotion-aware Speaker Anonymization via Factorized Distillation.Jixun Yao, Hexin Liu, Eng Siong Chng, Lei Xie
2024AAAIA Diffusion-Based Framework for Multi-Class Anomaly Detection.Haoyang He, Jiangning Zhang, Hongxu Chen, Xuhai Chen, Zhishan Li, Xu Chen, Yabiao Wang, Chengjie Wang, Lei Xie
2024ACLStreamVoice: Streamable Context-Aware Language Modeling for Real-time Zero-Shot Voice Conversion.Zhichao Wang, Yuanzhe Chen, Xinsheng Wang, Lei Xie, Yuping Wang
2024CVPRSignGraph: A Sign Sequence is Worth Graphs of Nodes.Shiwei Gan, Yafeng Yin, Zhiwei Jiang, Hongkai Wen, Lei Xie, Sanglu Lu
2024ICASSPAn Audio-Quality-Based Multi-Strategy Approach For Target Speaker Extraction in the Misp 2023 Challenge.Runduo Han, Xiaopeng Yan, Weiming Xu, Pengcheng Guo, Jiayao Sun, He Wang, Quan Lu, Ning Jiang, Lei Xie
2024ICASSPRad-Net: A Repairing and Denoising Network for Speech Signal Improvement.Mingshuai Liu, Zhuangqi Chen, Xiaopeng Yan, Yuanjun Lv, Xianjun Xia, Chuanzeng Huang, Yijian Xiao, Lei Xie
2024ICASSPSpontts: Modeling and Transferring Spontaneous Style for TTS.Hanzhao Li, Xinfa Zhu, Liumeng Xue, Yang Song, Yunlin Chen, Lei Xie
2024ICASSPAutomatic Channel Selection and Spatial Feature Integration for Multi-Channel Speech Recognition Across Various Array Topologies.Bingshen Mu, Pengcheng Guo, Dake Guo, Pan Zhou, Wei Chen, Lei Xie
2024ICASSPDualvc 2: Dynamic Masked Convolution for Unified Streaming and Non-Streaming Voice Conversion.Ziqian Ning, Yuepeng Jiang, Pengcheng Zhu, Shuai Wang, Jixun Yao, Lei Xie, Mengxiao Bi
2024ICASSPICMC-ASR: The ICASSP 2024 In-Car Multi-Channel Automatic Speech Recognition Challenge.He Wang, Pengcheng Guo, Yue Li, Ao Zhang, Jiayao Sun, Lei Xie, Wei Chen, Pan Zhou, Hui Bu, Xin Xu, Binbin Zhang, Zhuo Chen, Jian Wu, Longbiao Wang, Eng Siong Chng, Sun Li
2024ICASSPMLCA-AVSR: Multi-Layer Cross Attention Fusion Based Audio-Visual Speech Recognition.He Wang, Pengcheng Guo, Pan Zhou, Lei Xie
2024ICASSPSELM: Speech Enhancement using Discrete Tokens and Language Models.Ziqian Wang, Xinfa Zhu, Zihan Zhang, Yuanjun Lv, Ning Jiang, Guoqing Zhao, Lei Xie
2024ICASSPPromptvc: Flexible Stylistic Voice Conversion in Latent Space Driven by Natural Language Prompts.Jixun Yao, Yuguang Yang, Yi Lei, Ziqian Ning, Yanni Hu, Yu Pan, Jingjing Yin, Hongbin Zhou, Heng Lu, Lei Xie
2024ICASSPBs-Plcnet: Band-Split Packet Loss Concealment Network with Multi-Task Learning Framework and Multi-Discriminators.Zihan Zhang, Jiayao Sun, Xianjun Xia, Chuanzeng Huang, Yijian Xiao, Lei Xie
2024ICDCSLED Can Backscatter: Multi-Modal Based 3D Localization via LED-Tag.Shiyuan Ma, Lei Xie, Chuyu Wang, Long Fan, Jingyi Ning, Qing Guo, Baoliu Ye, Sanglu Lu
2024InterspeechStreaming Decoder-Only Automatic Speech Recognition with Discrete Speech Units: A Pilot Study.Peikun Chen, Sining Sun, Changhao Shan, Qing Yang, Lei Xie
2024InterspeechAS-70: A Mandarin stuttered speech dataset for automatic speech recognition and stuttering event detection.Rong Gong, Hongfei Xue, Lezhi Wang, Xin Xu, Qisheng Li, Lei Xie, Hui Bu, Shaomei Wu, Jiaming Zhou, Yong Qin, Binbin Zhang, Jun Du, Jia Bin, Ming Li
2024InterspeechText-aware and Context-aware Expressive Audiobook Speech Synthesis.Dake Guo, Xinfa Zhu, Liumeng Xue, Yongmao Zhang, Wenjie Tian, Lei Xie
2024InterspeechTowards Expressive Zero-Shot Speech Synthesis with Hierarchical Prosody Modeling.Yuepeng Jiang, Tao Li, Fengyu Yang, Lei Xie, Meng Meng, Yujun Wang
2024InterspeechRaD-Net 2: A causal two-stage repairing and denoising speech enhancement network with knowledge distillation and complex axial self-attention.Mingshuai Liu, Zhuangqi Chen, Xiaopeng Yan, Yuanjun Lv, Xianjun Xia, Chuanzeng Huang, Yijian Xiao, Lei Xie
2024InterspeechA Transcription Prompt-based Efficient Audio Large Language Model for Robust Speech Recognition.Yangze Li, Xiong Wang, Songjun Cao, Yike Zhang, Long Ma, Lei Xie
2024InterspeechSCDNet: Self-supervised Learning Feature based Speaker Change Detection.Yue Li, Xinsheng Wang, Li Zhang, Lei Xie
2024InterspeechSingle-Codec: Single-Codebook Speech Codec towards High-Performance Speech Generation.Hanzhao Li, Liumeng Xue, Haohan Guo, Xinfa Zhu, Yuanjun Lv, Lei Xie, Yunlin Chen, Hao Yin, Zhifei Li
2024InterspeechFreeV: Free Lunch For Vocoders Through Pseudo Inversed Mel Filter.Yuanjun Lv, Hai Li, Ying Yan, Junhui Liu, Danming Xie, Lei Xie
2024InterspeechWenetSpeech4TTS: A 12, 800-hour Mandarin TTS Corpus for Large Speech Generation Model Benchmark.Linhan Ma, Dake Guo, Kun Song, Yuepeng Jiang, Shuai Wang, Liumeng Xue, Weiming Xu, Huan Zhao, Binbin Zhang, Lei Xie
2024InterspeechVec-Tok-VC+: Residual-enhanced Robust Zero-shot Voice Conversion with Progressive Constraints in a Dual-mode Training Strategy.Linhan Ma, Xinfa Zhu, Yuanjun Lv, Zhichao Wang, Ziqian Wang, Wendi He, Hongbin Zhou, Lei Xie
2024InterspeechSEQ-former: A context-enhanced and efficient automatic speech recognition framework.Qinglin Meng, Min Liu, Kaixun Huang, Kun Wei, Lei Xie, Zongfeng Quan, Weihong Deng, Quan Lu, Ning Jiang, Guoqing Zhao
2024InterspeechDualVC 3: Leveraging Language Model Generated Pseudo Context for End-to-end Low Latency Streaming Voice Conversion.Ziqian Ning, Shuai Wang, Pengcheng Zhu, Zhichao Wang, Jixun Yao, Lei Xie, Mengxiao Bi
2024InterspeechTowards Rehearsal-Free Multilingual ASR: A LoRA-based Case Study on Whisper.Tianyi Xu, Kaixun Huang, Pengcheng Guo, Yu Zhou, Longtao Huang, Hui Xue, Lei Xie
2023AAAIUniSyn: An End-to-End Unified Model for Text-to-Speech and Singing Voice Synthesis.Yi Lei, Shan Yang, Xinsheng Wang, Qicong Xie, Jixun Yao, Lei Xie, Dan Su
2023ASRUBA-MoE: Boundary-Aware Mixture-of-Experts Adapter for Code-Switching Speech Recognition.Peikun Chen, Fan Yu, Yuhao Liang, Hongfei Xue, Xucheng Wan, Naijun Zheng, Huan Zhou, Lei Xie
2023ASRUHIGNN-TTS: Hierarchical Prosody Modeling With Graph Neural Networks for Expressive Long-Form TTS.Dake Guo, Xinfa Zhu, Liumeng Xue, Tao Li, Yuanjun Lv, Yuepeng Jiang, Lei Xie
2023ASRUSpike-Triggered Contextual Biasing for End-to-End Mandarin Speech Recognition.Kaixun Huang, Ao Zhang, Binbin Zhang, Tianyi Xu, Xingchen Song, Lei Xie
2023ASRUThe Second Multi-Channel Multi-Party Meeting Transcription Challenge (M2MeT 2.0): A Benchmark for Speaker-Attributed ASR.Yuhao Liang, Mohan Shi, Fan Yu, Yangze Li, Shiliang Zhang, Zhihao Du, Qian Chen, Lei Xie, Yanmin Qian, Jian Wu, Zhuo Chen, Kong Aik Lee, Zhijie Yan, Hui Bu
2023ASRUSa-Paraformer: Non-Autoregressive End-To-End Speaker-Attributed ASR.Yangze Li, Fan Yu, Yuhao Liang, Pengcheng Guo, Mohan Shi, Zhihao Du, Shiliang Zhang, Lei Xie
2023ASRUZero-Shot Emotion Transfer for Cross-Lingual Speech Synthesis.Yuke Li, Xinfa Zhu, Yi Lei, Hai Li, Junhui Liu, Danming Xie, Lei Xie
2023ASRUSalt: Distinguishable Speaker Anonymization Through Latent Space Transformation.Yuanjun Lv, Jixun Yao, Peikun Chen, Hongbin Zhou, Heng Lu, Lei Xie
2023ASRUVits-Based Singing Voice Conversion Leveraging Whisper and Multi-Scale F0 Modeling.Ziqian Ning, Yuepeng Jiang, Zhichao Wang, Bin Zhang, Lei Xie
2023ASRUMBTFNET: Multi-Band Temporal-Frequency Neural Network for Singing Voice Enhancement.Weiming Xu, Zhouxuan Chen, Zhili Tan, Shubo Lv, Runduo Han, Wenjiang Zhou, Weifeng Zhao, Lei Xie
2023ASRUPromptspeaker: Speaker Generation Based on Text Descriptions.Yongmao Zhang, Guanghou Liu, Yi Lei, Yunlin Chen, Hao Yin, Lei Xie, Zhifei Li
2023ASRUAn Exploration of Task-Decoupling on Two-Stage Neural Post Filter for Real-Time Personalized Acoustic Echo Cancellation.Zihan Zhang, Jiayao Sun, Xianjun Xia, Ziqian Wang, Xiaopeng Yan, Yijian Xiao, Lei Xie
2023ASRUU2-KWS: Unified Two-Pass Open-Vocabulary Keyword Spotting with Keyword Bias.Ao Zhang, Pan Zhou, Kaixun Huang, Yong Zou, Ming Liu, Lei Xie
2023FIEApplication of Organizational Systems Theory to Identify Education and Training Needs for Industry 4.0.Mx. K. Pomeroy, Shaoping Qiu, Lei Xie, Malini Natarajathinam, Michael Johnson
2023GLOBECOMJoint BS Selection, User Association, and Beamforming Design for Network Integrated Sensing and Communication.Yiming Xu, Dongfang Xu, Lei Xie, Shenghui Song
2023ICASSPA Hybrid Deep Neural Network for Nonlinear Causality Analysis in Complex Industrial Control System.Tian Feng, Qiming Chen, Yao Shi, Xun Lang, Lei Xie, Hongye Su
2023ICASSPTwo-Stage Neural Network for ICASSP 2023 Speech Signal Improvement Challenge.Mingshuai Liu, Shubo Lv, Zihan Zhang, Runduo Han, Xiang Hao, Xianjun Xia, Li Chen, Yijian Xiao, Lei Xie
2023ICASSPExpressive-VC: Highly Expressive Voice Conversion with Attention Fusion of Bottleneck and Perturbation Features.Ziqian Ning, Qicong Xie, Pengcheng Zhu, Zhichao Wang, Liumeng Xue, Jixun Yao, Lei Xie, Mengxiao Bi
2023ICASSPDSPGAN: A Gan-Based Universal Vocoder for High-Fidelity TTS by Time-Frequency Domain Supervision from DSP.Kun Song, Yongmao Zhang, Yi Lei, Jian Cong, Hanzhao Li, Lei Xie, Gang He, Jinfeng Bai
2023ICASSPDelivering Speaking Style in Low-Resource Voice Conversion with Multi-Factor Constraints.Zhichao Wang, Xinsheng Wang, Lei Xie, Yuanzhe Chen, Qiao Tian, Yuping Wang
2023ICASSPWekws: A Production First Small-Footprint End-to-End Keyword Spotting Toolkit.Jie Wang, Menglong Xu, Jingyong Hou, Binbin Zhang, Xiao-Lei Zhang, Lei Xie, Fuping Pan
2023ICASSPThe NPU-Elevoc Personalized Speech Enhancement System for Icassp2023 DNS Challenge.Xiaopeng Yan, Yindi Yang, Zhihao Guo, Liangliang Peng, Lei Xie
2023ICASSPPreserving Background Sound in Noise-Robust Voice Conversion Via Multi-Task Learning.Jixun Yao, Yi Lei, Qing Wang, Pengcheng Guo, Ziqian Ning, Lei Xie, Hai Li, Junhui Liu, Danming Xie
2023ICASSPDistinguishable Speaker Anonymization Based on Formant and Fundamental Frequency Scaling.Jixun Yao, Qing Wang, Yi Lei, Pengcheng Guo, Lei Xie, Namin Wang, Jie Liu
2023ICASSPVE-KWS: Visual Modality Enhanced End-to-End Keyword Spotting.Ao Zhang, He Wang, Pengcheng Guo, Yihui Fu, Lei Xie, Yingying Gao, Shilei Zhang, Junlan Feng
2023ICASSPDistance-Based Weight Transfer for Fine-Tuning From Near-Field to Far-Field Speaker Verification.Li Zhang, Qing Wang, Hongji Wang, Yue Li, Wei Rao, Yannan Wang, Lei Xie
2023ICASSPTwo-Step Band-Split Neural Network Approach For Full-Band Residual Echo Suppression.Zihan Zhang, Shimin Zhang, Mingshuai Liu, Yanhong Leng, Zhe Han, Li Chen, Lei Xie
2023ICASSPMulti-Speaker Expressive Speech Synthesis via Multiple Factors Decoupling.Xinfa Zhu, Yi Lei, Kun Song, Yongmao Zhang, Tao Li, Lei Xie
2023ICDCSWork Condition Monitoring for Knife-Edge Switches on Lightweight Edge Devices.Ziwei Liu, Lei Xie, Jingyi Ning, Ming Zhao, Zhenjie Lin, Liming Wang
2023ICDCSPoster:Multi-Modal-Based Video Stabilization for Mobile Devices in Dynamic Scenes.Chaoran Li, Lei Xie, Yanling Bu, Ming Zhao, Zhenjie Lin, Liming Wang
2023IJCAIContrastive Learning for Sign Language Recognition and Translation.Shiwei Gan, Yafeng Yin, Zhiwei Jiang, Kang Xia, Lei Xie, Sanglu Lu
2023INFOCOMmmMIC: Multi-modal Speech Recognition based on mmWave Radar.Long Fan, Lei Xie, Xinran Lu, Yi Li, Chuyu Wang, Sanglu Lu
2023INFOCOMmmEavesdropper: Signal Augmentation-based Directional Eavesdropping with mmWave Radar.Yiwen Feng, Kai Zhang, Chuyu Wang, Lei Xie, Jingyi Ning, Shijia Chen
2023InterspeechPseudo-Siamese Network based Timbre-reserved Black-box Adversarial Attack in Speaker Identification.Qing Wang, Jixun Yao, Ziqian Wang, Pengcheng Guo, Lei Xie
2023InterspeechContextualized End-to-End Speech Recognition with Contextual Phrase Prediction Network.Kaixun Huang, Ao Zhang, Zhanheng Yang, Pengcheng Guo, Bingshen Mu, Tianyi Xu, Lei Xie
2023InterspeechBA-SOT: Boundary-Aware Serialized Output Training for Multi-Talker ASR.Yuhao Liang, Fan Yu, Yangze Li, Pengcheng Guo, Shiliang Zhang, Qian Chen, Lei Xie
2023InterspeechPromptStyle: Controllable Style Transfer for Text-to-Speech with Natural Language Descriptions.Guanghou Liu, Yongmao Zhang, Yi Lei, Yunlin Chen, Rui Wang, Lei Xie, Zhifei Li
2023InterspeechDCCRN-KWS: An Audio Bias Based Model for Noise Robust Small-Footprint Keyword Spotting.Shubo Lv, Xiong Wang, Sining Sun, Long Ma, Lei Xie
2023InterspeechDualVC: Dual-mode Voice Conversion using Intra-model Knowledge Distillation and Hybrid Predictive Coding.Ziqian Ning, Yuepeng Jiang, Pengcheng Zhu, Jixun Yao, Shuai Wang, Lei Xie, Mengxiao Bi
2023InterspeechStyleS2ST: Zero-shot Style Transfer for Direct Speech-to-speech Translation.Kun Song, Yi Ren, Yi Lei, Chunfeng Wang, Kun Wei, Lei Xie, Xiang Yin, Zejun Ma
2023InterspeechTranUSR: Phoneme-to-word Transcoder Based Unified Speech Representation Learning for Cross-lingual Speech Recognition.Hongfei Xue, Qijie Shao, Peikun Chen, Pengcheng Guo, Lei Xie, Jie Liu
2023InterspeechAdaptive Contextual Biasing for Transducer Based Streaming Speech Recognition.Tianyi Xu, Zhanheng Yang, Kaixun Huang, Pengcheng Guo, Ao Zhang, Biao Li, Changru Chen, Chao Li, Lei Xie
2023InterspeechTwo Stage Contextual Word Filtering for Context Bias in Unified Streaming and Non-streaming Transducer.Zhanheng Yang, Sining Sun, Xiong Wang, Yike Zhang, Long Ma, Lei Xie
2022ASPLOSSuppressing ZZ crosstalk of Quantum computers through pulse and scheduling co-optimization.Lei Xie, Jidong Zhai, Zhenxing Zhang, Jonathan Allcock, Shengyu Zhang, Yicong Zheng
2022BMVCCICC: Channel Pruning via the Concentration of Information and Contributions of Channels.Yihao Chen, Zhishan Li, Yingqing Yang, Lei Xie, Yong Liu, Longhua Ma, Shanqi Liu, Guanzhong Tian
2022ICASSPUformer: A Unet Based Dilated Complex & Real Dual-Path Conformer Network for Simultaneous Speech Enhancement and Dereverberation.Yihui Fu, Yun Liu, Jingdong Li, Dawei Luo, Shubo Lv, Yukai Jv, Lei Xie
2022ICASSPTEA-PSE: Tencent-Ethereal-Audio-Lab Personalized Speech Enhancement System for ICASSP 2022 DNS Challenge.Yukai Ju, Wei Rao, Xiaopeng Yan, Yihui Fu, Shubo Lv, Luyao Cheng, Yannan Wang, Lei Xie, Shidong Shang
2022ICASSPAn Efficient Framework for Detection and Recognition of Numerical Traffic Signs.Zhishan Li, Mingmu Chen, Yifan He, Lei Xie, Hongye Su
2022ICASSPS-DCCRN: Super Wide Band DCCRN with Learnable Complex Feature for Speech Enhancement.Shubo Lv, Yihui Fu, Mengtao Xing, Jiayao Sun, Lei Xie, Jun Huang, Yannan Wang, Tao Yu
2022ICASSPOne-Shot Voice Conversion For Style Transfer Based On Speaker Adaptation.Zhichao Wang, Qicong Xie, Tao Li, Hongqiang Du, Lei Xie, Pengcheng Zhu, Mengxiao Bi
2022ICASSPConversational Speech Recognition by Learning Conversation-Level Characteristics.Kun Wei, Yike Zhang, Sining Sun, Lei Xie, Long Ma
2022ICASSPM2Met: The Icassp 2022 Multi-Channel Multi-Party Meeting Transcription Challenge.Fan Yu, Shiliang Zhang, Yihui Fu, Lei Xie, Siqi Zheng, Zhihao Du, Weilong Huang, Pengcheng Guo, Zhijie Yan, Bin Ma, Xin Xu, Hui Bu
2022ICASSPSummary on the ICASSP 2022 Multi-Channel Multi-Party Meeting Transcription Grand Challenge.Fan Yu, Shiliang Zhang, Pengcheng Guo, Yihui Fu, Zhihao Du, Siqi Zheng, Weilong Huang, Lei Xie, Zheng-Hua Tan, DeLiang Wang, Yanmin Qian, Kong Aik Lee, Zhijie Yan, Bin Ma, Xin Xu, Hui Bu
2022ICASSPVISinger: Variational Inference with Adversarial Learning for End-to-End Singing Voice Synthesis.Yongmao Zhang, Jian Cong, Heyang Xue, Lei Xie, Pengcheng Zhu, Mengxiao Bi
2022ICASSPWENETSPEECH: A 10000+ Hours Multi-Domain Mandarin Corpus for Speech Recognition.Binbin Zhang, Hang Lv, Pengcheng Guo, Qijie Shao, Chao Yang, Lei Xie, Xin Xu, Hui Bu, Xiaoyu Chen, Chenchen Zeng, Di Wu, Zhendong Peng
2022ICASSPMulti-Task Deep Residual Echo Suppression with Echo-Aware Loss.Shimin Zhang, Ziteng Wang, Jiayao Sun, Yihui Fu, Biao Tian, Qiang Fu, Lei Xie
2022ICDCSPinpoint Achilles' Heel in RFID Localization: Phase Calibration of RFID Antenna based on Linear Localization Model.Yanling Bu, Lei Xie, Jia Liu, Chuyu Wang, Ge Wang, Zenglong Wang, Sanglu Lu
2022INFOCOMRF-Protractor: Non-Contacting Angle Tracking via COTS RFID in Industrial IoT Environment.Tingjun Liu, Chuyu Wang, Lei Xie, Jingyi Ning, Tie Qiu, Fu Xiao, Sanglu Lu
2022INFOCOMRemote Meter Reading based on Lightweight Edge Devices.Ziwei Liu, Lei Xie, Jingyi Ning, Ming Zhao, Liming Wang, Hao Peng
2022INFOCOMSeparating Voices from Multiple Sound Sources using 2D Microphone Array.Xinran Lu, Lei Xie, Fang Wang, Tao Gu, Chuyu Wang, Wei Wang, Sanglu Lu
2022INFOCOMStatic Obstacle Detection based on Acoustic Signals.Runze Tang, Gaolei Duan, Lei Xie, Yanling Bu, Ming Zhao, Zhenjie Lin, Qiang Lin
2022InterspeechGlow-WaveGAN 2: High-quality Zero-shot Text-to-speech Synthesis and Any-to-any Voice Conversion.Yi Lei, Shan Yang, Jian Cong, Lei Xie, Dan Su
2022InterspeechCross-speaker Emotion Transfer Based On Prosody Compensation for End-to-End Speech Synthesis.Tao Li, Xinsheng Wang, Qicong Xie, Zhichao Wang, Mingqi Jiang, Lei Xie
2022InterspeechLinguistic-Acoustic Similarity Based Accent Shift for Accent Recognition.Qijie Shao, Jinghao Yan, Jian Kang, Pengcheng Guo, Xian Shi, Pengfei Hu, Lei Xie
2022InterspeechOpencpop: A High-Quality Open Source Chinese Popular Song Corpus for Singing Voice Synthesis.Yu Wang, Xinsheng Wang, Pengcheng Zhu, Jie Wu, Hanzhao Li, Heyang Xue, Yongmao Zhang, Lei Xie, Mengxiao Bi
2022InterspeechLeveraging Acoustic Contextual Representation by Audio-textual Cross-modal Learning for Conversational ASR.Kun Wei, Yike Zhang, Sining Sun, Lei Xie, Long Ma
2022InterspeechLearn2Sing 2.0: Diffusion and Mutual Information-Based Target Speaker SVS by Learning from Singing Teacher.Heyang Xue, Xinsheng Wang, Yongmao Zhang, Lei Xie, Pengcheng Zhu, Mengxiao Bi
2022InterspeechLearning Noise-independent Speech Representation for High-quality Voice Conversion for Noisy Target Speakers.Liumeng Xue, Shan Yang, Na Hu, Dan Su, Lei Xie
2022InterspeechMinimizing Sequential Confusion Error in Speech Command Recognition.Zhanheng Yang, Hang Lv, Xiong Wang, Ao Zhang, Lei Xie
2022InterspeechOpen Source MagicData-RAMC: A Rich Annotated Mandarin Conversational(RAMC) Speech Dataset.Zehui Yang, Yifan Chen, Lei Luo, Runyan Yang, Lingxuan Ye, Gaofeng Cheng, Ji Xu, Yaohui Jin, Qingqing Zhang, Pengyuan Zhang, Lei Xie, Yonghong Yan
2022InterspeechCaTT-KWS: A Multi-stage Customized Keyword Spotting Framework based on Cascaded Transducer-Transformer.Zhanheng Yang, Sining Sun, Jin Li, Xiaoming Zhang, Xiong Wang, Long Ma, Lei Xie
2021APWEBIncorporating Typological Features into Language Selection for Multilingual Neural Machine Translation.Chenggang Mi, Shaolin Zhu, Yi Fan, Lei Xie
2021ASRUConferencingspeech Challenge: Towards Far-Field Multi-Channel Speech Enhancement for Video Conferencing.Wei Rao, Yihui Fu, Yanxin Hu, Xin Xu, Yvkai Jv, Jiangyu Han, Zhongjie Jiang, Lei Xie, Yannan Wang, Shinji Watanabe, Zheng-Hua Tan, Hui Bu, Tao Yu, Shidong Shang
2021ASRUBoundary and Context Aware Training for CIF-Based Non-Autoregressive End-to-End ASR.Fan Yu, Haoneng Luo, Pengcheng Guo, Yuhao Liang, Zhuoyuan Yao, Lei Xie, Yingying Gao, Leijing Hou, Shilei Zhang
2021ASRUDuality Temporal-Channel-Frequency Attention Enhanced Speaker Representation Learning.Li Zhang, Qing Wang, Lei Xie
2021DACMitigating Crosstalk in Quantum Computers through Commutativity-Based Instruction Reordering.Lei Xie, Jidong Zhai, Weimin Zheng
2021ICASSPAn Asynchronous WFST-Based Decoder for Automatic Speech Recognition.Hang Lv, Zhehuai Chen, Hainan Xu, Daniel Povey, Lei Xie, Sanjeev Khudanpur
2021ICASSPThe Accented English Speech Recognition Challenge 2020: Open Datasets, Tracks, Baselines, Results and Methods.Xian Shi, Fan Yu, Yizhou Lu, Yuhao Liang, Qiangze Feng, Daliang Wang, Yanmin Qian, Lei Xie
2021ICASSPWake Word Detection with Streaming Transformers.Yiming Wang, Hang Lv, Daniel Povey, Lei Xie, Sanjeev Khudanpur
2021ICASSPThe Multi-Speaker Multi-Style Voice Cloning Challenge 2021.Qicong Xie, Xiaohai Tian, Guanghou Liu, Kun Song, Lei Xie, Zhiyong Wu, Hai Li, Song Shi, Haizhou Li, Fen Hong, Hui Bu, Xin Xu
2021ICMITeNC: Low Bit-Rate Speech Coding with VQ-VAE and GAN.Yi Chen, Shan Yang, Na Hu, Lei Xie, Dan Su
2021ICMIA Web-Based Longitudinal Mental Health Monitoring System.Zhiwei Chen, Weizhao Yang, Jinrong Li, Jiale Wang, Shuai Li, Ziwen Wang, Lei Xie
2021ICMIASMMC21: The 6th International Workshop on Affective Social Multimedia Computing.Dongyan Huang, Bjrn W. Schuller, Jianhua Tao, Lei Xie, Jie Yang
2021ICMIEfficient Gradient-Based Neural Architecture Search For End-to-End ASR.Xian Shi, Pan Zhou, Wei Chen, Lei Xie
2021ICMINoise Robust Singing Voice Synthesis Using Gaussian Mixture Variational Autoencoder.Heyang Xue, Xiao Zhang, Jie Wu, Jian Luan, Yujun Wang, Lei Xie
2021IGARSSReduced-Dimension Space-Time Adaptive Processing in the Presence of Multiple Targets.Lei Xie, Pei Li, Xingyi Su, Jun Tong, Zishu He, Wei Zhang
2021InterspeechImproving Performance of Seen and Unseen Speech Style Transfer in End-to-End Neural TTS.Xiaochun An, Frank K. Soong, Lei Xie
2021InterspeechControllable Context-Aware Conversational Speech Synthesis.Jian Cong, Shan Yang, Na Hu, Guangzhi Li, Lei Xie, Dan Su
2021InterspeechGlow-WaveGAN: Learning Speech Representations from GAN-Based Variational Auto-Encoder for High Fidelity Flow-Based Speech Synthesis.Jian Cong, Shan Yang, Lei Xie, Dan Su
2021InterspeechImproving Robustness of One-Shot Voice Conversion with Deep Discriminative Speaker Encoder.Hongqiang Du, Lei Xie
2021InterspeechAISHELL-4: An Open Source Dataset for Speech Enhancement, Separation, Recognition and Speaker Diarization in Conference Scenario.Yihui Fu, Luyao Cheng, Shubo Lv, Yukai Jv, Yuxiang Kong, Zhuo Chen, Yanxin Hu, Lei Xie, Jian Wu, Hui Bu, Xin Xu, Jun Du, Jingdong Chen
2021InterspeechMulti-Speaker ASR Combining Non-Autoregressive Conformer CTC and Conditional Speaker Chain.Pengcheng Guo, Xuankai Chang, Shinji Watanabe, Lei Xie
2021InterspeechDCCRN+: Channel-Wise Subband DCCRN with SNR Estimation for Speech Enhancement.Shubo Lv, Yanxin Hu, Shimin Zhang, Lei Xie
2021InterspeechAuto-KWS 2021 Challenge: Task, Datasets, and Baselines.Jingsong Wang, Yuxuan He, Chunyu Zhao, Qijie Shao, Wei-Wei Tu, Tom Ko, Hung-yi Lee, Lei Xie
2021InterspeechEfficient Conformer with Prob-Sparse Attention Mechanism for End-to-End Speech Recognition.Xiong Wang, Sining Sun, Lei Xie, Long Ma
2021InterspeechEnriching Source Style Transfer in Recognition-Synthesis Based Non-Parallel Voice Conversion.Zhichao Wang, Xinyong Zhou, Fengyu Yang, Tao Li, Hongqiang Du, Lei Xie, Wendong Gan, Haitao Chen, Hai Li
2020HCITeamwork in Virtual World - Impact of "Virtual Team" on Team Dynamic.Bin Mai, Brittany Garcia, Lei Xie, Andrew McCubbins, Jinsil Seo
2020ICARCVPBDE: An Effective Method for Filtering False Positive Boxes in Object Detection.Zhishan Li, Baozhi Jia, Mingmu Chen, Shaokai Xu, Yifan He, Lei Xie
2020ICARCVLoss Constrains Added Squeeze and Excitation Blocks for Pruning Deep Neural Networks.Yiqin Wang, Ming Li, Hongye Su, Lei Xie, Xiaochen Li, Weihua Xu, Xiaozhou Xu
2020ICARCVBatch-Normalization-based Soft Filter Pruning for Deep Convolutional Neural Networks.Xiaozhou Xu, Qiming Chen, Lei Xie, Hongye Su
2020ICARCVExtracting fetal heart rate from abdominal ECGs based on fast multivariate empirical mode decomposition.Jiayue Zhang, Xiaozhou Xu, Qiming Chen, Lei Xie, Hongye Su
2020ICARCVGene Prediction by the Scale-limited Gabor Wavelet Transform for Identifying the Protein Coding Regions.Qian Zheng, Wenxiang Zhou, Tao Chen, Lei Xie, Hongye Su
2020ICASSPEffective Wavenet Adaptation for Voice Conversion with Limited Data.Hongqiang Du, Xiaohai Tian, Lei Xie, Haizhou Li
2020ICASSPTime-Domain Neural Network Approach for Speech Bandwidth Extension.Xiang Hao, Chenglin Xu, Nana Hou, Lei Xie, Eng Siong Chng, Haizhou Li
2020ICASSPMining Effective Negative Training Samples for Keyword Spotting.Jingyong Hou, Yangyang Shi, Mari Ostendorf, Mei-Yuh Hwang, Lei Xie
2020ICCCNRF-Detector: 3D Structure Detection of Tiny Objects via RFID Systems.Jingyi Ning, Lei Xie, Chuyu Wang, Yanling Bu, Baoliu Ye, Sanglu Lu
2020ICDCSElan: Towards Generic and Efficient Elastic Training for Deep Learning.Lei Xie, Jidong Zhai, Baodong Wu, Yuanbo Wang, Xingcheng Zhang, Peng Sun, Shengen Yan
2020IJCAIImproving Attention Mechanism in Graph Neural Networks via Cardinality Preservation.Shuo Zhang, Lei Xie
2020INFOCOMActivating Wireless Voice for E-Toll Collection Systems with Zero Start-up Cost.Zhenlin An, Qiongzheng Lin, Lei Yang, Lei Xie
2020INFOCOMPhysical-Layer Arithmetic for Federated Learning in Uplink MU-MIMO Enabled Wireless Networks.Tao Huang, Baoliu Ye, Zhihao Qu, Bin Tang, Lei Xie, Sanglu Lu
2020INFOCOMSpiderMon: Towards Using Cell Towers as Illuminating Sources for Keystroke Monitoring.Kang Ling, Yuntang Liu, Ke Sun, Wei Wang, Lei Xie, Qing Gu
2020INFOCOMRF-Rhythm: Secure and Usable Two-Factor RFID Authentication.Jiawei Li, Chuyu Wang, Ang Li, Dianqi Han, Yan Zhang, Jinhang Zuo, Rui Zhang, Lei Xie, Yanchao Zhang
2020InterspeechData Efficient Voice Cloning from Noisy Samples with Domain Adversarial Training.Jian Cong, Shan Yang, Lei Xie, Guoqiao Yu, Guanglu Wan
2020InterspeechDCCRN: Deep Complex Convolution Recurrent Network for Phase-Aware Speech Enhancement.Yanxin Hu, Yun Liu, Shubo Lv, Mengtao Xing, Shimin Zhang, Yihui Fu, Jian Wu, Bihong Zhang, Lei Xie
2020InterspeechChannel-Wise Subband Input for Better Voice and Accompaniment Separation on High Resolution Music.Haohe Liu, Lei Xie, Jian Wu, Geng Yang
2020InterspeechWake Word Detection with Alignment-Free Lattice-Free MMI.Yiming Wang, Hang Lv, Daniel Povey, Lei Xie, Sanjeev Khudanpur
2020InterspeechInaudible Adversarial Perturbations for Targeted Attack in Speaker Recognition.Qing Wang, Pengcheng Guo, Lei Xie
2020InterspeechAutoSpeech 2020: The Second Automated Machine Learning Challenge for Speech Classification.Jingsong Wang, Tom Ko, Zhen Xu, Xiawei Guo, Souxiang Liu, Wei-Wei Tu, Lei Xie
2020InterspeechAn End-to-End Architecture of Online Multi-Channel Speech Separation.Jian Wu, Zhuo Chen, Jinyu Li, Takuya Yoshioka, Zhili Tan, Ed Lin, Yi Luo, Lei Xie
2020InterspeechExploiting Deep Sentential Context for Expressive End-to-End Speech Synthesis.Fengyu Yang, Shan Yang, Qinghua Wu, Yujun Wang, Lei Xie
2019ASPDACMosaic: an automated synthesis flow for boolean logic based on memristor crossbar.Lei Xie
2019ASRULearning Hierarchical Representations for Expressive Speaking Style in End-to-End Speech Synthesis.Xiaochun An, Yuxuan Wang, Shan Yang, Zejun Ma, Lei Xie
2019ASRUIncremental Lattice Determinization for WFST Decoders.Zhehuai Chen, Mahsa Yarmohammadi, Hainan Xu, Hang Lv, Lei Xie, Daniel Povey, Sanjeev Khudanpur
2019ASRUWaveNet Factorization with Singular Value Decomposition for Voice Conversion.Hongqiang Du, Xiaohai Tian, Lei Xie, Haizhou Li
2019ASRUEspresso: A Fast End-to-End Neural Speech Recognition Toolkit.Yiming Wang, Sanjeev Khudanpur, Tongfei Chen, Hainan Xu, Shuoyang Ding, Hang Lv, Yiwen Shao, Nanyun Peng, Lei Xie, Shinji Watanabe
2019ASRUVirtual Adversarial Training for DS-CNN Based Small-Footprint Keyword Spotting.Xiong Wang, Sining Sun, Lei Xie
2019ASRUTime Domain Audio Visual Speech Separation.Jian Wu, Yong Xu, Shi-Xiong Zhang, Lianwu Chen, Meng Yu, Lei Xie, Dong Yu
2019ASRUImproving Mandarin End-to-End Speech Synthesis by Self-Attention and Learnable Gaussian Bias.Fengyu Yang, Shan Yang, Pengcheng Zhu, Pengju Yan, Lei Xie
2019ASRUVerifying Deep Keyword Spotting Detection with Acoustic Word Embeddings.Yougen Yuan, Zhiqiang Lv, Shen Huang, Lei Xie
2019ASRUControlling Emotion Strength with Relative Attribute for End-to-End Speech Synthesis.Xiaolian Zhu, Shan Yang, Geng Yang, Lei Xie
2019ICASSPAn Attention-based Neural Network Approach for Single Channel Speech Enhancement.Xiang Hao, Changhao Shan, Yong Xu, Sining Sun, Lei Xie
2019ICASSPDomain Adversarial Training for Improving Keyword Spotting Performance of ESL Speech.Jingyong Hou, Pengcheng Guo, Sining Sun, Frank K. Soong, Wenping Hu, Lei Xie
2019ICASSPComponent Fusion: Learning Replaceable Language Model Component for End-to-end Speech Recognition System.Changhao Shan, Chao Weng, Guangsen Wang, Dan Su, Min Luo, Dong Yu, Lei Xie
2019ICASSPInvestigating End-to-end Speech Recognition for Mandarin-english Code-switching.Changhao Shan, Chao Weng, Guangsen Wang, Dan Su, Min Luo, Dong Yu, Lei Xie
2019ICASSPAdversarial Examples for Improving End-to-end Attention-based Small-footprint Keyword Spotting.Xiong Wang, Sining Sun, Changhao Shan, Jingyong Hou, Lei Xie, Shen Li, Xin Lei
2019ICASSPA Pitch-aware Approach to Single-channel Speech Separation.Ke Wang, Frank K. Soong, Lei Xie
2019ICASSPEnhancing Hybrid Self-attention Structure with Relative-position-aware Bias for Speech Synthesis.Shan Yang, Heng Lu, Shiying Kang, Lei Xie, Dong Yu
2019ICASSPRobust Audio-visual Speech Recognition Using Bimodal Dfsmn with Multi-condition Training and Dropout Regularization.Shiliang Zhang, Ming Lei, Bin Ma, Lei Xie
2019ICMIDeep Audio-visual System for Closed-set Word-level Speech Recognition.Yougen Yuan, Wei Tang, Minhao Fan, Yue Cao, Peng Zhang, Lei Xie
2019ICPADSiShake: Imitation-Resistant Secure Pairing of Smart Devices via Shaking.Congcong Shi, Lei Xie, Chuyu Wang, Peicheng Yang, Yubo Song, Sanglu Lu
2019INFOCOMSpin-Antenna: 3D Motion Tracking for Tag Array Labeled Objects via Spinning Antenna.Chuyu Wang, Lei Xie, Keyan Zhang, Wei Wang, Yanling Bu, Sanglu Lu
2019InterspeechUnsupervised Adaptation with Adversarial Dropout Regularization for Robust Speech Recognition.Pengcheng Guo, Sining Sun, Lei Xie
2019InterspeechA New GAN-Based End-to-End TTS Training Algorithm.Haohan Guo, Frank K. Soong, Lei He, Lei Xie
2019InterspeechExploiting Syntactic Features in a Parsed Tree to Improve End-to-End TTS.Haohan Guo, Frank K. Soong, Lei He, Lei Xie
2019InterspeechAdversarial Regularization for End-to-End Robust Speaker Verification.Qing Wang, Pengcheng Guo, Sining Sun, Lei Xie, John H. L. Hansen
2019InterspeechImproved Speaker-Dependent Separation for CHiME-5 Challenge.Jian Wu, Yong Xu, Shi-Xiong Zhang, Lianwu Chen, Meng Yu, Lei Xie, Dong Yu
2019InterspeechBuilding a Mixed-Lingual Neural TTS System with Only Monolingual Data.Liumeng Xue, Wei Song, Guanghui Xu, Lei Xie, Zhizheng Wu
2018CSCWDA Cooperative Denoising Method Based on Total Variation and Discrete Wavelet Transform.Lei Xie, Tao Wu, Xi Chen, Jia He
2018DATEMemristive devices for computation-in-memory.Jintao Yu, Hoang Anh Du Nguyen, Lei Xie, Mottaqiallah Taouil, Said Hamdioui
2018ICASSPAttention-Based End-to-End Speech Recognition on Voice Search.Changhao Shan, Junbo Zhang, Yujun Wang, Lei Xie
2018ICASSPDomain Adversarial Training for Accented Speech Recognition.Sining Sun, Ching-Feng Yeh, Mei-Yuh Hwang, Mari Ostendorf, Lei Xie
2018ICASSPUnsupervised Domain Adaptation via Domain Adversarial Training for Speaker Recognition.Qing Wang, Wei Rao, Sining Sun, Lei Xie, Eng Siong Chng, Haizhou Li
2018INFOCOMRF-Dial: An RFID-based 2D Human-Computer Interaction via Tag Array.Yanling Bu, Lei Xie, Yinyin Gong, Chuyu Wang, Lei Yang, Jia Liu, Sanglu Lu
2018INFOCOMRobust Spinning Sensing with Dual-RFID-Tags in Noisy Settings.Chunhui Duan, Lei Yang, Huanyu Jia, Qiongzheng Lin, Yunhao Liu, Lei Xie
2018INFOCOMMulti - Touch in the Air: Device-Free Finger Tracking and Gesture Recognition via COTS RFID.Chuyu Wang, Jian Liu, Yingying Chen, Hongbo Liu, Lei Xie, Wei Wang, Bingbing He, Sanglu Lu
2018InterspeechStudy of Semi-supervised Approaches to Improving English-Mandarin Code-Switching Speech Recognition.Pengcheng Guo, Haihua Xu, Lei Xie, Eng Siong Chng
2018InterspeechAttention-based End-to-End Models for Small-Footprint Keyword Spotting.Changhao Shan, Junbo Zhang, Yujun Wang, Lei Xie
2018InterspeechTraining Augmentation with Adversarial Examples for Robust Speech Recognition.Sining Sun, Ching-Feng Yeh, Mari Ostendorf, Mei-Yuh Hwang, Lei Xie
2018InterspeechInvestigating Generative Adversarial Networks Based Speech Dereverberation for Robust Speech Recognition.Ke Wang, Junbo Zhang, Sining Sun, Yujun Wang, Fei Xiang, Lei Xie
2018InterspeechEmpirical Evaluation of Speaker Adaptation on DNN Based Acoustic Model.Ke Wang, Junbo Zhang, Yujun Wang, Lei Xie
2017ASRUMultilingual bottle-neck feature learning from untranscribed speech.Hongjie Chen, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li
2017ASRUStatistical parametric speech synthesis using generative adversarial networks under a multi-task learning framework.Shan Yang, Lei Xie, Xiao Chen, Xiaoyan Lou, Xuan Zhu, Dongyan Huang, Haizhou Li
2017ASRUExtracting bottleneck features and word-like pairs from untranscribed speech for feature representation.Yougen Yuan, Cheung-Chi Leung, Lei Xie, Hongjie Chen, Bin Ma, Haizhou Li
2017DATEMemristor for computing: Myth or reality?Said Hamdioui, Shahar Kvatinsky, Gert Cauwenberghs, Lei Xie, Nimrod Wald, Siddharth Joshi, Hesham Mostafa Elsayed, Henk Corporaal, Koen Bertels
2017DDECSOn the robustness of memristor based logic gates.Lei Xie, Hoang Anh Du Nguyen, Jintao Yu, Mottaqiallah Taouil, Said Hamdioui
2017ICASSPPairwise learning using multi-lingual bottleneck features for low-resource query-by-example spoken term detection.Yougen Yuan, Cheung-Chi Leung, Lei Xie, Hongjie Chen, Bin Ma, Haizhou Li
2017ICDCSSmartphone Privacy Leakage of Social Relationships and Demographics from Surrounding Access Points.Chen Wang, Chuyu Wang, Yingying Chen, Lei Xie, Sanglu Lu
2017IGARSSAn optimized K-means clustering algorithm based on BC-QPSO for remote sensing image.Tao Wu, Xi Chen, Lei Xie, Zhongquan Qiu
2017INFOCOMMeta-activity recognition: A wearable approach for logic cognition-based activity sensing.Lei Xie, Xu Dong, Wei Wang, Dawei Huang
2017InterspeechEmpirical Evaluation of Parallel Training Algorithms on Acoustic Modeling.Wenpeng Li, Binbin Zhang, Lei Xie, Dong Yu
2017InterspeechDenoising Recurrent Neural Network for Deep Bidirectional LSTM Based Voice Conversion.Jie Wu, Dong-Yan Huang, Lei Xie, Haizhou Li
2016ICASSPExemplar-based sparse representation of timbre and prosody for voice conversion.Huaiping Ming, Dong-Yan Huang, Lei Xie, Shaofei Zhang, Minghui Dong, Haizhou Li
2016ICASSPApproximate search of audio queries by using DTW with phone time boundary and data augmentation.Haihua Xu, Jingyong Hou, Xiong Xiao, Van Tung Pham, Cheung-Chi Leung, Lei Wang, Van Hai Do, Hang Lv, Lei Xie, Bin Ma, Eng Siong Chng, Haizhou Li
2016ICDCSRF-ISee: Identify and Distinguish Multiple RFID Tagged Objects in Augmented Reality Systems.Jianqiang Sun, Lei Xie, Qingliang Cai, Chuyu Wang, Jie Wu, Sanglu Lu
2016IGARSSMonitoring permafrost soil moisture with multi-temporal TERRASAR-X data in northern tibet.Chao Wang, Hong Zhang, Qingbai Wu, Zhengjia Zhang, Lei Xie
2016IGARSSUrban land cover change types identification using fully polarimetric SAR descriptors.Lei Xie, Hong Zhang, Chao Wang
2016IGARSSBiomass estimation of oilseed rape using simulated compact polarimtric SAR imagery.Hao Yang, Lei Xie, Erxue Chen, Hong Zhang, Guijun Yang, Zhenhong Li, Xiaohe Gu
2016INFOCOMMoving tag detection via physical layer analysis for large-scale RFID systems.Chuyu Wang, Lei Xie, Wei Wang, Tao Xue, Sanglu Lu
2016INFOCOMCamK: A camera-based keyboard for small mobile devices.Yafeng Yin, Qun Li, Lei Xie, Shanhe Yi, Edmund Novak, Sanglu Lu
2016InterspeechUnsupervised Bottleneck Features for Low-Resource Query-by-Example Spoken Term Detection.Hongjie Chen, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li
2016InterspeechToward High-Performance Language-Independent Query-by-Example Spoken Term Detection for MediaEval 2015: Post-Evaluation Analysis.Cheung-Chi Leung, Lei Wang, Haihua Xu, Jingyong Hou, Van Tung Pham, Hang Lv, Lei Xie, Xiong Xiao, Chongjia Ni, Bin Ma, Eng Siong Chng, Haizhou Li
2016InterspeechDeep Bidirectional LSTM Modeling of Timbre and Prosody for Emotional Voice Conversion.Huaiping Ming, Dong-Yan Huang, Lei Xie, Jie Wu, Minghui Dong, Haizhou Li
2015ACIIFundamental frequency modeling using wavelets for emotional voice conversion.Huaiping Ming, Dong-Yan Huang, Minghui Dong, Haizhou Li, Lei Xie, Shaofei Zhang
2015ASRUAutomatic prosody prediction for Chinese speech synthesis using BLSTM-RNN and embedding features.Chuang Ding, Lei Xie, Jie Yan, Weini Zhang, Yang Liu
2015DATEMemristor based computation-in-memory architecture for data-intensive applications.Said Hamdioui, Lei Xie, Hoang Anh Du Nguyen, Mottaqiallah Taouil, Koen Bertels, Henk Corporaal, Hailong Jiao, Francky Catthoor, Dirk J. Wouters, Eike Linn, Jan van Lunteren
2015ICASSPPhoto-real talking head with deep bidirectional LSTM.Bo Fan, Lijuan Wang, Frank K. Soong, Lei Xie
2015ICASSPLanguage independent query-by-example spoken term detection using N-best phone sequences and partial matching.Haihua Xu, Peng Yang, Xiong Xiao, Lei Xie, Cheung-Chi Leung, Hongjie Chen, Jia Yu, Hang Lv, Lei Wang, Su Jun Leow, Bin Ma, Engsiong Chng, Haizhou Li
2015ICCDFast boolean logic mapped on memristor crossbar.Lei Xie, Hoang Anh Du Nguyen, Mottaqiallah Taouil, Koen Bertels, Said Hamdioui
2015INFOCOMFemto-matching: Efficient traffic offloading in heterogeneous cellular networks.Wei Wang, Xiaobing Wu, Lei Xie, Sanglu Lu
2015InterspeechParallel inference of dirichlet process Gaussian mixture models for unsupervised acoustic modeling: a feasibility study.Hongjie Chen, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li
2015InterspeechBLSTM neural networks for speech driven head motion synthesis.Chuang Ding, Pengcheng Zhu, Lei Xie
2015InterspeechAn alternating optimization approach for phase retrieval.Huaiping Ming, Dong-Yan Huang, Lei Xie, Haizhou Li, Minghui Dong
2014ICASSPUnsupervised broadcast news story segmentation using distance dependent Chinese restaurant processes.Chao Yang, Lei Xie, Xiangzeng Zhou
2014ICCCNAn energy efficient algorithm based on multi-topology routing in IP networks.Lei Xie, Xiaoning Zhang, Sheng Wang
2014ICIPAn ensemble of deep neural networks for object tracking.Xiangzeng Zhou, Lei Xie, Peng Zhang, Yanning Zhang
2014INFOCOMEfficiently collecting histograms over RFID tags.Lei Xie, Hao Han, Qun Li, Jie Wu, Sanglu Lu
2014InterspeechSpeech-driven head motion synthesis using neural networks.Chuang Ding, Pengcheng Zhu, Lei Xie, Dongmei Jiang, Zhong-Hua Fu
2014InterspeechStereo acoustic echo suppression using widely linear filtering in the frequency domain.Zhong-Hua Fu, Lei Xie
2014InterspeechA deep neural network approach for sentence boundary detection in broadcast news.Chenglin Xu, Lei Xie, Guangpu Huang, Xiong Xiao, Engsiong Chng, Haizhou Li
2014InterspeechIntrinsic spectral analysis based on temporal context features for query-by-example spoken term detection.Peng Yang, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li
2013ACLBroadcast News Story Segmentation Using Manifold Learning on Latent Topic Distributions.Xiaoming Lu, Lei Xie, Cheung-Chi Leung, Bin Ma, Haizhou Li
2013GLOBECOMAn efficient indoor navigation scheme using RFID-based delay tolerant network.Hao Ji, Lei Xie, Yafeng Yin, Sanglu Lu
2013IAAICase-Based Meta-Prediction for Bioinformatics.Xi Yun, Susan L. Epstein, Weiwei Han, Lei Xie
2013ICASSPBroadcast news story segmentation using latent topics on data manifold.Xiaoming Lu, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li
2013ICASSPMeasuring semantic similarity by contextualword connections in Chinese news story segmentation.Xuecheng Nie, Wei Feng, Liang Wan, Lei Xie
2013ICASSPA tighter lower bound estimate for dynamic time warping.Peng Yang, Lei Xie, Qiao Luan, Wei Feng
2013ICASSPA two layered data association approach for ball tracking.Xiangzeng Zhou, Qiang Huang, Lei Xie, Stephen J. Cox
2013ICCBRMulti-Agent, Multi-Case-Based Reasoning.Susan L. Epstein, Xi Yun, Lei Xie
2013ICCCNEfficient Protocols for Rule Checking in RFID Systems.Yafeng Yin, Lei Xie, Sanglu Lu, Daoxu Chen
2013ICPADSAdaptive Accurate Indoor-Localization Using Passive RFID.Xi Chen, Lei Xie, Chuyu Wang, Sanglu Lu
2013IGARSSA new compact three-component decomposition scheme.Lei Xie, Hong Zhang, Chao Wang, Bo Zhang, Fan Wu, Yixian Tang
2012GLOBECOMEffective capacity region in a wireless multiuser OFDMA network.Xiao Han, Huifang Chen, Lei Xie, Kuang Wang
2012ICASSPAcoustic TextTiling for story segmentation of spoken documents.Lilei Zheng, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li
2012InterspeechLexical Story Co-Segmentation of Chinese Broadcast News.Wei Feng, Xuecheng Nie, Liang Wan, Lei Xie, Jianmin Jiang
2012InterspeechSpeech Pattern Discovery using Audio-Visual Fusion and Canonical Correlation Analysis.Lei Xie, Yinqing Xu, Lilei Zheng, Qiang Huang, Bingfeng Li
2011InterspeechProbabilistic Latent Semantic Analysis for Broadcast News Story Segmentation.Mimi Lu, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li
2010INFOCOMEfficient Tag Identification in Mobile RFID Systems.Lei Xie, Bo Sheng, Chiu C. Tan, Hao Han, Qun Li, Daoxu Chen
2010InterspeechMaximum lexical cohesion for fine-grained news story segmentation.Zihan Liu, Lei Xie, Wei Feng
2010InterspeechPhoneme lattice based texttiling towards multilingual story segmentation.Xiaoxuan Wang, Lei Xie, Bin Ma, Engsiong Chng, Haizhou Li
2009ACCVMulticue Graph Mincut for Image Segmentation.Wei Feng, Lei Xie, Zhi-Qiang Liu
2009ICNPAchieving Efficiency and Fairness for Association Control in Vehicular Networks.Lei Xie, Qun Li, Weizhen Mao, Jie Wu, Daoxu Chen
2009ICPADSA Decentralized Storage Scheme for Multi-Dimensional Range Queries over Sensor Networks.Lei Xie, Lijun Chen, Daoxu Chen, Li Xie
2008GLOBECOMEEBASS: Energy-Efficient Balanced Storage Scheme for Sensor Networks.Lei Xie, Lijun Chen, Daoxu Chen, Li Xie
2007InterspeechModeling the statistical behavior of lexical chains to capture word cohesiveness for automatic story segmentation.Shing-kai Chan, Lei Xie, Helen M. Meng
2006ICASSPAn Articulatory Approach to Video-Realistic Mouth Animation.Lei Xie, Zhi-Qiang Liu
2006ICPRSpeech Animation Using Coupled Hidden Markov Models.Lei Xie, Zhi-Qiang Liu
2005ICMLCMulti-stream Articulator Model with Adaptive Reliability Measure for Audio Visual Speech Recognition.Lei Xie, Zhi-Qiang Liu