| 2026 | AAAI | WenetSpeech-Yue: A Large-Scale Cantonese Speech Corpus with Multi-dimensional Annotation. | Longhao Li, Zhao Guo, Hongjie Chen, Yuhang Dai, Ziyu Zhang, Hongfei Xue, Tianlun Zuo, Chengyou Wang, Shuiyuan Wang, Xin Xu, Hui Bu, Jie Li, Jian Kang, Binbin Zhang, Ruibin Yuan, Ziya Zhou, Wei Xue, Lei Xie |
| 2026 | AAAI | Hearing More with Less: Multi-Modal Retrieval-and-Selection Augmented Conversational LLM-Based ASR. | Bingshen Mu, Hexin Liu, Hongfei Xue, Kun Wei, Lei Xie |
| 2026 | AAAI | KALL-E: Autoregressive Speech Synthesis with Next-Distribution Prediction. | Kangxiang Xia, Xinfa Zhu, Jixun Yao, Wenjie Tian, Wenhao Li, Lei Xie |
| 2026 | ACL | LLM-ForcedAligner: A Non-Autoregressive and Accurate LLM-Based Forced Aligner for Multilingual and Long-Form Speech. | Bingshen Mu, Xian Shi, Xiong Wang, Hexin Liu, Jin Xu, Lei Xie |
| 2026 | ACL | WenetSpeech-Wu: Datasets, Benchmarks, and Models for a Unified Chinese Wu Dialect Speech Processing Ecosystem. | Chengyou Wang, Mingchen Shao, Jingbin Hu, Zeyu Zhu, Hongfei Xue, Bingshen Mu, Xin Xu, Xingyi Duan, Binbin Zhang, Pengcheng Zhu, Chuang Ding, Xiaojun Zhang, Hui Bu, Lei Xie |
| 2026 | ICDCS | Tackling the Runtime Context Fluctuation: Steady Scheduling in Data Stream Analytics for Industrial Internet of Things. | Shuyu Cao, Wenhui Zhou, Jingyi Ning, Lei Xie |
| 2026 | INFOCOM | RF-Gaussmeter: Noninvasive μT-level Magnetic Field Sensing using TMR-based RFID Tag. | Shiyuan Ma, Lei Xie, Chuyu Wang, Wei Wang, Yu He, Sanglu Lu |
| 2026 | INFOCOM | Large-Field-of-View Measurement of Fabric Density Based on Moir Pattern for Industrial IoT. | Zhaowei Wu, Jingyi Ning, Zhihao Yan, Jialu Xu, Lei Xie |
| 2026 | INFOCOM | Tackling the Imbalance in Video Analytics Pipelines with Hierarchical Embodied Intelligence. | Wenhui Zhou, Lei Xie, Jingyi Ning, Shuyu Cao, Hao Wu, Qinghua Peng, Long Fan |
| 2025 | AAAI | Drop the Beat! Freestyler for Accompaniment Conditioned Rapping Voice Generation. | Ziqian Ning, Shuai Wang, Yuepeng Jiang, Jixun Yao, Lei He, Shifeng Pan, Jie Ding, Lei Xie |
| 2025 | AAAI | StableVC: Style Controllable Zero-Shot Voice Conversion with Conditional Flow Matching. | Jixun Yao, Yuguang Yang, Yu Pan, Ziqian Ning, Jianhao Ye, Hongbin Zhou, Lei Xie |
| 2025 | ACL | Takin-VC: Expressive Zero-Shot Voice Conversion via Adaptive Hybrid Content Encoding and Enhanced Timbre Modeling. | Yuguang Yang, Yu Pan, Jixun Yao, Xiang Zhang, Jianhao Ye, Hongbin Zhou, Lei Xie, Lei Ma, Jianjun Zhao |
| 2025 | ACL | LLaSE-G1: Incentivizing Generalization Capability for LLaMA-based Speech Enhancement. | Boyi Kang, Xinfa Zhu, Zihan Zhang, Zhen Ye, Mingshuai Liu, Ziqian Wang, Yike Zhu, Guobin Ma, Jun Chen, Longshuai Xiao, Chao Weng, Wei Xue, Lei Xie |
| 2025 | ASRU | DiffRhythm+: Controllable and Flexible Full-Length Song Generation with Preference Optimization. | Huakang Chen, Yuepeng Jiang, Guobin Ma, Chunbo Hao, Shuai Wang, Jixun Yao, Ziqian Ning, Meng Meng, Jian Luan, Lei Xie |
| 2025 | ASRU | REF-VC: Robust, Expressive and Fast Zero-Shot Voice Conversion with Diffusion Transformers. | Yuepeng Jiang, Ziqian Ning, Shuai Wang, Chengjia Wang, Mengxiao Bi, Pengcheng Zhu, Zhonghua Fu, Lei Xie |
| 2025 | ASRU | Efficient Scaling for LLM-based ASR. | Bingshen Mu, Yiwen Shao, Kun Wei, Dong Yu, Lei Xie |
| 2025 | ASRU | Llasa+: Free Lunch for Accelerated and Streaming Llama-Based Speech Synthesis. | Wenjie Tian, Xinfa Zhu, Hanke Xie, Zhen Ye, Wei Xue, Lei Xie |
| 2025 | ASRU | XEmoRAG: Cross-Lingual Emotion Transfer with Controllable Intensity Using Retrieval-Augmented Generation. | Tianlun Zuo, Jingbin Hu, Yuke Li, Xinfa Zhu, Hai Li, Ying Yan, Junhui Liu, Danming Xie, Lei Xie |
| 2025 | CVPR | MobileMamba: Lightweight Multi-Receptive Visual Mamba Network. | Haoyang He, Jiangning Zhang, Yuxuan Cai, Hongxu Chen, Xiaobin Hu, Zhenye Gan, Yabiao Wang, Chengjie Wang, Yunsheng Wu, Lei Xie |
| 2025 | EMNLP | PVTNL: Prompting Vision Transformers with Natural Language for Generalizable Person Re-identification. | Ning Wang, Lei Xie, Sanglu Lu, Shiwei Gan |
| 2025 | ICASSP | CAMEL: Cross-Attention Enhanced Mixture-of-Experts and Language Bias for Code-Switching Speech Recognition. | He Wang, Xucheng Wan, Naijun Zheng, Kai Liu, Huan Zhou, Guojian Li, Lei Xie |
| 2025 | ICASSP | HDMoLE: Mixture of LoRA Experts with Hierarchical Routing and Dynamic Thresholds for Fine-Tuning LLM-based ASR Models. | Bingshen Mu, Kun Wei, Qijie Shao, Yong Xu, Lei Xie |
| 2025 | ICASSP | DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification. | Qing Wang, Jixun Yao, Zhaokai Sun, Pengcheng Guo, Lei Xie, John H. L. Hansen |
| 2025 | ICASSP | ZSVC: Zero-shot Style Voice Conversion with Disentangled Latent Diffusion Models and Adversarial Training. | Xinfa Zhu, Lei He, Yujia Xiao, Xi Wang, Xu Tan, Sheng Zhao, Lei Xie |
| 2025 | ICCV | A Comprehensive Library for Benchmarking Multi-Class Visual Anomaly Detection. | Jiangning Zhang, Haoyang He, Zhenye Gan, Qingdong He, Yuxuan Cai, Zhucun Xue, Yabiao Wang, Chengjie Wang, Lei Xie, Yong Liu |
| 2025 | ICDCS | Towards Visual-Inertial Integration: Multi-Modal Collaboration-based Video Stabilization. | Chaoran Li, Yanling Bu, Lei Xie |
| 2025 | ICDCS | mmUAVsense: mmWave Radar-based UAV Detection via Fine-grained Rotary Sensing. | Wenhao Xu, Chuyu Wang, Qiancheng Jin, Yanling Bu, Lei Xie, Sanglu Lu |
| 2025 | ICLR | GenSE: Generative Speech Enhancement via Language Models using Hierarchical Modeling. | Jixun Yao, Hexin Liu, Chen Chen, Yuchen Hu, Eng Siong Chng, Lei Xie |
| 2025 | ICML | Freeze-Omni: A Smart and Low Latency Speech-to-speech Dialogue Model with Frozen LLM. | Xiong Wang, Yangze Li, Chaoyou Fu, Yike Zhang, Yunhang Shen, Lei Xie, Ke Li, Xing Sun, Long Ma |
| 2025 | ICPADS | IMUWatermark: A Blind and Robust Backdoor Watermark via Frequency-Domain Injection. | Lei Xie, Xiulong Liu, Xin Xie, Kaixuan Zhang, Qixuan Cai, Xinyu Tong, Zheng Gong, Keqiu Li |
| 2025 | ICRA | RLPP: A Residual Method for Zero-Shot Real-World Autonomous Racing on Scaled Platforms. | Edoardo Ghignone, Nicolas Baumann, Cheng Hu, Jonathan Wang, Lei Xie, Andrea Carron, Michele Magno |
| 2025 | ICRA | A Data-Driven Aggressive Autonomous Racing Framework Utilizing Local Trajectory Planning with Velocity Prediction. | Zhouheng Li, Bei Zhou, Cheng Hu, Lei Xie, Hongye Su |
| 2025 | IJCNN | TSDA: A Temporal-Spatial Data Augmentation for Human Pose Recognition in Point Cloud. | Ning Wang, Lei Xie, Chuyu Wang, Sanglu Lu, Long Fan |
| 2025 | INFOCOM | SweaTag: Fine-Grained Sweat Amount Sensing with COTS RFID Tags. | Zhongkang Qiao, Chuyu Wang, Lei Xie, Yuanmin Chen, Sanglu Lu |
| 2025 | Interspeech | AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition. | Yuhang Dai, He Wang, Xingchen Li, Zihan Zhang, Shuiyuan Wang, Lei Xie, Xin Xu, Hongxiao Guo, Shaoji Zhang, Hui Bu, Wei Chen |
| 2025 | Interspeech | CabinSep: IR-Augmented Mask-Based MVDR for Real-Time In-car Speech Separation with Distributed Heterogeneous Arrays. | Runduo Han, Yanxin Hu, Yihui Fu, Zihan Zhang, Yukai Jv, Li Chen, Lei Xie |
| 2025 | Interspeech | Delayed-KD: Delayed Knowledge Distillation based CTC for Low-Latency Streaming ASR. | Longhao Li, Yangze Li, Hongfei Xue, Jie Liu, Shuai Fang, Kai Wang, Lei Xie |
| 2025 | Interspeech | Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation. | Zhennan Lin, Kaixun Huang, Wei Ren, Linju Yang, Lei Xie |
| 2025 | Interspeech | Weakly Supervised Data Refinement and Flexible Sequence Compression for Efficient Thai LLM-based ASR. | Mingchen Shao, Xinfa Zhu, Chengyou Wang, Bingshen Mu, Hai Li, Ying Yan, Junhui Liu, Danming Xie, Lei Xie |
| 2025 | Interspeech | Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM. | Zhaokai Sun, Li Zhang, Qing Wang, Pan Zhou, Lei Xie |
| 2025 | Interspeech | FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching. | Ziqian Wang, Zikai Liu, Xinfa Zhu, Yike Zhu, Mingshuai Liu, Jun Chen, Longshuai Xiao, Chao Weng, Lei Xie |
| 2025 | Interspeech | U-SAM: An Audio Language Model for Unified Speech, Audio, and Music Understanding. | Ziqian Wang, Xianjun Xia, Xinfa Zhu, Lei Xie |
| 2025 | Interspeech | Leveraging LLM and Self-Supervised Training Models for Speech Recognition in Chinese Dialects: A Comparative Analysis. | Tianyi Xu, Hongjie Chen, Qing Wang, Hang Lv, Jian Kang, Jie Li, Zhennan Lin, Yongxiang Li, Lei Xie |
| 2025 | Interspeech | Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty. | Hongfei Xue, Yufeng Tang, Jun Zhang, Xuelong Geng, Lei Xie |
| 2025 | Interspeech | EASY: Emotion-aware Speaker Anonymization via Factorized Distillation. | Jixun Yao, Hexin Liu, Eng Siong Chng, Lei Xie |
| 2024 | AAAI | A Diffusion-Based Framework for Multi-Class Anomaly Detection. | Haoyang He, Jiangning Zhang, Hongxu Chen, Xuhai Chen, Zhishan Li, Xu Chen, Yabiao Wang, Chengjie Wang, Lei Xie |
| 2024 | ACL | StreamVoice: Streamable Context-Aware Language Modeling for Real-time Zero-Shot Voice Conversion. | Zhichao Wang, Yuanzhe Chen, Xinsheng Wang, Lei Xie, Yuping Wang |
| 2024 | CVPR | SignGraph: A Sign Sequence is Worth Graphs of Nodes. | Shiwei Gan, Yafeng Yin, Zhiwei Jiang, Hongkai Wen, Lei Xie, Sanglu Lu |
| 2024 | ICASSP | An Audio-Quality-Based Multi-Strategy Approach For Target Speaker Extraction in the Misp 2023 Challenge. | Runduo Han, Xiaopeng Yan, Weiming Xu, Pengcheng Guo, Jiayao Sun, He Wang, Quan Lu, Ning Jiang, Lei Xie |
| 2024 | ICASSP | Rad-Net: A Repairing and Denoising Network for Speech Signal Improvement. | Mingshuai Liu, Zhuangqi Chen, Xiaopeng Yan, Yuanjun Lv, Xianjun Xia, Chuanzeng Huang, Yijian Xiao, Lei Xie |
| 2024 | ICASSP | Spontts: Modeling and Transferring Spontaneous Style for TTS. | Hanzhao Li, Xinfa Zhu, Liumeng Xue, Yang Song, Yunlin Chen, Lei Xie |
| 2024 | ICASSP | Automatic Channel Selection and Spatial Feature Integration for Multi-Channel Speech Recognition Across Various Array Topologies. | Bingshen Mu, Pengcheng Guo, Dake Guo, Pan Zhou, Wei Chen, Lei Xie |
| 2024 | ICASSP | Dualvc 2: Dynamic Masked Convolution for Unified Streaming and Non-Streaming Voice Conversion. | Ziqian Ning, Yuepeng Jiang, Pengcheng Zhu, Shuai Wang, Jixun Yao, Lei Xie, Mengxiao Bi |
| 2024 | ICASSP | ICMC-ASR: The ICASSP 2024 In-Car Multi-Channel Automatic Speech Recognition Challenge. | He Wang, Pengcheng Guo, Yue Li, Ao Zhang, Jiayao Sun, Lei Xie, Wei Chen, Pan Zhou, Hui Bu, Xin Xu, Binbin Zhang, Zhuo Chen, Jian Wu, Longbiao Wang, Eng Siong Chng, Sun Li |
| 2024 | ICASSP | MLCA-AVSR: Multi-Layer Cross Attention Fusion Based Audio-Visual Speech Recognition. | He Wang, Pengcheng Guo, Pan Zhou, Lei Xie |
| 2024 | ICASSP | SELM: Speech Enhancement using Discrete Tokens and Language Models. | Ziqian Wang, Xinfa Zhu, Zihan Zhang, Yuanjun Lv, Ning Jiang, Guoqing Zhao, Lei Xie |
| 2024 | ICASSP | Promptvc: Flexible Stylistic Voice Conversion in Latent Space Driven by Natural Language Prompts. | Jixun Yao, Yuguang Yang, Yi Lei, Ziqian Ning, Yanni Hu, Yu Pan, Jingjing Yin, Hongbin Zhou, Heng Lu, Lei Xie |
| 2024 | ICASSP | Bs-Plcnet: Band-Split Packet Loss Concealment Network with Multi-Task Learning Framework and Multi-Discriminators. | Zihan Zhang, Jiayao Sun, Xianjun Xia, Chuanzeng Huang, Yijian Xiao, Lei Xie |
| 2024 | ICDCS | LED Can Backscatter: Multi-Modal Based 3D Localization via LED-Tag. | Shiyuan Ma, Lei Xie, Chuyu Wang, Long Fan, Jingyi Ning, Qing Guo, Baoliu Ye, Sanglu Lu |
| 2024 | Interspeech | Streaming Decoder-Only Automatic Speech Recognition with Discrete Speech Units: A Pilot Study. | Peikun Chen, Sining Sun, Changhao Shan, Qing Yang, Lei Xie |
| 2024 | Interspeech | AS-70: A Mandarin stuttered speech dataset for automatic speech recognition and stuttering event detection. | Rong Gong, Hongfei Xue, Lezhi Wang, Xin Xu, Qisheng Li, Lei Xie, Hui Bu, Shaomei Wu, Jiaming Zhou, Yong Qin, Binbin Zhang, Jun Du, Jia Bin, Ming Li |
| 2024 | Interspeech | Text-aware and Context-aware Expressive Audiobook Speech Synthesis. | Dake Guo, Xinfa Zhu, Liumeng Xue, Yongmao Zhang, Wenjie Tian, Lei Xie |
| 2024 | Interspeech | Towards Expressive Zero-Shot Speech Synthesis with Hierarchical Prosody Modeling. | Yuepeng Jiang, Tao Li, Fengyu Yang, Lei Xie, Meng Meng, Yujun Wang |
| 2024 | Interspeech | RaD-Net 2: A causal two-stage repairing and denoising speech enhancement network with knowledge distillation and complex axial self-attention. | Mingshuai Liu, Zhuangqi Chen, Xiaopeng Yan, Yuanjun Lv, Xianjun Xia, Chuanzeng Huang, Yijian Xiao, Lei Xie |
| 2024 | Interspeech | A Transcription Prompt-based Efficient Audio Large Language Model for Robust Speech Recognition. | Yangze Li, Xiong Wang, Songjun Cao, Yike Zhang, Long Ma, Lei Xie |
| 2024 | Interspeech | SCDNet: Self-supervised Learning Feature based Speaker Change Detection. | Yue Li, Xinsheng Wang, Li Zhang, Lei Xie |
| 2024 | Interspeech | Single-Codec: Single-Codebook Speech Codec towards High-Performance Speech Generation. | Hanzhao Li, Liumeng Xue, Haohan Guo, Xinfa Zhu, Yuanjun Lv, Lei Xie, Yunlin Chen, Hao Yin, Zhifei Li |
| 2024 | Interspeech | FreeV: Free Lunch For Vocoders Through Pseudo Inversed Mel Filter. | Yuanjun Lv, Hai Li, Ying Yan, Junhui Liu, Danming Xie, Lei Xie |
| 2024 | Interspeech | WenetSpeech4TTS: A 12, 800-hour Mandarin TTS Corpus for Large Speech Generation Model Benchmark. | Linhan Ma, Dake Guo, Kun Song, Yuepeng Jiang, Shuai Wang, Liumeng Xue, Weiming Xu, Huan Zhao, Binbin Zhang, Lei Xie |
| 2024 | Interspeech | Vec-Tok-VC+: Residual-enhanced Robust Zero-shot Voice Conversion with Progressive Constraints in a Dual-mode Training Strategy. | Linhan Ma, Xinfa Zhu, Yuanjun Lv, Zhichao Wang, Ziqian Wang, Wendi He, Hongbin Zhou, Lei Xie |
| 2024 | Interspeech | SEQ-former: A context-enhanced and efficient automatic speech recognition framework. | Qinglin Meng, Min Liu, Kaixun Huang, Kun Wei, Lei Xie, Zongfeng Quan, Weihong Deng, Quan Lu, Ning Jiang, Guoqing Zhao |
| 2024 | Interspeech | DualVC 3: Leveraging Language Model Generated Pseudo Context for End-to-end Low Latency Streaming Voice Conversion. | Ziqian Ning, Shuai Wang, Pengcheng Zhu, Zhichao Wang, Jixun Yao, Lei Xie, Mengxiao Bi |
| 2024 | Interspeech | Towards Rehearsal-Free Multilingual ASR: A LoRA-based Case Study on Whisper. | Tianyi Xu, Kaixun Huang, Pengcheng Guo, Yu Zhou, Longtao Huang, Hui Xue, Lei Xie |
| 2023 | AAAI | UniSyn: An End-to-End Unified Model for Text-to-Speech and Singing Voice Synthesis. | Yi Lei, Shan Yang, Xinsheng Wang, Qicong Xie, Jixun Yao, Lei Xie, Dan Su |
| 2023 | ASRU | BA-MoE: Boundary-Aware Mixture-of-Experts Adapter for Code-Switching Speech Recognition. | Peikun Chen, Fan Yu, Yuhao Liang, Hongfei Xue, Xucheng Wan, Naijun Zheng, Huan Zhou, Lei Xie |
| 2023 | ASRU | HIGNN-TTS: Hierarchical Prosody Modeling With Graph Neural Networks for Expressive Long-Form TTS. | Dake Guo, Xinfa Zhu, Liumeng Xue, Tao Li, Yuanjun Lv, Yuepeng Jiang, Lei Xie |
| 2023 | ASRU | Spike-Triggered Contextual Biasing for End-to-End Mandarin Speech Recognition. | Kaixun Huang, Ao Zhang, Binbin Zhang, Tianyi Xu, Xingchen Song, Lei Xie |
| 2023 | ASRU | The Second Multi-Channel Multi-Party Meeting Transcription Challenge (M2MeT 2.0): A Benchmark for Speaker-Attributed ASR. | Yuhao Liang, Mohan Shi, Fan Yu, Yangze Li, Shiliang Zhang, Zhihao Du, Qian Chen, Lei Xie, Yanmin Qian, Jian Wu, Zhuo Chen, Kong Aik Lee, Zhijie Yan, Hui Bu |
| 2023 | ASRU | Sa-Paraformer: Non-Autoregressive End-To-End Speaker-Attributed ASR. | Yangze Li, Fan Yu, Yuhao Liang, Pengcheng Guo, Mohan Shi, Zhihao Du, Shiliang Zhang, Lei Xie |
| 2023 | ASRU | Zero-Shot Emotion Transfer for Cross-Lingual Speech Synthesis. | Yuke Li, Xinfa Zhu, Yi Lei, Hai Li, Junhui Liu, Danming Xie, Lei Xie |
| 2023 | ASRU | Salt: Distinguishable Speaker Anonymization Through Latent Space Transformation. | Yuanjun Lv, Jixun Yao, Peikun Chen, Hongbin Zhou, Heng Lu, Lei Xie |
| 2023 | ASRU | Vits-Based Singing Voice Conversion Leveraging Whisper and Multi-Scale F0 Modeling. | Ziqian Ning, Yuepeng Jiang, Zhichao Wang, Bin Zhang, Lei Xie |
| 2023 | ASRU | MBTFNET: Multi-Band Temporal-Frequency Neural Network for Singing Voice Enhancement. | Weiming Xu, Zhouxuan Chen, Zhili Tan, Shubo Lv, Runduo Han, Wenjiang Zhou, Weifeng Zhao, Lei Xie |
| 2023 | ASRU | Promptspeaker: Speaker Generation Based on Text Descriptions. | Yongmao Zhang, Guanghou Liu, Yi Lei, Yunlin Chen, Hao Yin, Lei Xie, Zhifei Li |
| 2023 | ASRU | An Exploration of Task-Decoupling on Two-Stage Neural Post Filter for Real-Time Personalized Acoustic Echo Cancellation. | Zihan Zhang, Jiayao Sun, Xianjun Xia, Ziqian Wang, Xiaopeng Yan, Yijian Xiao, Lei Xie |
| 2023 | ASRU | U2-KWS: Unified Two-Pass Open-Vocabulary Keyword Spotting with Keyword Bias. | Ao Zhang, Pan Zhou, Kaixun Huang, Yong Zou, Ming Liu, Lei Xie |
| 2023 | FIE | Application of Organizational Systems Theory to Identify Education and Training Needs for Industry 4.0. | Mx. K. Pomeroy, Shaoping Qiu, Lei Xie, Malini Natarajathinam, Michael Johnson |
| 2023 | GLOBECOM | Joint BS Selection, User Association, and Beamforming Design for Network Integrated Sensing and Communication. | Yiming Xu, Dongfang Xu, Lei Xie, Shenghui Song |
| 2023 | ICASSP | A Hybrid Deep Neural Network for Nonlinear Causality Analysis in Complex Industrial Control System. | Tian Feng, Qiming Chen, Yao Shi, Xun Lang, Lei Xie, Hongye Su |
| 2023 | ICASSP | Two-Stage Neural Network for ICASSP 2023 Speech Signal Improvement Challenge. | Mingshuai Liu, Shubo Lv, Zihan Zhang, Runduo Han, Xiang Hao, Xianjun Xia, Li Chen, Yijian Xiao, Lei Xie |
| 2023 | ICASSP | Expressive-VC: Highly Expressive Voice Conversion with Attention Fusion of Bottleneck and Perturbation Features. | Ziqian Ning, Qicong Xie, Pengcheng Zhu, Zhichao Wang, Liumeng Xue, Jixun Yao, Lei Xie, Mengxiao Bi |
| 2023 | ICASSP | DSPGAN: A Gan-Based Universal Vocoder for High-Fidelity TTS by Time-Frequency Domain Supervision from DSP. | Kun Song, Yongmao Zhang, Yi Lei, Jian Cong, Hanzhao Li, Lei Xie, Gang He, Jinfeng Bai |
| 2023 | ICASSP | Delivering Speaking Style in Low-Resource Voice Conversion with Multi-Factor Constraints. | Zhichao Wang, Xinsheng Wang, Lei Xie, Yuanzhe Chen, Qiao Tian, Yuping Wang |
| 2023 | ICASSP | Wekws: A Production First Small-Footprint End-to-End Keyword Spotting Toolkit. | Jie Wang, Menglong Xu, Jingyong Hou, Binbin Zhang, Xiao-Lei Zhang, Lei Xie, Fuping Pan |
| 2023 | ICASSP | The NPU-Elevoc Personalized Speech Enhancement System for Icassp2023 DNS Challenge. | Xiaopeng Yan, Yindi Yang, Zhihao Guo, Liangliang Peng, Lei Xie |
| 2023 | ICASSP | Preserving Background Sound in Noise-Robust Voice Conversion Via Multi-Task Learning. | Jixun Yao, Yi Lei, Qing Wang, Pengcheng Guo, Ziqian Ning, Lei Xie, Hai Li, Junhui Liu, Danming Xie |
| 2023 | ICASSP | Distinguishable Speaker Anonymization Based on Formant and Fundamental Frequency Scaling. | Jixun Yao, Qing Wang, Yi Lei, Pengcheng Guo, Lei Xie, Namin Wang, Jie Liu |
| 2023 | ICASSP | VE-KWS: Visual Modality Enhanced End-to-End Keyword Spotting. | Ao Zhang, He Wang, Pengcheng Guo, Yihui Fu, Lei Xie, Yingying Gao, Shilei Zhang, Junlan Feng |
| 2023 | ICASSP | Distance-Based Weight Transfer for Fine-Tuning From Near-Field to Far-Field Speaker Verification. | Li Zhang, Qing Wang, Hongji Wang, Yue Li, Wei Rao, Yannan Wang, Lei Xie |
| 2023 | ICASSP | Two-Step Band-Split Neural Network Approach For Full-Band Residual Echo Suppression. | Zihan Zhang, Shimin Zhang, Mingshuai Liu, Yanhong Leng, Zhe Han, Li Chen, Lei Xie |
| 2023 | ICASSP | Multi-Speaker Expressive Speech Synthesis via Multiple Factors Decoupling. | Xinfa Zhu, Yi Lei, Kun Song, Yongmao Zhang, Tao Li, Lei Xie |
| 2023 | ICDCS | Work Condition Monitoring for Knife-Edge Switches on Lightweight Edge Devices. | Ziwei Liu, Lei Xie, Jingyi Ning, Ming Zhao, Zhenjie Lin, Liming Wang |
| 2023 | ICDCS | Poster:Multi-Modal-Based Video Stabilization for Mobile Devices in Dynamic Scenes. | Chaoran Li, Lei Xie, Yanling Bu, Ming Zhao, Zhenjie Lin, Liming Wang |
| 2023 | IJCAI | Contrastive Learning for Sign Language Recognition and Translation. | Shiwei Gan, Yafeng Yin, Zhiwei Jiang, Kang Xia, Lei Xie, Sanglu Lu |
| 2023 | INFOCOM | mmMIC: Multi-modal Speech Recognition based on mmWave Radar. | Long Fan, Lei Xie, Xinran Lu, Yi Li, Chuyu Wang, Sanglu Lu |
| 2023 | INFOCOM | mmEavesdropper: Signal Augmentation-based Directional Eavesdropping with mmWave Radar. | Yiwen Feng, Kai Zhang, Chuyu Wang, Lei Xie, Jingyi Ning, Shijia Chen |
| 2023 | Interspeech | Pseudo-Siamese Network based Timbre-reserved Black-box Adversarial Attack in Speaker Identification. | Qing Wang, Jixun Yao, Ziqian Wang, Pengcheng Guo, Lei Xie |
| 2023 | Interspeech | Contextualized End-to-End Speech Recognition with Contextual Phrase Prediction Network. | Kaixun Huang, Ao Zhang, Zhanheng Yang, Pengcheng Guo, Bingshen Mu, Tianyi Xu, Lei Xie |
| 2023 | Interspeech | BA-SOT: Boundary-Aware Serialized Output Training for Multi-Talker ASR. | Yuhao Liang, Fan Yu, Yangze Li, Pengcheng Guo, Shiliang Zhang, Qian Chen, Lei Xie |
| 2023 | Interspeech | PromptStyle: Controllable Style Transfer for Text-to-Speech with Natural Language Descriptions. | Guanghou Liu, Yongmao Zhang, Yi Lei, Yunlin Chen, Rui Wang, Lei Xie, Zhifei Li |
| 2023 | Interspeech | DCCRN-KWS: An Audio Bias Based Model for Noise Robust Small-Footprint Keyword Spotting. | Shubo Lv, Xiong Wang, Sining Sun, Long Ma, Lei Xie |
| 2023 | Interspeech | DualVC: Dual-mode Voice Conversion using Intra-model Knowledge Distillation and Hybrid Predictive Coding. | Ziqian Ning, Yuepeng Jiang, Pengcheng Zhu, Jixun Yao, Shuai Wang, Lei Xie, Mengxiao Bi |
| 2023 | Interspeech | StyleS2ST: Zero-shot Style Transfer for Direct Speech-to-speech Translation. | Kun Song, Yi Ren, Yi Lei, Chunfeng Wang, Kun Wei, Lei Xie, Xiang Yin, Zejun Ma |
| 2023 | Interspeech | TranUSR: Phoneme-to-word Transcoder Based Unified Speech Representation Learning for Cross-lingual Speech Recognition. | Hongfei Xue, Qijie Shao, Peikun Chen, Pengcheng Guo, Lei Xie, Jie Liu |
| 2023 | Interspeech | Adaptive Contextual Biasing for Transducer Based Streaming Speech Recognition. | Tianyi Xu, Zhanheng Yang, Kaixun Huang, Pengcheng Guo, Ao Zhang, Biao Li, Changru Chen, Chao Li, Lei Xie |
| 2023 | Interspeech | Two Stage Contextual Word Filtering for Context Bias in Unified Streaming and Non-streaming Transducer. | Zhanheng Yang, Sining Sun, Xiong Wang, Yike Zhang, Long Ma, Lei Xie |
| 2022 | ASPLOS | Suppressing ZZ crosstalk of Quantum computers through pulse and scheduling co-optimization. | Lei Xie, Jidong Zhai, Zhenxing Zhang, Jonathan Allcock, Shengyu Zhang, Yicong Zheng |
| 2022 | BMVC | CICC: Channel Pruning via the Concentration of Information and Contributions of Channels. | Yihao Chen, Zhishan Li, Yingqing Yang, Lei Xie, Yong Liu, Longhua Ma, Shanqi Liu, Guanzhong Tian |
| 2022 | ICASSP | Uformer: A Unet Based Dilated Complex & Real Dual-Path Conformer Network for Simultaneous Speech Enhancement and Dereverberation. | Yihui Fu, Yun Liu, Jingdong Li, Dawei Luo, Shubo Lv, Yukai Jv, Lei Xie |
| 2022 | ICASSP | TEA-PSE: Tencent-Ethereal-Audio-Lab Personalized Speech Enhancement System for ICASSP 2022 DNS Challenge. | Yukai Ju, Wei Rao, Xiaopeng Yan, Yihui Fu, Shubo Lv, Luyao Cheng, Yannan Wang, Lei Xie, Shidong Shang |
| 2022 | ICASSP | An Efficient Framework for Detection and Recognition of Numerical Traffic Signs. | Zhishan Li, Mingmu Chen, Yifan He, Lei Xie, Hongye Su |
| 2022 | ICASSP | S-DCCRN: Super Wide Band DCCRN with Learnable Complex Feature for Speech Enhancement. | Shubo Lv, Yihui Fu, Mengtao Xing, Jiayao Sun, Lei Xie, Jun Huang, Yannan Wang, Tao Yu |
| 2022 | ICASSP | One-Shot Voice Conversion For Style Transfer Based On Speaker Adaptation. | Zhichao Wang, Qicong Xie, Tao Li, Hongqiang Du, Lei Xie, Pengcheng Zhu, Mengxiao Bi |
| 2022 | ICASSP | Conversational Speech Recognition by Learning Conversation-Level Characteristics. | Kun Wei, Yike Zhang, Sining Sun, Lei Xie, Long Ma |
| 2022 | ICASSP | M2Met: The Icassp 2022 Multi-Channel Multi-Party Meeting Transcription Challenge. | Fan Yu, Shiliang Zhang, Yihui Fu, Lei Xie, Siqi Zheng, Zhihao Du, Weilong Huang, Pengcheng Guo, Zhijie Yan, Bin Ma, Xin Xu, Hui Bu |
| 2022 | ICASSP | Summary on the ICASSP 2022 Multi-Channel Multi-Party Meeting Transcription Grand Challenge. | Fan Yu, Shiliang Zhang, Pengcheng Guo, Yihui Fu, Zhihao Du, Siqi Zheng, Weilong Huang, Lei Xie, Zheng-Hua Tan, DeLiang Wang, Yanmin Qian, Kong Aik Lee, Zhijie Yan, Bin Ma, Xin Xu, Hui Bu |
| 2022 | ICASSP | VISinger: Variational Inference with Adversarial Learning for End-to-End Singing Voice Synthesis. | Yongmao Zhang, Jian Cong, Heyang Xue, Lei Xie, Pengcheng Zhu, Mengxiao Bi |
| 2022 | ICASSP | WENETSPEECH: A 10000+ Hours Multi-Domain Mandarin Corpus for Speech Recognition. | Binbin Zhang, Hang Lv, Pengcheng Guo, Qijie Shao, Chao Yang, Lei Xie, Xin Xu, Hui Bu, Xiaoyu Chen, Chenchen Zeng, Di Wu, Zhendong Peng |
| 2022 | ICASSP | Multi-Task Deep Residual Echo Suppression with Echo-Aware Loss. | Shimin Zhang, Ziteng Wang, Jiayao Sun, Yihui Fu, Biao Tian, Qiang Fu, Lei Xie |
| 2022 | ICDCS | Pinpoint Achilles' Heel in RFID Localization: Phase Calibration of RFID Antenna based on Linear Localization Model. | Yanling Bu, Lei Xie, Jia Liu, Chuyu Wang, Ge Wang, Zenglong Wang, Sanglu Lu |
| 2022 | INFOCOM | RF-Protractor: Non-Contacting Angle Tracking via COTS RFID in Industrial IoT Environment. | Tingjun Liu, Chuyu Wang, Lei Xie, Jingyi Ning, Tie Qiu, Fu Xiao, Sanglu Lu |
| 2022 | INFOCOM | Remote Meter Reading based on Lightweight Edge Devices. | Ziwei Liu, Lei Xie, Jingyi Ning, Ming Zhao, Liming Wang, Hao Peng |
| 2022 | INFOCOM | Separating Voices from Multiple Sound Sources using 2D Microphone Array. | Xinran Lu, Lei Xie, Fang Wang, Tao Gu, Chuyu Wang, Wei Wang, Sanglu Lu |
| 2022 | INFOCOM | Static Obstacle Detection based on Acoustic Signals. | Runze Tang, Gaolei Duan, Lei Xie, Yanling Bu, Ming Zhao, Zhenjie Lin, Qiang Lin |
| 2022 | Interspeech | Glow-WaveGAN 2: High-quality Zero-shot Text-to-speech Synthesis and Any-to-any Voice Conversion. | Yi Lei, Shan Yang, Jian Cong, Lei Xie, Dan Su |
| 2022 | Interspeech | Cross-speaker Emotion Transfer Based On Prosody Compensation for End-to-End Speech Synthesis. | Tao Li, Xinsheng Wang, Qicong Xie, Zhichao Wang, Mingqi Jiang, Lei Xie |
| 2022 | Interspeech | Linguistic-Acoustic Similarity Based Accent Shift for Accent Recognition. | Qijie Shao, Jinghao Yan, Jian Kang, Pengcheng Guo, Xian Shi, Pengfei Hu, Lei Xie |
| 2022 | Interspeech | Opencpop: A High-Quality Open Source Chinese Popular Song Corpus for Singing Voice Synthesis. | Yu Wang, Xinsheng Wang, Pengcheng Zhu, Jie Wu, Hanzhao Li, Heyang Xue, Yongmao Zhang, Lei Xie, Mengxiao Bi |
| 2022 | Interspeech | Leveraging Acoustic Contextual Representation by Audio-textual Cross-modal Learning for Conversational ASR. | Kun Wei, Yike Zhang, Sining Sun, Lei Xie, Long Ma |
| 2022 | Interspeech | Learn2Sing 2.0: Diffusion and Mutual Information-Based Target Speaker SVS by Learning from Singing Teacher. | Heyang Xue, Xinsheng Wang, Yongmao Zhang, Lei Xie, Pengcheng Zhu, Mengxiao Bi |
| 2022 | Interspeech | Learning Noise-independent Speech Representation for High-quality Voice Conversion for Noisy Target Speakers. | Liumeng Xue, Shan Yang, Na Hu, Dan Su, Lei Xie |
| 2022 | Interspeech | Minimizing Sequential Confusion Error in Speech Command Recognition. | Zhanheng Yang, Hang Lv, Xiong Wang, Ao Zhang, Lei Xie |
| 2022 | Interspeech | Open Source MagicData-RAMC: A Rich Annotated Mandarin Conversational(RAMC) Speech Dataset. | Zehui Yang, Yifan Chen, Lei Luo, Runyan Yang, Lingxuan Ye, Gaofeng Cheng, Ji Xu, Yaohui Jin, Qingqing Zhang, Pengyuan Zhang, Lei Xie, Yonghong Yan |
| 2022 | Interspeech | CaTT-KWS: A Multi-stage Customized Keyword Spotting Framework based on Cascaded Transducer-Transformer. | Zhanheng Yang, Sining Sun, Jin Li, Xiaoming Zhang, Xiong Wang, Long Ma, Lei Xie |
| 2021 | APWEB | Incorporating Typological Features into Language Selection for Multilingual Neural Machine Translation. | Chenggang Mi, Shaolin Zhu, Yi Fan, Lei Xie |
| 2021 | ASRU | Conferencingspeech Challenge: Towards Far-Field Multi-Channel Speech Enhancement for Video Conferencing. | Wei Rao, Yihui Fu, Yanxin Hu, Xin Xu, Yvkai Jv, Jiangyu Han, Zhongjie Jiang, Lei Xie, Yannan Wang, Shinji Watanabe, Zheng-Hua Tan, Hui Bu, Tao Yu, Shidong Shang |
| 2021 | ASRU | Boundary and Context Aware Training for CIF-Based Non-Autoregressive End-to-End ASR. | Fan Yu, Haoneng Luo, Pengcheng Guo, Yuhao Liang, Zhuoyuan Yao, Lei Xie, Yingying Gao, Leijing Hou, Shilei Zhang |
| 2021 | ASRU | Duality Temporal-Channel-Frequency Attention Enhanced Speaker Representation Learning. | Li Zhang, Qing Wang, Lei Xie |
| 2021 | DAC | Mitigating Crosstalk in Quantum Computers through Commutativity-Based Instruction Reordering. | Lei Xie, Jidong Zhai, Weimin Zheng |
| 2021 | ICASSP | An Asynchronous WFST-Based Decoder for Automatic Speech Recognition. | Hang Lv, Zhehuai Chen, Hainan Xu, Daniel Povey, Lei Xie, Sanjeev Khudanpur |
| 2021 | ICASSP | The Accented English Speech Recognition Challenge 2020: Open Datasets, Tracks, Baselines, Results and Methods. | Xian Shi, Fan Yu, Yizhou Lu, Yuhao Liang, Qiangze Feng, Daliang Wang, Yanmin Qian, Lei Xie |
| 2021 | ICASSP | Wake Word Detection with Streaming Transformers. | Yiming Wang, Hang Lv, Daniel Povey, Lei Xie, Sanjeev Khudanpur |
| 2021 | ICASSP | The Multi-Speaker Multi-Style Voice Cloning Challenge 2021. | Qicong Xie, Xiaohai Tian, Guanghou Liu, Kun Song, Lei Xie, Zhiyong Wu, Hai Li, Song Shi, Haizhou Li, Fen Hong, Hui Bu, Xin Xu |
| 2021 | ICMI | TeNC: Low Bit-Rate Speech Coding with VQ-VAE and GAN. | Yi Chen, Shan Yang, Na Hu, Lei Xie, Dan Su |
| 2021 | ICMI | A Web-Based Longitudinal Mental Health Monitoring System. | Zhiwei Chen, Weizhao Yang, Jinrong Li, Jiale Wang, Shuai Li, Ziwen Wang, Lei Xie |
| 2021 | ICMI | ASMMC21: The 6th International Workshop on Affective Social Multimedia Computing. | Dongyan Huang, Bjrn W. Schuller, Jianhua Tao, Lei Xie, Jie Yang |
| 2021 | ICMI | Efficient Gradient-Based Neural Architecture Search For End-to-End ASR. | Xian Shi, Pan Zhou, Wei Chen, Lei Xie |
| 2021 | ICMI | Noise Robust Singing Voice Synthesis Using Gaussian Mixture Variational Autoencoder. | Heyang Xue, Xiao Zhang, Jie Wu, Jian Luan, Yujun Wang, Lei Xie |
| 2021 | IGARSS | Reduced-Dimension Space-Time Adaptive Processing in the Presence of Multiple Targets. | Lei Xie, Pei Li, Xingyi Su, Jun Tong, Zishu He, Wei Zhang |
| 2021 | Interspeech | Improving Performance of Seen and Unseen Speech Style Transfer in End-to-End Neural TTS. | Xiaochun An, Frank K. Soong, Lei Xie |
| 2021 | Interspeech | Controllable Context-Aware Conversational Speech Synthesis. | Jian Cong, Shan Yang, Na Hu, Guangzhi Li, Lei Xie, Dan Su |
| 2021 | Interspeech | Glow-WaveGAN: Learning Speech Representations from GAN-Based Variational Auto-Encoder for High Fidelity Flow-Based Speech Synthesis. | Jian Cong, Shan Yang, Lei Xie, Dan Su |
| 2021 | Interspeech | Improving Robustness of One-Shot Voice Conversion with Deep Discriminative Speaker Encoder. | Hongqiang Du, Lei Xie |
| 2021 | Interspeech | AISHELL-4: An Open Source Dataset for Speech Enhancement, Separation, Recognition and Speaker Diarization in Conference Scenario. | Yihui Fu, Luyao Cheng, Shubo Lv, Yukai Jv, Yuxiang Kong, Zhuo Chen, Yanxin Hu, Lei Xie, Jian Wu, Hui Bu, Xin Xu, Jun Du, Jingdong Chen |
| 2021 | Interspeech | Multi-Speaker ASR Combining Non-Autoregressive Conformer CTC and Conditional Speaker Chain. | Pengcheng Guo, Xuankai Chang, Shinji Watanabe, Lei Xie |
| 2021 | Interspeech | DCCRN+: Channel-Wise Subband DCCRN with SNR Estimation for Speech Enhancement. | Shubo Lv, Yanxin Hu, Shimin Zhang, Lei Xie |
| 2021 | Interspeech | Auto-KWS 2021 Challenge: Task, Datasets, and Baselines. | Jingsong Wang, Yuxuan He, Chunyu Zhao, Qijie Shao, Wei-Wei Tu, Tom Ko, Hung-yi Lee, Lei Xie |
| 2021 | Interspeech | Efficient Conformer with Prob-Sparse Attention Mechanism for End-to-End Speech Recognition. | Xiong Wang, Sining Sun, Lei Xie, Long Ma |
| 2021 | Interspeech | Enriching Source Style Transfer in Recognition-Synthesis Based Non-Parallel Voice Conversion. | Zhichao Wang, Xinyong Zhou, Fengyu Yang, Tao Li, Hongqiang Du, Lei Xie, Wendong Gan, Haitao Chen, Hai Li |
| 2020 | HCI | Teamwork in Virtual World - Impact of "Virtual Team" on Team Dynamic. | Bin Mai, Brittany Garcia, Lei Xie, Andrew McCubbins, Jinsil Seo |
| 2020 | ICARCV | PBDE: An Effective Method for Filtering False Positive Boxes in Object Detection. | Zhishan Li, Baozhi Jia, Mingmu Chen, Shaokai Xu, Yifan He, Lei Xie |
| 2020 | ICARCV | Loss Constrains Added Squeeze and Excitation Blocks for Pruning Deep Neural Networks. | Yiqin Wang, Ming Li, Hongye Su, Lei Xie, Xiaochen Li, Weihua Xu, Xiaozhou Xu |
| 2020 | ICARCV | Batch-Normalization-based Soft Filter Pruning for Deep Convolutional Neural Networks. | Xiaozhou Xu, Qiming Chen, Lei Xie, Hongye Su |
| 2020 | ICARCV | Extracting fetal heart rate from abdominal ECGs based on fast multivariate empirical mode decomposition. | Jiayue Zhang, Xiaozhou Xu, Qiming Chen, Lei Xie, Hongye Su |
| 2020 | ICARCV | Gene Prediction by the Scale-limited Gabor Wavelet Transform for Identifying the Protein Coding Regions. | Qian Zheng, Wenxiang Zhou, Tao Chen, Lei Xie, Hongye Su |
| 2020 | ICASSP | Effective Wavenet Adaptation for Voice Conversion with Limited Data. | Hongqiang Du, Xiaohai Tian, Lei Xie, Haizhou Li |
| 2020 | ICASSP | Time-Domain Neural Network Approach for Speech Bandwidth Extension. | Xiang Hao, Chenglin Xu, Nana Hou, Lei Xie, Eng Siong Chng, Haizhou Li |
| 2020 | ICASSP | Mining Effective Negative Training Samples for Keyword Spotting. | Jingyong Hou, Yangyang Shi, Mari Ostendorf, Mei-Yuh Hwang, Lei Xie |
| 2020 | ICCCN | RF-Detector: 3D Structure Detection of Tiny Objects via RFID Systems. | Jingyi Ning, Lei Xie, Chuyu Wang, Yanling Bu, Baoliu Ye, Sanglu Lu |
| 2020 | ICDCS | Elan: Towards Generic and Efficient Elastic Training for Deep Learning. | Lei Xie, Jidong Zhai, Baodong Wu, Yuanbo Wang, Xingcheng Zhang, Peng Sun, Shengen Yan |
| 2020 | IJCAI | Improving Attention Mechanism in Graph Neural Networks via Cardinality Preservation. | Shuo Zhang, Lei Xie |
| 2020 | INFOCOM | Activating Wireless Voice for E-Toll Collection Systems with Zero Start-up Cost. | Zhenlin An, Qiongzheng Lin, Lei Yang, Lei Xie |
| 2020 | INFOCOM | Physical-Layer Arithmetic for Federated Learning in Uplink MU-MIMO Enabled Wireless Networks. | Tao Huang, Baoliu Ye, Zhihao Qu, Bin Tang, Lei Xie, Sanglu Lu |
| 2020 | INFOCOM | SpiderMon: Towards Using Cell Towers as Illuminating Sources for Keystroke Monitoring. | Kang Ling, Yuntang Liu, Ke Sun, Wei Wang, Lei Xie, Qing Gu |
| 2020 | INFOCOM | RF-Rhythm: Secure and Usable Two-Factor RFID Authentication. | Jiawei Li, Chuyu Wang, Ang Li, Dianqi Han, Yan Zhang, Jinhang Zuo, Rui Zhang, Lei Xie, Yanchao Zhang |
| 2020 | Interspeech | Data Efficient Voice Cloning from Noisy Samples with Domain Adversarial Training. | Jian Cong, Shan Yang, Lei Xie, Guoqiao Yu, Guanglu Wan |
| 2020 | Interspeech | DCCRN: Deep Complex Convolution Recurrent Network for Phase-Aware Speech Enhancement. | Yanxin Hu, Yun Liu, Shubo Lv, Mengtao Xing, Shimin Zhang, Yihui Fu, Jian Wu, Bihong Zhang, Lei Xie |
| 2020 | Interspeech | Channel-Wise Subband Input for Better Voice and Accompaniment Separation on High Resolution Music. | Haohe Liu, Lei Xie, Jian Wu, Geng Yang |
| 2020 | Interspeech | Wake Word Detection with Alignment-Free Lattice-Free MMI. | Yiming Wang, Hang Lv, Daniel Povey, Lei Xie, Sanjeev Khudanpur |
| 2020 | Interspeech | Inaudible Adversarial Perturbations for Targeted Attack in Speaker Recognition. | Qing Wang, Pengcheng Guo, Lei Xie |
| 2020 | Interspeech | AutoSpeech 2020: The Second Automated Machine Learning Challenge for Speech Classification. | Jingsong Wang, Tom Ko, Zhen Xu, Xiawei Guo, Souxiang Liu, Wei-Wei Tu, Lei Xie |
| 2020 | Interspeech | An End-to-End Architecture of Online Multi-Channel Speech Separation. | Jian Wu, Zhuo Chen, Jinyu Li, Takuya Yoshioka, Zhili Tan, Ed Lin, Yi Luo, Lei Xie |
| 2020 | Interspeech | Exploiting Deep Sentential Context for Expressive End-to-End Speech Synthesis. | Fengyu Yang, Shan Yang, Qinghua Wu, Yujun Wang, Lei Xie |
| 2019 | ASPDAC | Mosaic: an automated synthesis flow for boolean logic based on memristor crossbar. | Lei Xie |
| 2019 | ASRU | Learning Hierarchical Representations for Expressive Speaking Style in End-to-End Speech Synthesis. | Xiaochun An, Yuxuan Wang, Shan Yang, Zejun Ma, Lei Xie |
| 2019 | ASRU | Incremental Lattice Determinization for WFST Decoders. | Zhehuai Chen, Mahsa Yarmohammadi, Hainan Xu, Hang Lv, Lei Xie, Daniel Povey, Sanjeev Khudanpur |
| 2019 | ASRU | WaveNet Factorization with Singular Value Decomposition for Voice Conversion. | Hongqiang Du, Xiaohai Tian, Lei Xie, Haizhou Li |
| 2019 | ASRU | Espresso: A Fast End-to-End Neural Speech Recognition Toolkit. | Yiming Wang, Sanjeev Khudanpur, Tongfei Chen, Hainan Xu, Shuoyang Ding, Hang Lv, Yiwen Shao, Nanyun Peng, Lei Xie, Shinji Watanabe |
| 2019 | ASRU | Virtual Adversarial Training for DS-CNN Based Small-Footprint Keyword Spotting. | Xiong Wang, Sining Sun, Lei Xie |
| 2019 | ASRU | Time Domain Audio Visual Speech Separation. | Jian Wu, Yong Xu, Shi-Xiong Zhang, Lianwu Chen, Meng Yu, Lei Xie, Dong Yu |
| 2019 | ASRU | Improving Mandarin End-to-End Speech Synthesis by Self-Attention and Learnable Gaussian Bias. | Fengyu Yang, Shan Yang, Pengcheng Zhu, Pengju Yan, Lei Xie |
| 2019 | ASRU | Verifying Deep Keyword Spotting Detection with Acoustic Word Embeddings. | Yougen Yuan, Zhiqiang Lv, Shen Huang, Lei Xie |
| 2019 | ASRU | Controlling Emotion Strength with Relative Attribute for End-to-End Speech Synthesis. | Xiaolian Zhu, Shan Yang, Geng Yang, Lei Xie |
| 2019 | ICASSP | An Attention-based Neural Network Approach for Single Channel Speech Enhancement. | Xiang Hao, Changhao Shan, Yong Xu, Sining Sun, Lei Xie |
| 2019 | ICASSP | Domain Adversarial Training for Improving Keyword Spotting Performance of ESL Speech. | Jingyong Hou, Pengcheng Guo, Sining Sun, Frank K. Soong, Wenping Hu, Lei Xie |
| 2019 | ICASSP | Component Fusion: Learning Replaceable Language Model Component for End-to-end Speech Recognition System. | Changhao Shan, Chao Weng, Guangsen Wang, Dan Su, Min Luo, Dong Yu, Lei Xie |
| 2019 | ICASSP | Investigating End-to-end Speech Recognition for Mandarin-english Code-switching. | Changhao Shan, Chao Weng, Guangsen Wang, Dan Su, Min Luo, Dong Yu, Lei Xie |
| 2019 | ICASSP | Adversarial Examples for Improving End-to-end Attention-based Small-footprint Keyword Spotting. | Xiong Wang, Sining Sun, Changhao Shan, Jingyong Hou, Lei Xie, Shen Li, Xin Lei |
| 2019 | ICASSP | A Pitch-aware Approach to Single-channel Speech Separation. | Ke Wang, Frank K. Soong, Lei Xie |
| 2019 | ICASSP | Enhancing Hybrid Self-attention Structure with Relative-position-aware Bias for Speech Synthesis. | Shan Yang, Heng Lu, Shiying Kang, Lei Xie, Dong Yu |
| 2019 | ICASSP | Robust Audio-visual Speech Recognition Using Bimodal Dfsmn with Multi-condition Training and Dropout Regularization. | Shiliang Zhang, Ming Lei, Bin Ma, Lei Xie |
| 2019 | ICMI | Deep Audio-visual System for Closed-set Word-level Speech Recognition. | Yougen Yuan, Wei Tang, Minhao Fan, Yue Cao, Peng Zhang, Lei Xie |
| 2019 | ICPADS | iShake: Imitation-Resistant Secure Pairing of Smart Devices via Shaking. | Congcong Shi, Lei Xie, Chuyu Wang, Peicheng Yang, Yubo Song, Sanglu Lu |
| 2019 | INFOCOM | Spin-Antenna: 3D Motion Tracking for Tag Array Labeled Objects via Spinning Antenna. | Chuyu Wang, Lei Xie, Keyan Zhang, Wei Wang, Yanling Bu, Sanglu Lu |
| 2019 | Interspeech | Unsupervised Adaptation with Adversarial Dropout Regularization for Robust Speech Recognition. | Pengcheng Guo, Sining Sun, Lei Xie |
| 2019 | Interspeech | A New GAN-Based End-to-End TTS Training Algorithm. | Haohan Guo, Frank K. Soong, Lei He, Lei Xie |
| 2019 | Interspeech | Exploiting Syntactic Features in a Parsed Tree to Improve End-to-End TTS. | Haohan Guo, Frank K. Soong, Lei He, Lei Xie |
| 2019 | Interspeech | Adversarial Regularization for End-to-End Robust Speaker Verification. | Qing Wang, Pengcheng Guo, Sining Sun, Lei Xie, John H. L. Hansen |
| 2019 | Interspeech | Improved Speaker-Dependent Separation for CHiME-5 Challenge. | Jian Wu, Yong Xu, Shi-Xiong Zhang, Lianwu Chen, Meng Yu, Lei Xie, Dong Yu |
| 2019 | Interspeech | Building a Mixed-Lingual Neural TTS System with Only Monolingual Data. | Liumeng Xue, Wei Song, Guanghui Xu, Lei Xie, Zhizheng Wu |
| 2018 | CSCWD | A Cooperative Denoising Method Based on Total Variation and Discrete Wavelet Transform. | Lei Xie, Tao Wu, Xi Chen, Jia He |
| 2018 | DATE | Memristive devices for computation-in-memory. | Jintao Yu, Hoang Anh Du Nguyen, Lei Xie, Mottaqiallah Taouil, Said Hamdioui |
| 2018 | ICASSP | Attention-Based End-to-End Speech Recognition on Voice Search. | Changhao Shan, Junbo Zhang, Yujun Wang, Lei Xie |
| 2018 | ICASSP | Domain Adversarial Training for Accented Speech Recognition. | Sining Sun, Ching-Feng Yeh, Mei-Yuh Hwang, Mari Ostendorf, Lei Xie |
| 2018 | ICASSP | Unsupervised Domain Adaptation via Domain Adversarial Training for Speaker Recognition. | Qing Wang, Wei Rao, Sining Sun, Lei Xie, Eng Siong Chng, Haizhou Li |
| 2018 | INFOCOM | RF-Dial: An RFID-based 2D Human-Computer Interaction via Tag Array. | Yanling Bu, Lei Xie, Yinyin Gong, Chuyu Wang, Lei Yang, Jia Liu, Sanglu Lu |
| 2018 | INFOCOM | Robust Spinning Sensing with Dual-RFID-Tags in Noisy Settings. | Chunhui Duan, Lei Yang, Huanyu Jia, Qiongzheng Lin, Yunhao Liu, Lei Xie |
| 2018 | INFOCOM | Multi - Touch in the Air: Device-Free Finger Tracking and Gesture Recognition via COTS RFID. | Chuyu Wang, Jian Liu, Yingying Chen, Hongbo Liu, Lei Xie, Wei Wang, Bingbing He, Sanglu Lu |
| 2018 | Interspeech | Study of Semi-supervised Approaches to Improving English-Mandarin Code-Switching Speech Recognition. | Pengcheng Guo, Haihua Xu, Lei Xie, Eng Siong Chng |
| 2018 | Interspeech | Attention-based End-to-End Models for Small-Footprint Keyword Spotting. | Changhao Shan, Junbo Zhang, Yujun Wang, Lei Xie |
| 2018 | Interspeech | Training Augmentation with Adversarial Examples for Robust Speech Recognition. | Sining Sun, Ching-Feng Yeh, Mari Ostendorf, Mei-Yuh Hwang, Lei Xie |
| 2018 | Interspeech | Investigating Generative Adversarial Networks Based Speech Dereverberation for Robust Speech Recognition. | Ke Wang, Junbo Zhang, Sining Sun, Yujun Wang, Fei Xiang, Lei Xie |
| 2018 | Interspeech | Empirical Evaluation of Speaker Adaptation on DNN Based Acoustic Model. | Ke Wang, Junbo Zhang, Yujun Wang, Lei Xie |
| 2017 | ASRU | Multilingual bottle-neck feature learning from untranscribed speech. | Hongjie Chen, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li |
| 2017 | ASRU | Statistical parametric speech synthesis using generative adversarial networks under a multi-task learning framework. | Shan Yang, Lei Xie, Xiao Chen, Xiaoyan Lou, Xuan Zhu, Dongyan Huang, Haizhou Li |
| 2017 | ASRU | Extracting bottleneck features and word-like pairs from untranscribed speech for feature representation. | Yougen Yuan, Cheung-Chi Leung, Lei Xie, Hongjie Chen, Bin Ma, Haizhou Li |
| 2017 | DATE | Memristor for computing: Myth or reality? | Said Hamdioui, Shahar Kvatinsky, Gert Cauwenberghs, Lei Xie, Nimrod Wald, Siddharth Joshi, Hesham Mostafa Elsayed, Henk Corporaal, Koen Bertels |
| 2017 | DDECS | On the robustness of memristor based logic gates. | Lei Xie, Hoang Anh Du Nguyen, Jintao Yu, Mottaqiallah Taouil, Said Hamdioui |
| 2017 | ICASSP | Pairwise learning using multi-lingual bottleneck features for low-resource query-by-example spoken term detection. | Yougen Yuan, Cheung-Chi Leung, Lei Xie, Hongjie Chen, Bin Ma, Haizhou Li |
| 2017 | ICDCS | Smartphone Privacy Leakage of Social Relationships and Demographics from Surrounding Access Points. | Chen Wang, Chuyu Wang, Yingying Chen, Lei Xie, Sanglu Lu |
| 2017 | IGARSS | An optimized K-means clustering algorithm based on BC-QPSO for remote sensing image. | Tao Wu, Xi Chen, Lei Xie, Zhongquan Qiu |
| 2017 | INFOCOM | Meta-activity recognition: A wearable approach for logic cognition-based activity sensing. | Lei Xie, Xu Dong, Wei Wang, Dawei Huang |
| 2017 | Interspeech | Empirical Evaluation of Parallel Training Algorithms on Acoustic Modeling. | Wenpeng Li, Binbin Zhang, Lei Xie, Dong Yu |
| 2017 | Interspeech | Denoising Recurrent Neural Network for Deep Bidirectional LSTM Based Voice Conversion. | Jie Wu, Dong-Yan Huang, Lei Xie, Haizhou Li |
| 2016 | ICASSP | Exemplar-based sparse representation of timbre and prosody for voice conversion. | Huaiping Ming, Dong-Yan Huang, Lei Xie, Shaofei Zhang, Minghui Dong, Haizhou Li |
| 2016 | ICASSP | Approximate search of audio queries by using DTW with phone time boundary and data augmentation. | Haihua Xu, Jingyong Hou, Xiong Xiao, Van Tung Pham, Cheung-Chi Leung, Lei Wang, Van Hai Do, Hang Lv, Lei Xie, Bin Ma, Eng Siong Chng, Haizhou Li |
| 2016 | ICDCS | RF-ISee: Identify and Distinguish Multiple RFID Tagged Objects in Augmented Reality Systems. | Jianqiang Sun, Lei Xie, Qingliang Cai, Chuyu Wang, Jie Wu, Sanglu Lu |
| 2016 | IGARSS | Monitoring permafrost soil moisture with multi-temporal TERRASAR-X data in northern tibet. | Chao Wang, Hong Zhang, Qingbai Wu, Zhengjia Zhang, Lei Xie |
| 2016 | IGARSS | Urban land cover change types identification using fully polarimetric SAR descriptors. | Lei Xie, Hong Zhang, Chao Wang |
| 2016 | IGARSS | Biomass estimation of oilseed rape using simulated compact polarimtric SAR imagery. | Hao Yang, Lei Xie, Erxue Chen, Hong Zhang, Guijun Yang, Zhenhong Li, Xiaohe Gu |
| 2016 | INFOCOM | Moving tag detection via physical layer analysis for large-scale RFID systems. | Chuyu Wang, Lei Xie, Wei Wang, Tao Xue, Sanglu Lu |
| 2016 | INFOCOM | CamK: A camera-based keyboard for small mobile devices. | Yafeng Yin, Qun Li, Lei Xie, Shanhe Yi, Edmund Novak, Sanglu Lu |
| 2016 | Interspeech | Unsupervised Bottleneck Features for Low-Resource Query-by-Example Spoken Term Detection. | Hongjie Chen, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li |
| 2016 | Interspeech | Toward High-Performance Language-Independent Query-by-Example Spoken Term Detection for MediaEval 2015: Post-Evaluation Analysis. | Cheung-Chi Leung, Lei Wang, Haihua Xu, Jingyong Hou, Van Tung Pham, Hang Lv, Lei Xie, Xiong Xiao, Chongjia Ni, Bin Ma, Eng Siong Chng, Haizhou Li |
| 2016 | Interspeech | Deep Bidirectional LSTM Modeling of Timbre and Prosody for Emotional Voice Conversion. | Huaiping Ming, Dong-Yan Huang, Lei Xie, Jie Wu, Minghui Dong, Haizhou Li |
| 2015 | ACII | Fundamental frequency modeling using wavelets for emotional voice conversion. | Huaiping Ming, Dong-Yan Huang, Minghui Dong, Haizhou Li, Lei Xie, Shaofei Zhang |
| 2015 | ASRU | Automatic prosody prediction for Chinese speech synthesis using BLSTM-RNN and embedding features. | Chuang Ding, Lei Xie, Jie Yan, Weini Zhang, Yang Liu |
| 2015 | DATE | Memristor based computation-in-memory architecture for data-intensive applications. | Said Hamdioui, Lei Xie, Hoang Anh Du Nguyen, Mottaqiallah Taouil, Koen Bertels, Henk Corporaal, Hailong Jiao, Francky Catthoor, Dirk J. Wouters, Eike Linn, Jan van Lunteren |
| 2015 | ICASSP | Photo-real talking head with deep bidirectional LSTM. | Bo Fan, Lijuan Wang, Frank K. Soong, Lei Xie |
| 2015 | ICASSP | Language independent query-by-example spoken term detection using N-best phone sequences and partial matching. | Haihua Xu, Peng Yang, Xiong Xiao, Lei Xie, Cheung-Chi Leung, Hongjie Chen, Jia Yu, Hang Lv, Lei Wang, Su Jun Leow, Bin Ma, Engsiong Chng, Haizhou Li |
| 2015 | ICCD | Fast boolean logic mapped on memristor crossbar. | Lei Xie, Hoang Anh Du Nguyen, Mottaqiallah Taouil, Koen Bertels, Said Hamdioui |
| 2015 | INFOCOM | Femto-matching: Efficient traffic offloading in heterogeneous cellular networks. | Wei Wang, Xiaobing Wu, Lei Xie, Sanglu Lu |
| 2015 | Interspeech | Parallel inference of dirichlet process Gaussian mixture models for unsupervised acoustic modeling: a feasibility study. | Hongjie Chen, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li |
| 2015 | Interspeech | BLSTM neural networks for speech driven head motion synthesis. | Chuang Ding, Pengcheng Zhu, Lei Xie |
| 2015 | Interspeech | An alternating optimization approach for phase retrieval. | Huaiping Ming, Dong-Yan Huang, Lei Xie, Haizhou Li, Minghui Dong |
| 2014 | ICASSP | Unsupervised broadcast news story segmentation using distance dependent Chinese restaurant processes. | Chao Yang, Lei Xie, Xiangzeng Zhou |
| 2014 | ICCCN | An energy efficient algorithm based on multi-topology routing in IP networks. | Lei Xie, Xiaoning Zhang, Sheng Wang |
| 2014 | ICIP | An ensemble of deep neural networks for object tracking. | Xiangzeng Zhou, Lei Xie, Peng Zhang, Yanning Zhang |
| 2014 | INFOCOM | Efficiently collecting histograms over RFID tags. | Lei Xie, Hao Han, Qun Li, Jie Wu, Sanglu Lu |
| 2014 | Interspeech | Speech-driven head motion synthesis using neural networks. | Chuang Ding, Pengcheng Zhu, Lei Xie, Dongmei Jiang, Zhong-Hua Fu |
| 2014 | Interspeech | Stereo acoustic echo suppression using widely linear filtering in the frequency domain. | Zhong-Hua Fu, Lei Xie |
| 2014 | Interspeech | A deep neural network approach for sentence boundary detection in broadcast news. | Chenglin Xu, Lei Xie, Guangpu Huang, Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2014 | Interspeech | Intrinsic spectral analysis based on temporal context features for query-by-example spoken term detection. | Peng Yang, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li |
| 2013 | ACL | Broadcast News Story Segmentation Using Manifold Learning on Latent Topic Distributions. | Xiaoming Lu, Lei Xie, Cheung-Chi Leung, Bin Ma, Haizhou Li |
| 2013 | GLOBECOM | An efficient indoor navigation scheme using RFID-based delay tolerant network. | Hao Ji, Lei Xie, Yafeng Yin, Sanglu Lu |
| 2013 | IAAI | Case-Based Meta-Prediction for Bioinformatics. | Xi Yun, Susan L. Epstein, Weiwei Han, Lei Xie |
| 2013 | ICASSP | Broadcast news story segmentation using latent topics on data manifold. | Xiaoming Lu, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li |
| 2013 | ICASSP | Measuring semantic similarity by contextualword connections in Chinese news story segmentation. | Xuecheng Nie, Wei Feng, Liang Wan, Lei Xie |
| 2013 | ICASSP | A tighter lower bound estimate for dynamic time warping. | Peng Yang, Lei Xie, Qiao Luan, Wei Feng |
| 2013 | ICASSP | A two layered data association approach for ball tracking. | Xiangzeng Zhou, Qiang Huang, Lei Xie, Stephen J. Cox |
| 2013 | ICCBR | Multi-Agent, Multi-Case-Based Reasoning. | Susan L. Epstein, Xi Yun, Lei Xie |
| 2013 | ICCCN | Efficient Protocols for Rule Checking in RFID Systems. | Yafeng Yin, Lei Xie, Sanglu Lu, Daoxu Chen |
| 2013 | ICPADS | Adaptive Accurate Indoor-Localization Using Passive RFID. | Xi Chen, Lei Xie, Chuyu Wang, Sanglu Lu |
| 2013 | IGARSS | A new compact three-component decomposition scheme. | Lei Xie, Hong Zhang, Chao Wang, Bo Zhang, Fan Wu, Yixian Tang |
| 2012 | GLOBECOM | Effective capacity region in a wireless multiuser OFDMA network. | Xiao Han, Huifang Chen, Lei Xie, Kuang Wang |
| 2012 | ICASSP | Acoustic TextTiling for story segmentation of spoken documents. | Lilei Zheng, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li |
| 2012 | Interspeech | Lexical Story Co-Segmentation of Chinese Broadcast News. | Wei Feng, Xuecheng Nie, Liang Wan, Lei Xie, Jianmin Jiang |
| 2012 | Interspeech | Speech Pattern Discovery using Audio-Visual Fusion and Canonical Correlation Analysis. | Lei Xie, Yinqing Xu, Lilei Zheng, Qiang Huang, Bingfeng Li |
| 2011 | Interspeech | Probabilistic Latent Semantic Analysis for Broadcast News Story Segmentation. | Mimi Lu, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li |
| 2010 | INFOCOM | Efficient Tag Identification in Mobile RFID Systems. | Lei Xie, Bo Sheng, Chiu C. Tan, Hao Han, Qun Li, Daoxu Chen |
| 2010 | Interspeech | Maximum lexical cohesion for fine-grained news story segmentation. | Zihan Liu, Lei Xie, Wei Feng |
| 2010 | Interspeech | Phoneme lattice based texttiling towards multilingual story segmentation. | Xiaoxuan Wang, Lei Xie, Bin Ma, Engsiong Chng, Haizhou Li |
| 2009 | ACCV | Multicue Graph Mincut for Image Segmentation. | Wei Feng, Lei Xie, Zhi-Qiang Liu |
| 2009 | ICNP | Achieving Efficiency and Fairness for Association Control in Vehicular Networks. | Lei Xie, Qun Li, Weizhen Mao, Jie Wu, Daoxu Chen |
| 2009 | ICPADS | A Decentralized Storage Scheme for Multi-Dimensional Range Queries over Sensor Networks. | Lei Xie, Lijun Chen, Daoxu Chen, Li Xie |
| 2008 | GLOBECOM | EEBASS: Energy-Efficient Balanced Storage Scheme for Sensor Networks. | Lei Xie, Lijun Chen, Daoxu Chen, Li Xie |
| 2007 | Interspeech | Modeling the statistical behavior of lexical chains to capture word cohesiveness for automatic story segmentation. | Shing-kai Chan, Lei Xie, Helen M. Meng |
| 2006 | ICASSP | An Articulatory Approach to Video-Realistic Mouth Animation. | Lei Xie, Zhi-Qiang Liu |
| 2006 | ICPR | Speech Animation Using Coupled Hidden Markov Models. | Lei Xie, Zhi-Qiang Liu |
| 2005 | ICMLC | Multi-stream Articulator Model with Adaptive Reliability Measure for Audio Visual Speech Recognition. | Lei Xie, Zhi-Qiang Liu |