Skip to content

Yanmin Qian

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

185

Venues

7

Active years

2010–2026

Best venue rank

A*

Where they publish

Papers

185 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIUSE: A Unified Model for Universal Sound Separation and Extraction.Hongyu Wang, Chenda Li, Xin Zhou, Shuai Wang, Yanmin Qian
2026ACLA Data-Centric Approach to Generalizable Speech Deepfake Detection.Wen Huang, Yuchen Mao, Yanmin Qian
2026ACLBeyond Sentence-level Labels: Integrating Conversational Context and Personal Experience for Natural Emotional Expression.Haiyang Sun, Chenyang Le, Wei Wang, Leying Zhang, Chuang Li, Bing Han, Chenda Li, Mengxiao Bi, Yanmin Qian
2025ACLSpeechFake: A Large-Scale Multilingual Speech Deepfake Dataset Incorporating Cutting-Edge Generation Methods.Wen Huang, Yanmei Gu, Zhiming Wang, Huijia Zhu, Yanmin Qian
2025ASRULess is More: Data Curation Matters in Scaling Speech Enhancement.Chenda Li, Wangyou Zhang, Wei Wang, Robin Scheibler, Kohei Saijo, Samuele Cornell, Yihui Fu, Marvin Sach, Zhaoheng Ni, Anurag Kumar, Tim Fingscheidt, Shinji Watanabe, Yanmin Qian
2025ASRUStellarTTS: Sparse Temporal Embedding for Low-Latency and Robust Speech Synthesis.Kaicheng Luo, Xuefei Gong, Yutao Sun, Jinling He, Yujie Hou, Xiaoyang Xing, Huiyan Li, Bing Han, Yanmin Qian
2025ASRUOOQ: Outlier-Oriented Quantization for Efficient Large Language Models.Haoyu Wang, Bei Liu, Hang Shao, Bo Xiao, Ke Zeng, Guanglu Wan, Yanmin Qian
2025ASRUURGENT-PK: Perceptually-Aligned Ranking Model Designed for Speech Enhancement Competition.Jiahe Wang, Chenda Li, Wei Wang, Wangyou Zhang, Samuele Cornell, Marvin Sach, Robin Scheibler, Kohei Saijo, Yihui Fu, Zhaoheng Ni, Anurag Kumar, Tim Fingscheidt, Shinji Watanabe, Yanmin Qian
2025ASRUImproving Speech Enhancement with Multi-Metric Supervision from Learned Quality Assessment.Wei Wang, Wangyou Zhang, Chenda Li, Jaitong Shi, Shinji Watanabe, Yanmin Qian
2025ASRUAdvancing Controllable Music Generation with Latent Rectified Flow Guided by Rhythm and Harmony.Haibin Yu, Jiayi Zhou, Wei Wang, Zhiming Wang, Huijia Zhu, Yanmin Qian
2025ICASSPGeneralizable Audio Deepfake Detection via Latent Space Refinement and Augmentation.Wen Huang, Yanmei Gu, Zhiming Wang, Huijia Zhu, Yanmin Qian
2025ICASSPAdvancing Non-intrusive Suppression on Enhancement Distortion for Noise Robust ASR.Wei Wang, Siyi Zhao, Yanmin Qian
2025ICASSPFlow-TSVAD: Target-Speaker Voice Activity Detection via Latent Flow Matching for Speaker Diarization.Zhengyang Chen, Bing Han, Shuai Wang, Yidi Jiang, Yanmin Qian
2025ICASSPEfficient Pruning for Large-Scale Seq2Seq Speech Models without Back-Propagation.Tianteng Gu, Bei Liu, Yanmin Qian
2025ICASSPData-Efficient Low-Complexity Acoustic Scene Classification via Distilling and Progressive Pruning.Bing Han, Wen Huang, Zhengyang Chen, Anbai Jiang, Pingyi Fan, Cheng Lu, Zhiqiang Lv, Jia Liu, Wei-Qiang Zhang, Yanmin Qian
2025ICASSPSLIDE: Integrating Speech Language Model with LLM for Spontaneous Spoken Dialogue Generation.Haitian Lu, Gaofeng Cheng, Liuping Luo, Leying Zhang, Yanmin Qian, Pengyuan Zhang
2025ICASSPAdvanced Zero-Shot Text-to-Speech for Background Removal and Preservation with Controllable Masked Speech Prediction.Leying Zhang, Wangyou Zhang, Zhengyang Chen, Yanmin Qian
2025InterspeechBR-ASR: Efficient and Scalable Bias Retrieval Framework for Contextual Biasing ASR in Speech LLM.Xun Gong, Anqi Lv, Wangyou Zhang, Zhiming Wang, Huijia Zhu, Yanmin Qian
2025InterspeechUltra-Low Bit Post-Training Quantization of Large Speech Models via K-Means Clustering and Mixed Precision Allocation.Tianteng Gu, Bei Liu, Haoyu Wang, Yanmin Qian
2025InterspeechRanking and Selection of Bias Words for Contextual Bias Speech Recognition.Haoxiang Hou, Xun Gong, Wangyou Zhang, Wei Wang, Yanmin Qian
2025InterspeechFrom Sharpness to Better Generalization for Speech Deepfake Detection.Wen Huang, Xuechen Liu, Xin Wang, Junichi Yamagishi, Yanmin Qian
2025InterspeechNovel Parasitic Dual-Scale Modeling for Efficient and Accurate Multilingual Speech Translation.Chenyang Le, Yinfeng Xia, Huiyan Li, Manhong Wang, Yutao Sun, Xingyang Ma, Yanmin Qian
2025InterspeechEfficient Multilingual ASR Finetuning via LoRA Language Experts.Jiahong Li, Yiwen Shao, Jianheng Zhuo, Chenda Li, Liliang Tang, Dong Yu, Yanmin Qian
2025InterspeechE2E-BPVC: End-to-End Background-Preserving Voice Conversion via In-Context Learning.Yihan Liu, Zhengyang Chen, Leying Zhang, Yanmin Qian
2025InterspeechMFLA: Monotonic Finite Look-ahead Attention for Streaming Speech Recognition.Yinfeng Xia, Huiyan Li, Chenyang Le, Manhong Wang, Yutao Sun, Xingyang Ma, Yanmin Qian
2025InterspeechLessons Learned from the URGENT 2024 Speech Enhancement Challenge.Wangyou Zhang, Kohei Saijo, Samuele Cornell, Robin Scheibler, Chenda Li, Zhaoheng Ni, Anurag Kumar, Marvin Sach, Wei Wang, Yihui Fu, Shinji Watanabe, Tim Fingscheidt, Yanmin Qian
2025InterspeechLightweight Front-end Enhancement for Robust ASR via Frame Resampling and Sub-Band Pruning.Siyi Zhao, Wei Wang, Yanmin Qian
2024ICASSPExploring Large Scale Pre-Trained Models for Robust Machine Anomalous Sound Detection.Bing Han, Zhiqiang Lv, Anbai Jiang, Wen Huang, Zhengyang Chen, Yufeng Deng, Jiawei Ding, Cheng Lu, Wei-Qiang Zhang, Pingyi Fan, Jia Liu, Yanmin Qian
2024ICASSPRobust Cross-Domain Speaker Verification with Multi-Level Domain Adapters.Wen Huang, Bing Han, Shuai Wang, Zhengyang Chen, Yanmin Qian
2024ICASSPPrompt-Driven Target Speech Diarization.Yidi Jiang, Zhengyang Chen, Ruijie Tao, Liqun Deng, Yanmin Qian, Haizhou Li
2024ICASSPOne-Shot Sensitivity-Aware Mixed Sparsity Pruning for Large Language Models.Hang Shao, Bei Liu, Yanmin Qian
2024ICASSPLeveraging in-the-wild Data for Effective Self-supervised Pretraining in Speaker Recognition.Shuai Wang, Qibing Bai, Qi Liu, Jianwei Yu, Zhengyang Chen, Bing Han, Yanmin Qian, Haizhou Li
2024ICASSPGeneration-Based Target Speech Extraction with Speech Discretization and Vocoder.Linfeng Yu, Wangyou Zhang, Chenpeng Du, Leying Zhang, Zheng Liang, Yanmin Qian
2024ICASSPImproving Design of Input Condition Invariant Speech Enhancement.Wangyou Zhang, Jee-weon Jung, Yanmin Qian
2024IJCAIInstructME: An Instruction Guided Music Edit Framework with Latent Diffusion Models.Bing Han, Junyu Dai, Weituo Hao, Xinyan He, Dong Guo, Jitong Chen, Yuxuan Wang, Yanmin Qian, Xuchen Song
2024InterspeechContextual Biasing Speech Recognition in Speech-enhanced Large Language Model.Xun Gong, Anqi Lv, Zhiming Wang, Yanmin Qian
2024InterspeechGenerating Speakers by Prompting Listener Impressions for Pre-trained Multi-Speaker Text-to-Speech Systems.Zhengyang Chen, Xuechen Liu, Erica Cooper, Junichi Yamagishi, Yanmin Qian
2024InterspeechSparseWAV: Fast and Accurate One-Shot Unstructured Pruning for Large Speech Foundation Models.Tianteng Gu, Bei Liu, Hang Shao, Yanmin Qian
2024InterspeechAnoPatch: Towards Better Consistency in Machine Anomalous Sound Detection.Anbai Jiang, Bing Han, Zhiqiang Lv, Yufeng Deng, Wei-Qiang Zhang, Xie Chen, Yanmin Qian, Jia Liu, Pingyi Fan
2024InterspeechWeSep: A Scalable and Flexible Toolkit Towards Generalizable Target Speaker Extraction.Shuai Wang, Ke Zhang, Shaoxiong Lin, Junjie Li, Xuefei Wang, Meng Ge, Jianwei Yu, Yanmin Qian, Haizhou Li
2024InterspeechBeyond Performance Plateaus: A Comprehensive Study on Scalability in Speech Enhancement.Wangyou Zhang, Kohei Saijo, Jee-weon Jung, Chenda Li, Shinji Watanabe, Yanmin Qian
2024InterspeechURGENT Challenge: Universality, Robustness, and Generalizability For Speech Enhancement.Wangyou Zhang, Robin Scheibler, Kohei Saijo, Samuele Cornell, Chenda Li, Zhaoheng Ni, Jan Pirklbauer, Marvin Sach, Shinji Watanabe, Tim Fingscheidt, Yanmin Qian
2023ASRUEfficient Text-Only Domain Adaptation For CTC-Based ASR.Chang Chen, Xun Gong, Yanmin Qian
2023ASRUThe Second Multi-Channel Multi-Party Meeting Transcription Challenge (M2MeT 2.0): A Benchmark for Speaker-Attributed ASR.Yuhao Liang, Mohan Shi, Fan Yu, Yangze Li, Shiliang Zhang, Zhihao Du, Qian Chen, Lei Xie, Yanmin Qian, Jian Wu, Zhuo Chen, Kong Aik Lee, Zhijie Yan, Hui Bu
2023ASRUImproving Speech Enhancement Using Audio Tagging Knowledge From Pre-Trained Representations and Multi-Task Learning.Shaoxiong Lin, Chao Zhang, Yanmin Qian
2023ASRUFAT-HuBERT: Front-End Adaptive Training of Hidden-Unit BERT For Distortion-Invariant Robust Speech Recognition.Dongning Yang, Wei Wang, Yanmin Qian
2023ASRUToward Universal Speech Enhancement For Diverse Input Conditions.Wangyou Zhang, Kohei Saijo, Zhong-Qiu Wang, Shinji Watanabe, Yanmin Qian
2023ASRUExploring Time-Frequency Domain Target Speaker Extraction For Causal and Non-Causal Processing.Wangyou Zhang, Lei Yang, Yanmin Qian
2023ICASSPLongFNT: Long-Form Speech Recognition with Factorized Neural Transducer.Xun Gong, Yu Wu, Jinyu Li, Shujie Liu, Rui Zhao, Xie Chen, Yanmin Qian
2023ICASSPFactorized AED: Factorized Attention-Based Encoder-Decoder for Text-Only Domain Adaptive ASR.Xun Gong, Wei Wang, Hang Shao, Xie Chen, Yanmin Qian
2023ICASSPExploring Binary Classification Loss for Speaker Verification.Bing Han, Zhengyang Chen, Yanmin Qian
2023ICASSPImproving Dino-Based Self-Supervised Speaker Verification with Progressive Cluster-Aware Training.Bing Han, Wen Huang, Zhengyang Chen, Yanmin Qian
2023ICASSPRobust Audio-Visual ASR with Unified Cross-Modal Attention.Jiahong Li, Chenda Li, Yifei Wu, Yanmin Qian
2023ICASSPTarget Sound Extraction with Variable Cross-Modality Clues.Chenda Li, Yao Qian, Zhuo Chen, Dongmei Wang, Takuya Yoshioka, Shujie Liu, Yanmin Qian, Michael Zeng
2023ICASSPMulti-Speaker End-to-End Multi-Modal Speaker Diarization System for the MISP 2022 Challenge.Tao Liu, Zhengyang Chen, Yanmin Qian, Kai Yu
2023ICASSPPredictive Skim: Contrastive Predictive Coding for Low-Latency Online Speech Separation.Chenda Li, Yifei Wu, Yanmin Qian
2023ICASSPJoint Discriminator and Transfer Based Fast Domain Adaptation For End-To-End Speech Recognition.Hang Shao, Tian Tan, Wei Wang, Xun Gong, Yanmin Qian
2023ICASSPLowbit Neural Network Quantization for Speaker Verification.Haoyu Wang, Bei Liu, Yifei Wu, Zhengyang Chen, Yanmin Qian
2023ICASSPWespeaker: A Research and Production Oriented Speaker Embedding Learning Toolkit.Hongji Wang, Chengdong Liang, Shuai Wang, Zhengyang Chen, Binbin Zhang, Xu Xiang, Yanlei Deng, Yanmin Qian
2023ICASSPHuBERT-AGG: Aggregated Representation Distillation of Hidden-Unit Bert for Robust Speech Recognition.Wei Wang, Yanmin Qian
2023ICASSPLight-Weight Visualvoice: Neural Network Quantization On Audio Visual Speech Separation.Yifei Wu, Chenda Li, Yanmin Qian
2023ICASSPCode-Switching Text Generation and Injection in Mandarin-English ASR.Haibin Yu, Yuxuan Hu, Yao Qian, Ma Jin, Linquan Liu, Shujie Liu, Yu Shi, Yanmin Qian, Edward Lin, Michael Zeng
2023ICASSPAdaptive Large Margin Fine-Tuning For Robust Speaker Verification.Leying Zhang, Zhengyang Chen, Yanmin Qian
2023InterspeechAttention-based Encoder-Decoder Network for End-to-End Neural Speaker Diarization with Target Speaker Attractor.Zhengyang Chen, Bing Han, Shuai Wang, Yanmin Qian
2023InterspeechBuild a SRE Challenge System: Lessons from VoxSRC 2022 and CNSRC 2022.Zhengyang Chen, Bing Han, Xu Xiang, Houjun Huang, Bei Liu, Yanmin Qian
2023InterspeechAdapting Multi-Lingual ASR Models for Handling Multiple Talkers.Chenda Li, Yao Qian, Zhuo Chen, Naoyuki Kanda, Dongmei Wang, Takuya Yoshioka, Yanmin Qian, Michael Zeng
2023InterspeechReversible Neural Networks for Memory-Efficient Speaker Verification.Bei Liu, Yanmin Qian
2023InterspeechECAPA++: Fine-grained Deep Embedding Learning for TDNN Based Speaker Verification.Bei Liu, Yanmin Qian
2023InterspeechExtremely Low Bit Quantization for Mobile Speaker Verification Systems Under 1MB Memory.Bei Liu, Haoyu Wang, Yanmin Qian
2023InterspeechText Only Domain Adaptation with Phoneme Guided Data Splicing for End-to-End Speech Recognition.Wei Wang, Xun Gong, Hang Shao, Dongning Yang, Yanmin Qian
2023InterspeechAdaptive Neural Network Quantization For Lightweight Speaker Verification.Haoyu Wang, Bei Liu, Yifei Wu, Yanmin Qian
2023InterspeechUniSplice: Universal Cross-Lingual Data Splicing for Low-Resource ASR.Wei Wang, Yanmin Qian
2023InterspeechOverlap Aware Continuous Speech Separation without Permutation Invariant Training.Linfeng Yu, Wangyou Zhang, Chenda Li, Yanmin Qian
2023InterspeechWeakly-Supervised Speech Pre-training: A Case Study on Target Speech Recognition.Wangyou Zhang, Yanmin Qian
2023InterspeechFast and Efficient Multilingual Self-Supervised Pre-training for Low-Resource Speech Recognition.Zhilong Zhang, Wei Wang, Yanmin Qian
2022ICASSPLarge-Scale Self-Supervised Speech Representation Learning for Automatic Speaker Verification.Zhengyang Chen, Sanyuan Chen, Yu Wu, Yao Qian, Chengyi Wang, Shujie Liu, Yanmin Qian, Michael Zeng
2022ICASSPMLP-SVNET: A Multi-Layer Perceptrons Based Network for Speaker Verification.Bing Han, Zhengyang Chen, Bei Liu, Yanmin Qian
2022ICASSPLocal Information Modeling with Self-Attention for Speaker Verification.Bing Han, Zhengyang Chen, Yanmin Qian
2022ICASSPSelf-Knowledge Distillation via Feature Enhancement for Speaker Verification.Bei Liu, Haoyu Wang, Zhengyang Chen, Shuai Wang, Yanmin Qian
2022ICASSPSkim: Skipping Memory Lstm for Low-Latency Real-Time Continuous Speech Separation.Chenda Li, Lei Yang, Weiqin Wang, Yanmin Qian
2022ICASSPThe Sjtu System For Multimodal Information Based Speech Processing Challenge 2021.Wei Wang, Xun Gong, Yifei Wu, Zhikai Zhou, Chenda Li, Wangyou Zhang, Bing Han, Yanmin Qian
2022ICASSPOptimizing Alignment of Speech and Language Latent Spaces for End-To-End Speech Recognition and Understanding.Wei Wang, Shuo Ren, Yao Qian, Shujie Liu, Yu Shi, Yanmin Qian, Michael Zeng
2022ICASSPTime-Domain Audio-Visual Speech Separation on Low Quality Videos.Yifei Wu, Chenda Li, Jinfeng Bai, Zhongqin Wu, Yanmin Qian
2022ICASSPSummary on the ICASSP 2022 Multi-Channel Multi-Party Meeting Transcription Grand Challenge.Fan Yu, Shiliang Zhang, Pengcheng Guo, Yihui Fu, Zhihao Du, Siqi Zheng, Weilong Huang, Lei Xie, Zheng-Hua Tan, DeLiang Wang, Yanmin Qian, Kong Aik Lee, Zhijie Yan, Bin Ma, Xin Xu, Hui Bu
2022ICASSPPunctuation Prediction for Streaming On-Device Speech Recognition.Zhikai Zhou, Tian Tan, Yanmin Qian
2022ICASSPExploring Effective Data Utilization for Low-Resource Speech Recognition.Zhikai Zhou, Wei Wang, Wangyou Zhang, Yanmin Qian
2022InterspeechKnowledge Transfer and Distillation from Autoregressive to Non-Autoregessive Speech Recognition.Xun Gong, Zhikai Zhou, Yanmin Qian
2022InterspeechSelf-Supervised Speaker Verification Using Dynamic Loss-Gate and Label Correction.Bing Han, Zhengyang Chen, Yanmin Qian
2022InterspeechMSDWild: Multi-modal Speaker Diarization Dataset in the Wild.Tao Liu, Shuai Fan, Xu Xiang, Hongbo Song, Shaoxiong Lin, Jiaqi Sun, Tianyuan Han, Siyuan Chen, Binwei Yao, Sen Liu, Yifei Wu, Yanmin Qian, Kai Yu
2022InterspeechAttentive Feature Fusion for Robust Speaker Verification.Bei Liu, Zhengyang Chen, Yanmin Qian
2022InterspeechDual Path Embedding Learning for Speaker Verification with Triplet Attention.Bei Liu, Zhengyang Chen, Yanmin Qian
2022InterspeechDF-ResNet: Boosting Speaker Verification Performance with Depth-First Design.Bei Liu, Zhengyang Chen, Shuai Wang, Haoyu Wang, Bing Han, Yanmin Qian
2022InterspeechESPnet-SE++: Speech Enhancement for Robust Speech Recognition, Translation, and Understanding.Yen-Ju Lu, Xuankai Chang, Chenda Li, Wangyou Zhang, Samuele Cornell, Zhaoheng Ni, Yoshiki Masuyama, Brian Yan, Robin Scheibler, Zhong-Qiu Wang, Yu Tsao, Yanmin Qian, Shinji Watanabe
2022InterspeechSeparating Long-Form Speech with Group-wise Permutation Invariant Training.Wangyou Zhang, Zhuo Chen, Naoyuki Kanda, Shujie Liu, Jinyu Li, Sefik Emre Eskimez, Takuya Yoshioka, Xiong Xiao, Zhong Meng, Yanmin Qian, Furu Wei
2022InterspeechEnroll-Aware Attentive Statistics Pooling for Target Speaker Verification.Leying Zhang, Zhengyang Chen, Yanmin Qian
2021ICASSPAISpeech-SJTU ASR System for the Accented English Speech Recognition Challenge.Tian Tan, Yizhou Lu, Rao Ma, Sen Zhu, Jiaqi Guo, Yanmin Qian
2021ICASSPConvolutive Transfer Function Invariant SDR Training Criteria for Multi-Channel Reverberant Speech Separation.Christoph Bddeker, Wangyou Zhang, Tomohiro Nakatani, Keisuke Kinoshita, Tsubasa Ochiai, Marc Delcroix, Naoyuki Kamo, Yanmin Qian, Reinhold Haeb-Umbach
2021ICASSPSelf-Supervised Learning Based Domain Adaptation for Robust Speaker Verification.Zhengyang Chen, Shuai Wang, Yanmin Qian
2021ICASSPSynAug: Synthesis-Based Data Augmentation for Text-Dependent Speaker Verification.Chenpeng Du, Bing Han, Shuai Wang, Yanmin Qian, Kai Yu
2021ICASSPAISpeech-SJTU Accent Identification System for the Accented English Speech Recognition Challenge.Houjun Huang, Xu Xiang, Yexin Yang, Rao Ma, Yanmin Qian
2021ICASSPUnit Selection Synthesis Based Data Augmentation for Fixed Phrase Speaker Verification.Houjun Huang, Xu Xiang, Fei Zhao, Shuai Wang, Yanmin Qian
2021ICASSPDual-Path Modeling for Long Recording Speech Separation in Meetings.Chenda Li, Zhuo Chen, Yi Luo, Cong Han, Tianyan Zhou, Keisuke Kinoshita, Marc Delcroix, Shinji Watanabe, Yanmin Qian
2021ICASSPThe Accented English Speech Recognition Challenge 2020: Open Datasets, Tracks, Baselines, Results and Methods.Xian Shi, Fan Yu, Yizhou Lu, Yuhao Liang, Qiangze Feng, Daliang Wang, Yanmin Qian, Lei Xie
2021ICASSPTowards Data Selection on TTS Data for Children's Speech Recognition.Wei Wang, Zhikai Zhou, Yizhou Lu, Hongji Wang, Chenpeng Du, Yanmin Qian
2021ICASSPEnd-to-End Dereverberation, Beamforming, and Speech Recognition with Improved Numerical Stability and Advanced Frontend.Wangyou Zhang, Christoph Bddeker, Shinji Watanabe, Tomohiro Nakatani, Marc Delcroix, Keisuke Kinoshita, Tsubasa Ochiai, Naoyuki Kamo, Reinhold Haeb-Umbach, Yanmin Qian
2021InterspeechLayer-Wise Fast Adaptation for End-to-End Multi-Accent Speech Recognition.Xun Gong, Yizhou Lu, Zhikai Zhou, Yanmin Qian
2021InterspeechThe SJTU System for Short-Duration Speaker Verification Challenge 2021.Bing Han, Zhengyang Chen, Zhikai Zhou, Yanmin Qian
2021InterspeechBasis-MelGAN: Efficient Neural Vocoder Based on Audio Decomposition.Zhengxi Liu, Yanmin Qian
2021InterspeechAudio-Visual Multi-Talker Speech Recognition in a Cocktail Party.Yifei Wu, Chenda Li, Song Yang, Zhongqin Wu, Yanmin Qian
2021InterspeechKnowledge Distillation from Multi-Modality to Single-Modality for Person Verification.Leying Zhang, Zhengyang Chen, Yanmin Qian
2020ICASSPEnd-To-End Multi-Speaker Speech Recognition With Transformer.Xuankai Chang, Wangyou Zhang, Yanmin Qian, Jonathan Le Roux, Shinji Watanabe
2020ICASSPChannel Invariant Speaker Embedding Learning with Joint Multi-Task and Adversarial Training.Zhengyang Chen, Shuai Wang, Yanmin Qian, Kai Yu
2020ICASSPDeep Audio-Visual Speech Separation with Attention Mechanism.Chenda Li, Yanmin Qian
2020ICASSPText Adaptation for Speaker Verification with Speaker-Text Factorized Embeddings.Yexin Yang, Shuai Wang, Xun Gong, Yanmin Qian, Kai Yu
2020InterspeechMulti-Modality Matters: A Performance Leap on VoxCeleb.Zhengyang Chen, Shuai Wang, Yanmin Qian
2020InterspeechAdversarial Domain Adaptation for Speaker Verification Using Partially Shared Network.Zhengyang Chen, Shuai Wang, Yanmin Qian
2020InterspeechListen, Watch and Understand at the Cocktail Party: Audio-Visual-Contextual Speech Separation.Chenda Li, Yanmin Qian
2020InterspeechBi-Encoder Transformer Network for Mandarin-English Code-Switching Speech Recognition Using Mixture of Experts.Yizhou Lu, Mingkun Huang, Hao Li, Jiaqi Guo, Yanmin Qian
2020InterspeechDual-Adversarial Domain Adaptation for Generalized Replay Attack Detection.Hongji Wang, Heinrich Dinkel, Shuai Wang, Yanmin Qian, Kai Yu
2020InterspeechLearning Contextual Language Embeddings for Monaural Multi-Talker Speech Recognition.Wangyou Zhang, Yanmin Qian
2020InterspeechEnd-to-End Far-Field Speech Recognition with Unified Dereverberation and Beamforming.Wangyou Zhang, Aswin Shanmugam Subramanian, Xuankai Chang, Shinji Watanabe, Yanmin Qian
2019ASRUMIMO-Speech: End-to-End Multi-Channel Multi-Speaker Speech Recognition.Xuankai Chang, Wangyou Zhang, Yanmin Qian, Jonathan Le Roux, Shinji Watanabe
2019ASRUExploring Model Units and Training Strategies for End-to-End Speech Recognition.Mingkun Huang, Yizhou Lu, Lan Wang, Yanmin Qian, Kai Yu
2019ASRUGANs for Children: A Generative Data Augmentation Strategy for Children Speech Recognition.Peiyao Sheng, Zhuolin Yang, Yanmin Qian
2019ASRUEnd-to-End Overlapped Speech Detection and Speaker Counting with Raw Waveform.Wangyou Zhang, Man Sun, Lan Wang, Yanmin Qian
2019ICASSPEnd-to-end Monaural Multi-speaker ASR System without Pretraining.Xuankai Chang, Yanmin Qian, Kai Yu, Shinji Watanabe
2019ICASSPKnowledge Distillation for Small Foot-print Deep Speaker Embedding.Shuai Wang, Yexin Yang, Tianzhe Wang, Yanmin Qian, Kai Yu
2019InterspeechJoint Decoding of CTC Based Systems for Speech Recognition.Jiaqi Guo, Yongbin You, Yanmin Qian, Kai Yu
2019InterspeechProsody Usage Optimization for Children Speech Recognition with Zero Resource Children Speech.Chenda Li, Yanmin Qian
2019InterspeechCross-Domain Replay Spoofing Attack Detection Using Domain Adversarial Training.Hongji Wang, Heinrich Dinkel, Shuai Wang, Yanmin Qian, Kai Yu
2019InterspeechOn the Usage of Phonetic Information for Text-Independent Speaker Embedding Extraction.Shuai Wang, Johan Rohdin, Luks Burget, Oldrich Plchot, Yanmin Qian, Kai Yu, Jan Cernock
2019InterspeechData Augmentation Using Variational Autoencoder for Embedding Based Speaker Verification.Zhanghao Wu, Shuai Wang, Yanmin Qian, Kai Yu
2019InterspeechThe SJTU Robust Anti-Spoofing System for the ASVspoof 2019 Challenge.Yexin Yang, Hongji Wang, Heinrich Dinkel, Zhengyang Chen, Shuai Wang, Yanmin Qian, Kai Yu
2019InterspeechKnowledge Distillation for End-to-End Monaural Multi-Talker ASR System.Wangyou Zhang, Xuankai Chang, Yanmin Qian
2019InterspeechRobust DOA Estimation Based on Convolutional Neural Network and Time-Frequency Masking.Wangyou Zhang, Ying Zhou, Yanmin Qian
2018ICASSPKnowledge Transfer in Permutation Invariant Training for Single-Channel Multi-Talker Speech Recognition.Tian Tan, Yanmin Qian, Dong Yu
2018ICASSPAdaptive Permutation Invariant Training with Auxiliary Information for Monaural Multi-Talker Speech Recognition.Xuankai Chang, Yanmin Qian, Dong Yu
2018ICASSPFast Adaptation on Deepmixture Generative Network Based Acoustic Modeling.Wen Ding, Tian Tan, Yanmin Qian
2018ICASSPGenerative Adversarial Networks Based Data Augmentation for Noise Robust Speech Recognition.Hu Hu, Tian Tan, Yanmin Qian
2018ICASSPJoint I-Vector with End-to-End System for Short Duration Text-Independent Speaker Verification.Zili Huang, Shuai Wang, Yanmin Qian
2018ICASSPNoise Robust Speech Recognition on Aurora4 by Humans and Machines.Yanmin Qian, Tian Tan, Hu Hu, Qi Liu
2018ICASSPFocal Kl-Divergence Based Dilated Convolutional Neural Networks for Co-Channel Speaker Identification.Shuai Wang, Yanmin Qian, Kai Yu
2018ICASSPRobust Mask Estimation By Integrating Neural Network-Based and Clustering-Based Approaches for Adaptive Acoustic Beamforming.Ying Zhou, Yanmin Qian
2018InterspeechMonaural Multi-Talker Speech Recognition with Attention Mechanism and Gated Convolutional Networks.Xuankai Chang, Yanmin Qian, Dong Yu
2018InterspeechPermutation Invariant Training of Generative Adversarial Network for Monaural Speech Separation.Lianwu Chen, Meng Yu, Yanmin Qian, Dan Su, Dong Yu
2018InterspeechKnowledge Distillation for Sequence Model.Mingkun Huang, Yongbin You, Zhehuai Chen, Yanmin Qian, Kai Yu
2018InterspeechDeep Extractor Network for Target Speaker Recovery from Single Channel Speech Mixtures.Jun Wang, Jie Chen, Dan Su, Lianwu Chen, Meng Yu, Yanmin Qian, Dong Yu
2017ASRUFuture vector enhanced LSTM language model for LVCSR.Qi Liu, Yanmin Qian, Kai Yu
2017ICASSPEnd-to-end spoofing detection with raw waveform CLDNNS.Heinrich Dinkel, Nanxin Chen, Yanmin Qian, Kai Yu
2017IJCNNSmall-footprint convolutional neural network for spoofing detection.Heinrich Dinkel, Yanmin Qian, Kai Yu
2017InterspeechWhat Does the Speaker Embedding Encode?Shuai Wang, Yanmin Qian, Kai Yu
2017InterspeechBinary Deep Neural Networks for Speech Recognition.Xu Xiang, Yanmin Qian, Kai Yu
2017InterspeechRecognizing Multi-Talker Speech with Permutation Invariant Training.Dong Yu, Xuankai Chang, Yanmin Qian
2016ICASSPJoint acoustic factor learning for robust deep neural network based automatic speech recognition.Souvik Kundu, Gautam Mantena, Yanmin Qian, Tian Tan, Marc Delcroix, Khe Chai Sim
2016ICASSPAn investigation into using parallel data for far-field speech recognition.Yanmin Qian, Tian Tan, Dong Yu
2016ICASSPIntegrated adaptation with multi-factor joint-learning for far-field speech recognition.Yanmin Qian, Tian Tan, Dong Yu, Yu Zhang
2016ICASSPSpeaker-aware training of LSTM-RNNS for acoustic modelling.Tian Tan, Yanmin Qian, Dong Yu, Souvik Kundu, Liang Lu, Khe Chai Sim, Xiong Xiao, Yu Zhang
2016ICASSPImproved DNN-based segmentation for multi-genre broadcast audio.Linlin Wang, Chao Zhang, Philip C. Woodland, Mark J. F. Gales, Panagiota Karanasou, Pierre Lanchantin, Xunying Liu, Yanmin Qian
2016InterspeechUnrestricted Vocabulary Keyword Spotting Using LSTM-CTC.Yimeng Zhuang, Xuankai Chang, Yanmin Qian, Kai Yu
2015ASRUSpeaker diarisation and longitudinal linking in multi-genre broadcast data.Penny Karanasou, Mark J. F. Gales, Pierre Lanchantin, Xunying Liu, Yanmin Qian, Linlin Wang, Philip C. Woodland, Chao Zhang
2015ASRUThe development of the cambridge university alignment systems for the multi-genre broadcast challenge.Pierre Lanchantin, Mark J. F. Gales, Penny Karanasou, Xunying Liu, Yanmin Qian, Linlin Wang, Philip C. Woodland, Chao Zhang
2015ASRUMulti-task joint-learning of deep neural networks for robust speech recognition.Yanmin Qian, Maofan Yin, Yongbin You, Kai Yu
2015ASRUCambridge university transcription systems for the multi-genre broadcast challenge.Philip C. Woodland, Xunying Liu, Yanmin Qian, Chao Zhang, Mark J. F. Gales, Penny Karanasou, Pierre Lanchantin, Linlin Wang
2015ICASSPA novel static parameter calculation method for model compensation.Suliang Bu, Yunxin Zhao, Yanmin Qian, Kai Yu
2015ICASSPRecurrent neural network language model with structured word embeddings for speech recognition.Tianxing He, Xu Xiang, Yanmin Qian, Kai Yu
2015ICASSPCluster adaptive training for deep neural network.Tian Tan, Yanmin Qian, Maofan Yin, Yimeng Zhuang, Kai Yu
2015IJCNNAutomatic model redundancy reduction for fast back-propagation for deep neural networks in speech recognition.Yanmin Qian, Tianxing He, Wei Deng, Kai Yu
2015InterspeechVery deep convolutional neural networks for LVCSR.Mengxiao Bi, Yanmin Qian, Kai Yu
2015InterspeechRobust deep feature for spoofing detection - the SJTU system for ASVspoof 2015 challenge.Nanxin Chen, Yanmin Qian, Heinrich Dinkel, Bo Chen, Kai Yu
2015InterspeechMulti-task learning for text-dependent speaker verification.Nanxin Chen, Yanmin Qian, Kai Yu
2015InterspeechParagraph vector based topic model for language model adaptation.Wengong Jin, Tianxing He, Yanmin Qian, Kai Yu
2014ICASSPSecond order vector taylor series based robust speech recognition.Suliang Bu, Yanmin Qian, Khe Chai Sim, Yongbin You, Kai Yu
2014ICASSPStochastic data sweeping for fast DNN training.Wei Deng, Yanmin Qian, Yuchen Fan, Tianfan Fu, Kai Yu
2014ICASSPReshaping deep neural network for fast decoding by node-pruning.Tianxing He, Yuchen Fan, Yanmin Qian, Tian Tan, Kai Yu
2014IJCNNSpeaker verification with deep features.Yuan Liu, Tianfan Fu, Yuchen Fan, Yanmin Qian, Kai Yu
2014InterspeechA novel dynamic parameters calculation approach for model compensation.Suliang Bu, Yanmin Qian, Kai Yu
2014InterspeechTandem deep features for text-dependent speaker verification.Tianfan Fu, Yanmin Qian, Yuan Liu, Kai Yu
2013ASRUCombination of data borrowing strategies for low-resource LVCSR.Yanmin Qian, Kai Yu, Jia Liu
2013InterspeechMLP-HMM two-stage unsupervised training for low-resource languages on conversational telephone speech recognition.Yanmin Qian, Jia Liu
2012ICASSPGenerating exact lattices in the WFST framework.Daniel Povey, Mirko Hannemann, Gilles Boulianne, Luks Burget, Arnab Ghoshal, Milos Janda, Martin Karafit, Stefan Kombrink, Petr Motlcek, Yanmin Qian, Korbinian Riedhammer, Karel Vesel, Ngoc Thang Vu
2012InterspeechCross-Lingual and Ensemble MLPs Strategies for Low-Resource Speech Recognition.Yanmin Qian, Jia Liu
2012InterspeechArticulatory Feature based Multilingual MLPs for Low-Resource Speech Recognition.Yanmin Qian, Jia Liu
2011ASRUStrategies for using MLP based features with limited target-language training data.Yanmin Qian, Ji Xu, Daniel Povey, Jia Liu
2011InterspeechState-Level Data Borrowing for Low-Resource Speech Recognition Based on Subspace GMMs.Yanmin Qian, Daniel Povey, Jia Liu
2010ICASSPPhone modeling and combining discriminative training for mandarinenglish bilingual speech recognition.Yanmin Qian, Jia Liu