Skip to content

Zhong Meng

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

55

Venues

4

Active years

2016–2024

Best venue rank

A

Where they publish

Papers

55 indexed papers, newest first.

YearVenueTitleAuthors
2024ICASSPExtreme Encoder Output Frame Rate Reduction: Improving Computational Latencies of Large End-to-End Models.Rohit Prabhavalkar, Zhong Meng, Weiran Wang, Adam Stooke, Xingyu Cai, Yanzhang He, Arun Narayanan, Dongseong Hwang, Tara N. Sainath, Pedro J. Moreno
2024ICASSPAugmenting Conformers With Structured State-Space Sequence Models For Online Speech Recognition.Haozhe Shan, Albert Gu, Zhong Meng, Weiran Wang, Krzysztof Choromanski, Tara N. Sainath
2024ICASSPA Comparison of Parameter-Efficient ASR Domain Adaptation Methods for Universal Speech and Language Models.Khe Chai Sim, Zhouyuan Huo, Tsendsuren Munkhdalai, Nikhil Siddhartha, Adam Stooke, Zhong Meng, Bo Li, Tara N. Sainath
2024InterspeechEfficiently Train ASR Models that Memorize Less and Perform Better with Per-core Clipping.Lun Wang, Om Thakkar, Zhong Meng, Nicole Rafidi, Rohit Prabhavalkar, Arun Narayanan
2024InterspeechSpeech Prefix-Tuning with RNNT Loss for Improving LLM Predictions.Murali Karthick Baskar, Andrew Rosenberg, Bhuvana Ramabhadran, Neeraj Gaur, Zhong Meng
2024InterspeechText Injection for Neural Contextual Biasing.Zhong Meng, Zelin Wu, Rohit Prabhavalkar, Cal Peyser, Weiran Wang, Nanxin Chen, Tara N. Sainath, Bhuvana Ramabhadran
2024InterspeechContextual Biasing with the Knuth-Morris-Pratt Matching Algorithm.Weiran Wang, Zelin Wu, Diamantino Caseiro, Tsendsuren Munkhdalai, Khe Chai Sim, Pat Rondon, Golan Pundak, Gan Song, Rohit Prabhavalkar, Zhong Meng, Ding Zhao, Tara Sainath, Yanzhang He, Pedro Moreno Mengibar
2024NAACLMassive End-to-end Speech Recognition Models with Time Reduction.Weiran Wang, Rohit Prabhavalkar, Haozhe Shan, Zhong Meng, Dongseong Hwang, Qiujia Li, Khe Chai Sim, Bo Li, James Qin, Xingyu Cai, Adam Stooke, Chengjian Zheng, Yanzhang He, Tara N. Sainath, Pedro Moreno Mengibar
2024NAACLDeferred NAM: Low-latency Top-K Context Injection via Deferred Context Encoding for Non-Streaming ASR.Zelin Wu, Gan Song, Christopher Li, Pat Rondon, Zhong Meng, Xavier Velez, Weiran Wang, Diamantino Caseiro, Golan Pundak, Tsendsuren Munkhdalai, Angad Chandorkar, Rohit Prabhavalkar
2023ICASSPJEIT: Joint End-to-End Model and Internal Language Model Training for Speech Recognition.Zhong Meng, Weiran Wang, Rohit Prabhavalkar, Tara N. Sainath, Tongzhou Chen, Ehsan Variani, Yu Zhang, Bo Li, Andrew Rosenberg, Bhuvana Ramabhadran
2023InterspeechText Injection for Capitalization and Turn-Taking Prediction in Speech Models.Shaan Bijwadia, Shuo-Yiin Chang, Weiran Wang, Zhong Meng, Hao Zhang
2023InterspeechImproving Joint Speech-Text Representations Without Alignment.Cal Peyser, Zhong Meng, Rohit Prabhavalkar, Andrew Rosenberg, Tara N. Sainath, Michael Picheny, Kyunghyun Cho, Ke Hu
2022ICASSPFactorized Neural Transducer for Efficient Language Model Adaptation.Xie Chen, Zhong Meng, Sarangarajan Parthasarathy, Jinyu Li
2022ICASSPTranscribe-to-Diarize: Neural Speaker Diarization for Unlimited Number of Speakers Using End-to-End Speaker-Attributed ASR.Naoyuki Kanda, Xiong Xiao, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Takuya Yoshioka
2022ICASSPContinuous Speech Separation with Recurrent Selective Attention Network.Yixuan Zhang, Zhuo Chen, Jian Wu, Takuya Yoshioka, Peidong Wang, Zhong Meng, Jinyu Li
2022InterspeechStreaming Speaker-Attributed ASR with Token-Level Speaker Embeddings.Naoyuki Kanda, Jian Wu, Yu Wu, Xiong Xiao, Zhong Meng, Xiaofei Wang, Yashesh Gaur, Zhuo Chen, Jinyu Li, Takuya Yoshioka
2022InterspeechStreaming Multi-Talker ASR with Token-Level Serialized Output Training.Naoyuki Kanda, Jian Wu, Yu Wu, Xiong Xiao, Zhong Meng, Xiaofei Wang, Yashesh Gaur, Zhuo Chen, Jinyu Li, Takuya Yoshioka
2022InterspeechInternal Language Model Adaptation with Text-Only Data for End-to-End Speech Recognition.Zhong Meng, Yashesh Gaur, Naoyuki Kanda, Jinyu Li, Xie Chen, Yu Wu, Yifan Gong
2022InterspeechSeparating Long-Form Speech with Group-wise Permutation Invariant Training.Wangyou Zhang, Zhuo Chen, Naoyuki Kanda, Shujie Liu, Jinyu Li, Sefik Emre Eskimez, Takuya Yoshioka, Xiong Xiao, Zhong Meng, Yanmin Qian, Furu Wei
2021ASRUA Comparative Study of Modular and Joint Approaches for Speaker-Attributed ASR on Monaural Long-Form Audio.Naoyuki Kanda, Xiong Xiao, Jian Wu, Tianyan Zhou, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Takuya Yoshioka
2021ICASSPHypothesis Stitcher for End-to-End Speaker-Attributed ASR on Long-Form Multi-Talker Recordings.Xuankai Chang, Naoyuki Kanda, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Takuya Yoshioka
2021ICASSPMinimum Bayes Risk Training for End-to-End Speaker-Attributed ASR.Naoyuki Kanda, Zhong Meng, Liang Lu, Yashesh Gaur, Xiaofei Wang, Zhuo Chen, Takuya Yoshioka
2021ICASSPInternal Language Model Training for Domain-Adaptive End-To-End Speech Recognition.Zhong Meng, Naoyuki Kanda, Yashesh Gaur, Sarangarajan Parthasarathy, Eric Sun, Liang Lu, Xie Chen, Jinyu Li, Yifan Gong
2021ICASSPSequence-Level Self-Teaching Regularization.Eric Sun, Liang Lu, Zhong Meng, Yifan Gong
2021InterspeechOn Minimum Word Error Rate Training of the Hybrid Autoregressive Transducer.Liang Lu, Zhong Meng, Naoyuki Kanda, Jinyu Li, Yifan Gong
2021InterspeechImproving RNN-T for Domain Scaling Using Semi-Supervised Training with Neural TTS.Yan Deng, Rui Zhao, Zhong Meng, Xie Chen, Bing Liu, Jinyu Li, Yifan Gong, Lei He
2021InterspeechEnd-to-End Speaker-Attributed ASR with Transformer.Naoyuki Kanda, Guoli Ye, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Takuya Yoshioka
2021InterspeechLarge-Scale Pre-Training of End-to-End Multi-Talker ASR for Meeting Transcription with Single Distant Microphone.Naoyuki Kanda, Guoli Ye, Yu Wu, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Takuya Yoshioka
2021InterspeechMinimum Word Error Rate Training with Language Model Fusion for End-to-End Speech Recognition.Zhong Meng, Yu Wu, Naoyuki Kanda, Liang Lu, Xie Chen, Guoli Ye, Eric Sun, Jinyu Li, Yifan Gong
2021InterspeechImproving Multilingual Transformer Transducer Models by Reducing Language Confusions.Eric Sun, Jinyu Li, Zhong Meng, Yu Wu, Jian Xue, Shujie Liu, Yifan Gong
2020ICASSPContinuous Speech Separation: Dataset and Analysis.Zhuo Chen, Takuya Yoshioka, Liang Lu, Tianyan Zhou, Zhong Meng, Yi Luo, Jian Wu, Xiong Xiao, Jinyu Li
2020ICASSPHigh-Accuracy and Low-Latency Speech Recognition with Two-Head Contextual Layer Trajectory LSTM Model.Jinyu Li, Rui Zhao, Eric Sun, Jeremy Heng Meng Wong, Amit Das, Zhong Meng, Yifan Gong
2020ICASSPL-Vector: Neural Label Embedding for Domain Adaptation.Zhong Meng, Hu Hu, Jinyu Li, Changliang Liu, Yan Huang, Yifan Gong, Chin-Hui Lee
2020InterspeechJoint Speaker Counting, Speech Recognition, and Speaker Identification for Overlapped Speech of any Number of Speakers.Naoyuki Kanda, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Tianyan Zhou, Takuya Yoshioka
2020InterspeechSerialized Output Training for End-to-End Overlapped Speech Recognition.Naoyuki Kanda, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Takuya Yoshioka
2020InterspeechDeveloping RNN-T Models Surpassing High-Performance Hybrid Models with Customization Capability.Jinyu Li, Rui Zhao, Zhong Meng, Yanqing Liu, Wenning Wei, Sarangarajan Parthasarathy, Vadim Mazalov, Zhenghao Wang, Lei He, Sheng Zhao, Yifan Gong
2019ASRUCharacter-Aware Attention-Based End-to-End Speech Recognition.Zhong Meng, Yashesh Gaur, Jinyu Li, Yifan Gong
2019ASRUDomain Adaptation via Teacher-Student Learning for End-to-End Speech Recognition.Zhong Meng, Jinyu Li, Yashesh Gaur, Yifan Gong
2019ASRUSpeech Separation Using Speaker Inventory.Peidong Wang, Zhuo Chen, Xiong Xiao, Zhong Meng, Takuya Yoshioka, Tianyan Zhou, Liang Lu, Jinyu Li
2019ICASSPAdversarial Speaker Adaptation.Zhong Meng, Jinyu Li, Yifan Gong
2019ICASSPAttentive Adversarial Learning for Domain-invariant Training.Zhong Meng, Jinyu Li, Yifan Gong
2019ICASSPConditional Teacher-student Learning.Zhong Meng, Jinyu Li, Yong Zhao, Yifan Gong
2019ICASSPAdversarial Speaker Verification.Zhong Meng, Yong Zhao, Jinyu Li, Yifan Gong
2019InterspeechAcoustic-to-Phrase Models for Speech Recognition.Yashesh Gaur, Jinyu Li, Zhong Meng, Yifan Gong
2019InterspeechSpeaker Adaptation for Attention-Based End-to-End Speech Recognition.Zhong Meng, Yashesh Gaur, Jinyu Li, Yifan Gong
2018ICASSPSpeaker-Invariant Training Via Adversarial Learning.Zhong Meng, Jinyu Li, Zhuo Chen, Yang Zhao, Vadim Mazalov, Yifan Gong, Biing-Hwang Juang
2018ICASSPAdversarial Teacher-Student Learning for Unsupervised Domain Adaptation.Zhong Meng, Jinyu Li, Yifan Gong, Biing-Hwang Juang
2018InterspeechCycle-Consistent Speech Enhancement.Zhong Meng, Jinyu Li, Yifan Gong, Biing-Hwang Fred Juang
2018InterspeechAdversarial Feature-Mapping for Speech Enhancement.Zhong Meng, Jinyu Li, Yifan Gong, Biing-Hwang Fred Juang
2017ASRUUnsupervised adaptation with domain separation networks for robust speech recognition.Zhong Meng, Zhuo Chen, Vadim Mazalov, Jinyu Li, Yifan Gong
2017ICASSPDeep long short-term memory adaptive beamforming networks for multichannel robust speech recognition.Zhong Meng, Shinji Watanabe, John R. Hershey, Hakan Erdogan
2017InterspeechMinimum Semantic Error Cost Training of Deep Long Short-Term Memory Networks for Topic Spotting on Conversational Speech.Zhong Meng, Biing-Hwang Juang
2017InterspeechNon-Uniform MCE Training of Deep Long Short-Term Memory Recurrent Neural Networks for Keyword Spotting.Zhong Meng, Biing-Hwang Juang
2016InterspeechNon-Uniform Boosted MCE Training of Deep Neural Networks for Keyword Spotting.Zhong Meng, Biing-Hwang Juang
2016InterspeechStatistical Modeling of Speaker's Voice with Temporal Co-Location for Active Voice Authentication.Zhong Meng, Biing-Hwang Juang