Zhong Meng
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
55
Venues
4
Active years
2016–2024
Best venue rank
A
Where they publish
Papers
55 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2024 | ICASSP | Extreme Encoder Output Frame Rate Reduction: Improving Computational Latencies of Large End-to-End Models. | Rohit Prabhavalkar, Zhong Meng, Weiran Wang, Adam Stooke, Xingyu Cai, Yanzhang He, Arun Narayanan, Dongseong Hwang, Tara N. Sainath, Pedro J. Moreno |
| 2024 | ICASSP | Augmenting Conformers With Structured State-Space Sequence Models For Online Speech Recognition. | Haozhe Shan, Albert Gu, Zhong Meng, Weiran Wang, Krzysztof Choromanski, Tara N. Sainath |
| 2024 | ICASSP | A Comparison of Parameter-Efficient ASR Domain Adaptation Methods for Universal Speech and Language Models. | Khe Chai Sim, Zhouyuan Huo, Tsendsuren Munkhdalai, Nikhil Siddhartha, Adam Stooke, Zhong Meng, Bo Li, Tara N. Sainath |
| 2024 | Interspeech | Efficiently Train ASR Models that Memorize Less and Perform Better with Per-core Clipping. | Lun Wang, Om Thakkar, Zhong Meng, Nicole Rafidi, Rohit Prabhavalkar, Arun Narayanan |
| 2024 | Interspeech | Speech Prefix-Tuning with RNNT Loss for Improving LLM Predictions. | Murali Karthick Baskar, Andrew Rosenberg, Bhuvana Ramabhadran, Neeraj Gaur, Zhong Meng |
| 2024 | Interspeech | Text Injection for Neural Contextual Biasing. | Zhong Meng, Zelin Wu, Rohit Prabhavalkar, Cal Peyser, Weiran Wang, Nanxin Chen, Tara N. Sainath, Bhuvana Ramabhadran |
| 2024 | Interspeech | Contextual Biasing with the Knuth-Morris-Pratt Matching Algorithm. | Weiran Wang, Zelin Wu, Diamantino Caseiro, Tsendsuren Munkhdalai, Khe Chai Sim, Pat Rondon, Golan Pundak, Gan Song, Rohit Prabhavalkar, Zhong Meng, Ding Zhao, Tara Sainath, Yanzhang He, Pedro Moreno Mengibar |
| 2024 | NAACL | Massive End-to-end Speech Recognition Models with Time Reduction. | Weiran Wang, Rohit Prabhavalkar, Haozhe Shan, Zhong Meng, Dongseong Hwang, Qiujia Li, Khe Chai Sim, Bo Li, James Qin, Xingyu Cai, Adam Stooke, Chengjian Zheng, Yanzhang He, Tara N. Sainath, Pedro Moreno Mengibar |
| 2024 | NAACL | Deferred NAM: Low-latency Top-K Context Injection via Deferred Context Encoding for Non-Streaming ASR. | Zelin Wu, Gan Song, Christopher Li, Pat Rondon, Zhong Meng, Xavier Velez, Weiran Wang, Diamantino Caseiro, Golan Pundak, Tsendsuren Munkhdalai, Angad Chandorkar, Rohit Prabhavalkar |
| 2023 | ICASSP | JEIT: Joint End-to-End Model and Internal Language Model Training for Speech Recognition. | Zhong Meng, Weiran Wang, Rohit Prabhavalkar, Tara N. Sainath, Tongzhou Chen, Ehsan Variani, Yu Zhang, Bo Li, Andrew Rosenberg, Bhuvana Ramabhadran |
| 2023 | Interspeech | Text Injection for Capitalization and Turn-Taking Prediction in Speech Models. | Shaan Bijwadia, Shuo-Yiin Chang, Weiran Wang, Zhong Meng, Hao Zhang |
| 2023 | Interspeech | Improving Joint Speech-Text Representations Without Alignment. | Cal Peyser, Zhong Meng, Rohit Prabhavalkar, Andrew Rosenberg, Tara N. Sainath, Michael Picheny, Kyunghyun Cho, Ke Hu |
| 2022 | ICASSP | Factorized Neural Transducer for Efficient Language Model Adaptation. | Xie Chen, Zhong Meng, Sarangarajan Parthasarathy, Jinyu Li |
| 2022 | ICASSP | Transcribe-to-Diarize: Neural Speaker Diarization for Unlimited Number of Speakers Using End-to-End Speaker-Attributed ASR. | Naoyuki Kanda, Xiong Xiao, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Takuya Yoshioka |
| 2022 | ICASSP | Continuous Speech Separation with Recurrent Selective Attention Network. | Yixuan Zhang, Zhuo Chen, Jian Wu, Takuya Yoshioka, Peidong Wang, Zhong Meng, Jinyu Li |
| 2022 | Interspeech | Streaming Speaker-Attributed ASR with Token-Level Speaker Embeddings. | Naoyuki Kanda, Jian Wu, Yu Wu, Xiong Xiao, Zhong Meng, Xiaofei Wang, Yashesh Gaur, Zhuo Chen, Jinyu Li, Takuya Yoshioka |
| 2022 | Interspeech | Streaming Multi-Talker ASR with Token-Level Serialized Output Training. | Naoyuki Kanda, Jian Wu, Yu Wu, Xiong Xiao, Zhong Meng, Xiaofei Wang, Yashesh Gaur, Zhuo Chen, Jinyu Li, Takuya Yoshioka |
| 2022 | Interspeech | Internal Language Model Adaptation with Text-Only Data for End-to-End Speech Recognition. | Zhong Meng, Yashesh Gaur, Naoyuki Kanda, Jinyu Li, Xie Chen, Yu Wu, Yifan Gong |
| 2022 | Interspeech | Separating Long-Form Speech with Group-wise Permutation Invariant Training. | Wangyou Zhang, Zhuo Chen, Naoyuki Kanda, Shujie Liu, Jinyu Li, Sefik Emre Eskimez, Takuya Yoshioka, Xiong Xiao, Zhong Meng, Yanmin Qian, Furu Wei |
| 2021 | ASRU | A Comparative Study of Modular and Joint Approaches for Speaker-Attributed ASR on Monaural Long-Form Audio. | Naoyuki Kanda, Xiong Xiao, Jian Wu, Tianyan Zhou, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Takuya Yoshioka |
| 2021 | ICASSP | Hypothesis Stitcher for End-to-End Speaker-Attributed ASR on Long-Form Multi-Talker Recordings. | Xuankai Chang, Naoyuki Kanda, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Takuya Yoshioka |
| 2021 | ICASSP | Minimum Bayes Risk Training for End-to-End Speaker-Attributed ASR. | Naoyuki Kanda, Zhong Meng, Liang Lu, Yashesh Gaur, Xiaofei Wang, Zhuo Chen, Takuya Yoshioka |
| 2021 | ICASSP | Internal Language Model Training for Domain-Adaptive End-To-End Speech Recognition. | Zhong Meng, Naoyuki Kanda, Yashesh Gaur, Sarangarajan Parthasarathy, Eric Sun, Liang Lu, Xie Chen, Jinyu Li, Yifan Gong |
| 2021 | ICASSP | Sequence-Level Self-Teaching Regularization. | Eric Sun, Liang Lu, Zhong Meng, Yifan Gong |
| 2021 | Interspeech | On Minimum Word Error Rate Training of the Hybrid Autoregressive Transducer. | Liang Lu, Zhong Meng, Naoyuki Kanda, Jinyu Li, Yifan Gong |
| 2021 | Interspeech | Improving RNN-T for Domain Scaling Using Semi-Supervised Training with Neural TTS. | Yan Deng, Rui Zhao, Zhong Meng, Xie Chen, Bing Liu, Jinyu Li, Yifan Gong, Lei He |
| 2021 | Interspeech | End-to-End Speaker-Attributed ASR with Transformer. | Naoyuki Kanda, Guoli Ye, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Takuya Yoshioka |
| 2021 | Interspeech | Large-Scale Pre-Training of End-to-End Multi-Talker ASR for Meeting Transcription with Single Distant Microphone. | Naoyuki Kanda, Guoli Ye, Yu Wu, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Takuya Yoshioka |
| 2021 | Interspeech | Minimum Word Error Rate Training with Language Model Fusion for End-to-End Speech Recognition. | Zhong Meng, Yu Wu, Naoyuki Kanda, Liang Lu, Xie Chen, Guoli Ye, Eric Sun, Jinyu Li, Yifan Gong |
| 2021 | Interspeech | Improving Multilingual Transformer Transducer Models by Reducing Language Confusions. | Eric Sun, Jinyu Li, Zhong Meng, Yu Wu, Jian Xue, Shujie Liu, Yifan Gong |
| 2020 | ICASSP | Continuous Speech Separation: Dataset and Analysis. | Zhuo Chen, Takuya Yoshioka, Liang Lu, Tianyan Zhou, Zhong Meng, Yi Luo, Jian Wu, Xiong Xiao, Jinyu Li |
| 2020 | ICASSP | High-Accuracy and Low-Latency Speech Recognition with Two-Head Contextual Layer Trajectory LSTM Model. | Jinyu Li, Rui Zhao, Eric Sun, Jeremy Heng Meng Wong, Amit Das, Zhong Meng, Yifan Gong |
| 2020 | ICASSP | L-Vector: Neural Label Embedding for Domain Adaptation. | Zhong Meng, Hu Hu, Jinyu Li, Changliang Liu, Yan Huang, Yifan Gong, Chin-Hui Lee |
| 2020 | Interspeech | Joint Speaker Counting, Speech Recognition, and Speaker Identification for Overlapped Speech of any Number of Speakers. | Naoyuki Kanda, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Tianyan Zhou, Takuya Yoshioka |
| 2020 | Interspeech | Serialized Output Training for End-to-End Overlapped Speech Recognition. | Naoyuki Kanda, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Takuya Yoshioka |
| 2020 | Interspeech | Developing RNN-T Models Surpassing High-Performance Hybrid Models with Customization Capability. | Jinyu Li, Rui Zhao, Zhong Meng, Yanqing Liu, Wenning Wei, Sarangarajan Parthasarathy, Vadim Mazalov, Zhenghao Wang, Lei He, Sheng Zhao, Yifan Gong |
| 2019 | ASRU | Character-Aware Attention-Based End-to-End Speech Recognition. | Zhong Meng, Yashesh Gaur, Jinyu Li, Yifan Gong |
| 2019 | ASRU | Domain Adaptation via Teacher-Student Learning for End-to-End Speech Recognition. | Zhong Meng, Jinyu Li, Yashesh Gaur, Yifan Gong |
| 2019 | ASRU | Speech Separation Using Speaker Inventory. | Peidong Wang, Zhuo Chen, Xiong Xiao, Zhong Meng, Takuya Yoshioka, Tianyan Zhou, Liang Lu, Jinyu Li |
| 2019 | ICASSP | Adversarial Speaker Adaptation. | Zhong Meng, Jinyu Li, Yifan Gong |
| 2019 | ICASSP | Attentive Adversarial Learning for Domain-invariant Training. | Zhong Meng, Jinyu Li, Yifan Gong |
| 2019 | ICASSP | Conditional Teacher-student Learning. | Zhong Meng, Jinyu Li, Yong Zhao, Yifan Gong |
| 2019 | ICASSP | Adversarial Speaker Verification. | Zhong Meng, Yong Zhao, Jinyu Li, Yifan Gong |
| 2019 | Interspeech | Acoustic-to-Phrase Models for Speech Recognition. | Yashesh Gaur, Jinyu Li, Zhong Meng, Yifan Gong |
| 2019 | Interspeech | Speaker Adaptation for Attention-Based End-to-End Speech Recognition. | Zhong Meng, Yashesh Gaur, Jinyu Li, Yifan Gong |
| 2018 | ICASSP | Speaker-Invariant Training Via Adversarial Learning. | Zhong Meng, Jinyu Li, Zhuo Chen, Yang Zhao, Vadim Mazalov, Yifan Gong, Biing-Hwang Juang |
| 2018 | ICASSP | Adversarial Teacher-Student Learning for Unsupervised Domain Adaptation. | Zhong Meng, Jinyu Li, Yifan Gong, Biing-Hwang Juang |
| 2018 | Interspeech | Cycle-Consistent Speech Enhancement. | Zhong Meng, Jinyu Li, Yifan Gong, Biing-Hwang Fred Juang |
| 2018 | Interspeech | Adversarial Feature-Mapping for Speech Enhancement. | Zhong Meng, Jinyu Li, Yifan Gong, Biing-Hwang Fred Juang |
| 2017 | ASRU | Unsupervised adaptation with domain separation networks for robust speech recognition. | Zhong Meng, Zhuo Chen, Vadim Mazalov, Jinyu Li, Yifan Gong |
| 2017 | ICASSP | Deep long short-term memory adaptive beamforming networks for multichannel robust speech recognition. | Zhong Meng, Shinji Watanabe, John R. Hershey, Hakan Erdogan |
| 2017 | Interspeech | Minimum Semantic Error Cost Training of Deep Long Short-Term Memory Networks for Topic Spotting on Conversational Speech. | Zhong Meng, Biing-Hwang Juang |
| 2017 | Interspeech | Non-Uniform MCE Training of Deep Long Short-Term Memory Recurrent Neural Networks for Keyword Spotting. | Zhong Meng, Biing-Hwang Juang |
| 2016 | Interspeech | Non-Uniform Boosted MCE Training of Deep Neural Networks for Keyword Spotting. | Zhong Meng, Biing-Hwang Juang |
| 2016 | Interspeech | Statistical Modeling of Speaker's Voice with Temporal Co-Location for Active Voice Authentication. | Zhong Meng, Biing-Hwang Juang |