Skip to content

Yanzhang He

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

51

Venues

6

Active years

2012–2024

Best venue rank

Multiconference

Where they publish

Papers

51 indexed papers, newest first.

YearVenueTitleAuthors
2024ICASSPUSM-Lite: Quantization and Sparsity Aware Fine-Tuning for Speech Recognition with Universal Speech Models.Shaojin Ding, David Qiu, David Rim, Yanzhang He, Oleg Rybakov, Bo Li, Rohit Prabhavalkar, Weiran Wang, Tara N. Sainath, Zhonglin Han, Jian Li, Amir Yazdanbakhsh, Shivani Agrawal
2024ICASSPExtreme Encoder Output Frame Rate Reduction: Improving Computational Latencies of Large End-to-End Models.Rohit Prabhavalkar, Zhong Meng, Weiran Wang, Adam Stooke, Xingyu Cai, Yanzhang He, Arun Narayanan, Dongseong Hwang, Tara N. Sainath, Pedro J. Moreno
2024InterspeechContextual Biasing with the Knuth-Morris-Pratt Matching Algorithm.Weiran Wang, Zelin Wu, Diamantino Caseiro, Tsendsuren Munkhdalai, Khe Chai Sim, Pat Rondon, Golan Pundak, Gan Song, Rohit Prabhavalkar, Zhong Meng, Ding Zhao, Tara Sainath, Yanzhang He, Pedro Moreno Mengibar
2024NAACLMassive End-to-end Speech Recognition Models with Time Reduction.Weiran Wang, Rohit Prabhavalkar, Haozhe Shan, Zhong Meng, Dongseong Hwang, Qiujia Li, Khe Chai Sim, Bo Li, James Qin, Xingyu Cai, Adam Stooke, Chengjian Zheng, Yanzhang He, Tara N. Sainath, Pedro Moreno Mengibar
2023ASRUEfficient Cascaded Streaming ASR System Via Frame Rate Reduction.Xingyu Cai, David Qiu, Shaojin Ding, Dongseong Hwang, Weiran Wang, Antoine Bruguier, Rohit Prabhavalkar, Tara N. Sainath, Yanzhang He
2023ASRUThe Role of Feature Correlation on Quantized Neural Networks.David Qiu, Shaojin Ding, Yanzhang He
2023ICASSPSharing Low Rank Conformer Weights for Tiny Always-On Ambient Speech Recognition Models.Steven M. Hernandez, Ding Zhao, Shaojin Ding, Antoine Bruguier, Rohit Prabhavalkar, Tara N. Sainath, Yanzhang He, Ian McGraw
2023ICASSPE2E Segmentation in a Two-Pass Cascaded Encoder ASR Model.W. Ronny Huang, Shuo-Yiin Chang, Tara N. Sainath, Yanzhang He, David Rybach, Robert David, Rohit Prabhavalkar, Cyril Allauzen, Cal Peyser, Trevor D. Strohman
2023ICASSPConditional Conformer: Improving Speaker Modulation For Single And Multi-User Speech Enhancement.Tom O'Malley, Shaojin Ding, Arun Narayanan, Quan Wang, Rajeev Rikhye, Qiao Liang, Yanzhang He, Ian McGraw
2023ICASSPMulti-Output RNN-T Joint Networks for Multi-Task Learning of ASR and Auxiliary Tasks.Weiran Wang, Ding Zhao, Shaojin Ding, Hao Zhang, Shuo-Yiin Chang, David Rybach, Tara N. Sainath, Yanzhang He, Ian McGraw, Shankar Kumar
2023Interspeech2-bit Conformer quantization for automatic speech recognition.Oleg Rybakov, Phoenix Meadowlark, Shaojin Ding, David Qiu, Jian Li, David Rim, Yanzhang He
2022ICASSPLarge-Scale ASR Domain Adaptation Using Self- and Semi-Supervised Learning.Dongseong Hwang, Ananya Misra, Zhouyuan Huo, Nikhil Siddhartha, Shefali Garg, David Qiu, Khe Chai Sim, Trevor Strohman, Franoise Beaufays, Yanzhang He
2022ICASSPImproving Confidence Estimation on Out-of-Domain Data for End-to-End Speech Recognition.Qiujia Li, Yu Zhang, David Qiu, Yanzhang He, Liangliang Cao, Philip C. Woodland
2022ICASSPImproving The Latency And Quality Of Cascaded Encoders.Tara N. Sainath, Yanzhang He, Arun Narayanan, Rami Botros, Weiran Wang, David Qiu, Chung-Cheng Chiu, Rohit Prabhavalkar, Alexander Gruenstein, Anmol Gulati, Bo Li, David Rybach, Emmanuel Guzman, Ian McGraw, James Qin, Krzysztof Choromanski, Qiao Liang, Robert David, Ruoming Pang, Shuo-Yiin Chang, Trevor Strohman, W. Ronny Huang, Wei Han, Yonghui Wu, Yu Zhang
2022InterspeechTurn-Taking Prediction for Natural Conversational Speech.Shuo-Yiin Chang, Bo Li, Tara N. Sainath, Chao Zhang, Trevor Strohman, Qiao Liang, Yanzhang He
2022Interspeech4-bit Conformer with Native Quantization Aware Training for Speech Recognition.Shaojin Ding, Phoenix Meadowlark, Yanzhang He, Lukasz Lew, Shivani Agrawal, Oleg Rybakov
2022InterspeechPersonal VAD 2.0: Optimizing Personal Voice Activity Detection for On-Device Speech Recognition.Shaojin Ding, Rajeev Rikhye, Qiao Liang, Yanzhang He, Quan Wang, Arun Narayanan, Tom O'Malley, Ian McGraw
2022InterspeechA Unified Cascaded Encoder ASR Model for Dynamic Model Sizes.Shaojin Ding, Weiran Wang, Ding Zhao, Tara N. Sainath, Yanzhang He, Robert David, Rami Botros, Xin Wang, Rina Panigrahy, Qiao Liang, Dongseong Hwang, Ian McGraw, Rohit Prabhavalkar, Trevor Strohman
2022InterspeechImproving Deliberation by Text-Only and Semi-Supervised Training.Ke Hu, Tara N. Sainath, Yanzhang He, Rohit Prabhavalkar, Trevor Strohman, Sepand Mavandadi, Weiran Wang
2022InterspeechA Language Agnostic Multilingual Streaming On-Device ASR System.Bo Li, Tara N. Sainath, Ruoming Pang, Shuo-Yiin Chang, Qiumin Xu, Trevor Strohman, Vince Chen, Qiao Liang, Heguang Liu, Yanzhang He, Parisa Haghani, Sameer Bidichandani
2022InterspeechImproving Rare Word Recognition with LM-aware MWER Training.Weiran Wang, Tongzhou Chen, Tara N. Sainath, Ehsan Variani, Rohit Prabhavalkar, W. Ronny Huang, Bhuvana Ramabhadran, Neeraj Gaur, Sepand Mavandadi, Cal Peyser, Trevor Strohman, Yanzhang He, David Rybach
2021ASRUCross-Attention Conformer for Context Modeling in Speech Enhancement for ASR.Arun Narayanan, Chung-Cheng Chiu, Tom O'Malley, Quan Wang, Yanzhang He
2021ASRUMulti-User Voicefilter-Lite via Attentive Speaker Embedding.Rajeev Rikhye, Quan Wang, Qiao Liang, Yanzhang He, Ian McGraw
2021ICASSPA Better and Faster end-to-end Model for Streaming ASR.Bo Li, Anmol Gulati, Jiahui Yu, Tara N. Sainath, Chung-Cheng Chiu, Arun Narayanan, Shuo-Yiin Chang, Ruoming Pang, Yanzhang He, James Qin, Wei Han, Qiao Liang, Yu Zhang, Trevor Strohman, Yonghui Wu
2021ICASSPConfidence Estimation for Attention-Based Sequence-to-Sequence Models for Speech Recognition.Qiujia Li, David Qiu, Yu Zhang, Bo Li, Yanzhang He, Philip C. Woodland, Liangliang Cao, Trevor Strohman
2021ICASSPLess is More: Improved RNN-T Decoding Using Limited Label Context and Path Merging.Rohit Prabhavalkar, Yanzhang He, David Rybach, Sean Campbell, Arun Narayanan, Trevor Strohman, Tara N. Sainath
2021ICASSPLearning Word-Level Confidence for Subword End-To-End ASR.David Qiu, Qiujia Li, Yanzhang He, Yu Zhang, Bo Li, Liangliang Cao, Rohit Prabhavalkar, Deepti Bhatia, Wei Li, Ke Hu, Tara N. Sainath, Ian McGraw
2021ICASSPFastEmit: Low-Latency Streaming ASR with Sequence-Level Emission Regularization.Jiahui Yu, Chung-Cheng Chiu, Bo Li, Shuo-Yiin Chang, Tara N. Sainath, Yanzhang He, Arun Narayanan, Wei Han, Anmol Gulati, Yonghui Wu, Ruoming Pang
2021InterspeechTied & Reduced RNN-T Decoder.Rami Botros, Tara N. Sainath, Robert David, Emmanuel Guzman, Wei Li, Yanzhang He
2021InterspeechMulti-Task Learning for End-to-End ASR Word and Utterance Confidence with Deletion Prediction.David Qiu, Yanzhang He, Qiujia Li, Yu Zhang, Liangliang Cao, Ian McGraw
2021InterspeechPersonalized Keyphrase Detection Using Speaker and Environment Information.Rajeev Rikhye, Quan Wang, Qiao Liang, Yanzhang He, Ding Zhao, Yiteng Huang, Arun Narayanan, Ian McGraw
2021InterspeechAn Efficient Streaming Non-Recurrent On-Device End-to-End Model with Improvements to Rare-Word Modeling.Tara N. Sainath, Yanzhang He, Arun Narayanan, Rami Botros, Ruoming Pang, David Rybach, Cyril Allauzen, Ehsan Variani, James Qin, Quoc-Nam Le-The, Shuo-Yiin Chang, Bo Li, Anmol Gulati, Jiahui Yu, Chung-Cheng Chiu, Diamantino Caseiro, Wei Li, Qiao Liang, Pat Rondon
2020ICASSPTowards Fast and Accurate Streaming End-To-End ASR.Bo Li, Shuo-Yiin Chang, Tara N. Sainath, Ruoming Pang, Yanzhang He, Trevor Strohman, Yonghui Wu
2020ICASSPA Streaming On-Device End-To-End Model Surpassing Server-Side Conventional Model Quality and Latency.Tara N. Sainath, Yanzhang He, Bo Li, Arun Narayanan, Ruoming Pang, Antoine Bruguier, Shuo-Yiin Chang, Wei Li, Raziel Alvarez, Zhifeng Chen, Chung-Cheng Chiu, David Garcia, Alexander Gruenstein, Ke Hu, Anjuli Kannan, Qiao Liang, Ian McGraw, Cal Peyser, Rohit Prabhavalkar, Golan Pundak, David Rybach, Yuan Shangguan, Yash Sheth, Trevor Strohman, Mirk Visontai, Yonghui Wu, Yu Zhang, Ding Zhao
2020ICASSPAn Attention-Based Joint Acoustic and Text on-Device End-To-End Model.Tara N. Sainath, Ruoming Pang, Ron J. Weiss, Yanzhang He, Chung-Cheng Chiu, Trevor Strohman
2020InterspeechLow Latency Speech Recognition Using End-to-End Prefetching.Shuo-Yiin Chang, Bo Li, David Rybach, Yanzhang He, Wei Li, Tara N. Sainath, Trevor Strohman
2020InterspeechParallel Rescoring with Transformer for Streaming On-Device Speech Recognition.Wei Li, James Qin, Chung-Cheng Chiu, Ruoming Pang, Yanzhang He
2020InterspeechAnalyzing the Quality and Stability of a Streaming End-to-End On-Device Speech Recognizer.Yuan Shangguan, Kate Knister, Yanzhang He, Ian McGraw, Franoise Beaufays
2020InterspeechVoiceFilter-Lite: Streaming Targeted Voice Separation for On-Device Speech Recognition.Quan Wang, Ignacio Lpez-Moreno, Mert Saglam, Kevin W. Wilson, Alan Chiao, Renjie Liu, Yanzhang He, Wei Li, Jason Pelecanos, Marily Nika, Alexander Gruenstein
2019ICASSPJoint Endpointing and Decoding with End-to-end Models.Shuo-Yiin Chang, Rohit Prabhavalkar, Yanzhang He, Tara N. Sainath, Gabor Simko
2019ICASSPStreaming End-to-end Speech Recognition for Mobile Devices.Yanzhang He, Tara N. Sainath, Rohit Prabhavalkar, Ian McGraw, Raziel Alvarez, Ding Zhao, David Rybach, Anjuli Kannan, Yonghui Wu, Ruoming Pang, Qiao Liang, Deepti Bhatia, Yuan Shangguan, Bo Li, Golan Pundak, Khe Chai Sim, Tom Bagby, Shuo-Yiin Chang, Kanishka Rao, Alexander Gruenstein
2019InterspeechTwo-Pass End-to-End Speech Recognition.Tara N. Sainath, Ruoming Pang, David Rybach, Yanzhang He, Rohit Prabhavalkar, Wei Li, Mirk Visontai, Qiao Liang, Trevor Strohman, Yonghui Wu, Ian McGraw, Chung-Cheng Chiu
2017ASRUStreaming small-footprint keyword spotting using sequence-to-sequence models.Yanzhang He, Rohit Prabhavalkar, Kanishka Rao, Wei Li, Anton Bakhtin, Ian McGraw
2015ASRUCombining spectral feature mapping and multi-channel model-based source separation for noise-robust automatic speech recognition.Deblin Bagchi, Michael I. Mandel, Zhongqiu Wang, Yanzhang He, Andrew R. Plummer, Eric Fosler-Lussier
2015ICASSPImprovements on transducing syllable lattice to word lattice for keyword search.Hang Su, Van Tung Pham, Yanzhang He, James Hieronymus
2015InterspeechDeep neural network based spectral feature mapping for robust speech recognition.Kun Han, Yanzhang He, Deblin Bagchi, Eric Fosler-Lussier, DeLiang Wang
2015InterspeechSegmental conditional random fields with deep neural networks as acoustic models for first-pass word recognition.Yanzhang He, Eric Fosler-Lussier
2014HPCCVirtual Machine Scheduling Considering Both Computing and Cooling Energy.Xiang Li, Xiaohong Jiang, Yanzhang He
2014ICASSPSubword-based modeling for handling OOV words inkeyword spotting.Yanzhang He, Brian Hutchinson, Peter Baumann, Mari Ostendorf, Eric Fosler-Lussier, Janet B. Pierrehumbert
2012CLUSTERvHadoop: A Scalable Hadoop Virtual Cluster Platform for MapReduce-Based Parallel Machine Learning with Performance Consideration.Kejiang Ye, Xiaohong Jiang, Yanzhang He, Xiang Li, Haiming Yan, Peng Huang
2012InterspeechEfficient Segmental Conditional Random Fields for One-Pass Phone Recognition.Yanzhang He, Eric Fosler-Lussier