Yanzhang He
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
51
Venues
6
Active years
2012–2024
Best venue rank
Multiconference
Where they publish
Papers
51 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2024 | ICASSP | USM-Lite: Quantization and Sparsity Aware Fine-Tuning for Speech Recognition with Universal Speech Models. | Shaojin Ding, David Qiu, David Rim, Yanzhang He, Oleg Rybakov, Bo Li, Rohit Prabhavalkar, Weiran Wang, Tara N. Sainath, Zhonglin Han, Jian Li, Amir Yazdanbakhsh, Shivani Agrawal |
| 2024 | ICASSP | Extreme Encoder Output Frame Rate Reduction: Improving Computational Latencies of Large End-to-End Models. | Rohit Prabhavalkar, Zhong Meng, Weiran Wang, Adam Stooke, Xingyu Cai, Yanzhang He, Arun Narayanan, Dongseong Hwang, Tara N. Sainath, Pedro J. Moreno |
| 2024 | Interspeech | Contextual Biasing with the Knuth-Morris-Pratt Matching Algorithm. | Weiran Wang, Zelin Wu, Diamantino Caseiro, Tsendsuren Munkhdalai, Khe Chai Sim, Pat Rondon, Golan Pundak, Gan Song, Rohit Prabhavalkar, Zhong Meng, Ding Zhao, Tara Sainath, Yanzhang He, Pedro Moreno Mengibar |
| 2024 | NAACL | Massive End-to-end Speech Recognition Models with Time Reduction. | Weiran Wang, Rohit Prabhavalkar, Haozhe Shan, Zhong Meng, Dongseong Hwang, Qiujia Li, Khe Chai Sim, Bo Li, James Qin, Xingyu Cai, Adam Stooke, Chengjian Zheng, Yanzhang He, Tara N. Sainath, Pedro Moreno Mengibar |
| 2023 | ASRU | Efficient Cascaded Streaming ASR System Via Frame Rate Reduction. | Xingyu Cai, David Qiu, Shaojin Ding, Dongseong Hwang, Weiran Wang, Antoine Bruguier, Rohit Prabhavalkar, Tara N. Sainath, Yanzhang He |
| 2023 | ASRU | The Role of Feature Correlation on Quantized Neural Networks. | David Qiu, Shaojin Ding, Yanzhang He |
| 2023 | ICASSP | Sharing Low Rank Conformer Weights for Tiny Always-On Ambient Speech Recognition Models. | Steven M. Hernandez, Ding Zhao, Shaojin Ding, Antoine Bruguier, Rohit Prabhavalkar, Tara N. Sainath, Yanzhang He, Ian McGraw |
| 2023 | ICASSP | E2E Segmentation in a Two-Pass Cascaded Encoder ASR Model. | W. Ronny Huang, Shuo-Yiin Chang, Tara N. Sainath, Yanzhang He, David Rybach, Robert David, Rohit Prabhavalkar, Cyril Allauzen, Cal Peyser, Trevor D. Strohman |
| 2023 | ICASSP | Conditional Conformer: Improving Speaker Modulation For Single And Multi-User Speech Enhancement. | Tom O'Malley, Shaojin Ding, Arun Narayanan, Quan Wang, Rajeev Rikhye, Qiao Liang, Yanzhang He, Ian McGraw |
| 2023 | ICASSP | Multi-Output RNN-T Joint Networks for Multi-Task Learning of ASR and Auxiliary Tasks. | Weiran Wang, Ding Zhao, Shaojin Ding, Hao Zhang, Shuo-Yiin Chang, David Rybach, Tara N. Sainath, Yanzhang He, Ian McGraw, Shankar Kumar |
| 2023 | Interspeech | 2-bit Conformer quantization for automatic speech recognition. | Oleg Rybakov, Phoenix Meadowlark, Shaojin Ding, David Qiu, Jian Li, David Rim, Yanzhang He |
| 2022 | ICASSP | Large-Scale ASR Domain Adaptation Using Self- and Semi-Supervised Learning. | Dongseong Hwang, Ananya Misra, Zhouyuan Huo, Nikhil Siddhartha, Shefali Garg, David Qiu, Khe Chai Sim, Trevor Strohman, Franoise Beaufays, Yanzhang He |
| 2022 | ICASSP | Improving Confidence Estimation on Out-of-Domain Data for End-to-End Speech Recognition. | Qiujia Li, Yu Zhang, David Qiu, Yanzhang He, Liangliang Cao, Philip C. Woodland |
| 2022 | ICASSP | Improving The Latency And Quality Of Cascaded Encoders. | Tara N. Sainath, Yanzhang He, Arun Narayanan, Rami Botros, Weiran Wang, David Qiu, Chung-Cheng Chiu, Rohit Prabhavalkar, Alexander Gruenstein, Anmol Gulati, Bo Li, David Rybach, Emmanuel Guzman, Ian McGraw, James Qin, Krzysztof Choromanski, Qiao Liang, Robert David, Ruoming Pang, Shuo-Yiin Chang, Trevor Strohman, W. Ronny Huang, Wei Han, Yonghui Wu, Yu Zhang |
| 2022 | Interspeech | Turn-Taking Prediction for Natural Conversational Speech. | Shuo-Yiin Chang, Bo Li, Tara N. Sainath, Chao Zhang, Trevor Strohman, Qiao Liang, Yanzhang He |
| 2022 | Interspeech | 4-bit Conformer with Native Quantization Aware Training for Speech Recognition. | Shaojin Ding, Phoenix Meadowlark, Yanzhang He, Lukasz Lew, Shivani Agrawal, Oleg Rybakov |
| 2022 | Interspeech | Personal VAD 2.0: Optimizing Personal Voice Activity Detection for On-Device Speech Recognition. | Shaojin Ding, Rajeev Rikhye, Qiao Liang, Yanzhang He, Quan Wang, Arun Narayanan, Tom O'Malley, Ian McGraw |
| 2022 | Interspeech | A Unified Cascaded Encoder ASR Model for Dynamic Model Sizes. | Shaojin Ding, Weiran Wang, Ding Zhao, Tara N. Sainath, Yanzhang He, Robert David, Rami Botros, Xin Wang, Rina Panigrahy, Qiao Liang, Dongseong Hwang, Ian McGraw, Rohit Prabhavalkar, Trevor Strohman |
| 2022 | Interspeech | Improving Deliberation by Text-Only and Semi-Supervised Training. | Ke Hu, Tara N. Sainath, Yanzhang He, Rohit Prabhavalkar, Trevor Strohman, Sepand Mavandadi, Weiran Wang |
| 2022 | Interspeech | A Language Agnostic Multilingual Streaming On-Device ASR System. | Bo Li, Tara N. Sainath, Ruoming Pang, Shuo-Yiin Chang, Qiumin Xu, Trevor Strohman, Vince Chen, Qiao Liang, Heguang Liu, Yanzhang He, Parisa Haghani, Sameer Bidichandani |
| 2022 | Interspeech | Improving Rare Word Recognition with LM-aware MWER Training. | Weiran Wang, Tongzhou Chen, Tara N. Sainath, Ehsan Variani, Rohit Prabhavalkar, W. Ronny Huang, Bhuvana Ramabhadran, Neeraj Gaur, Sepand Mavandadi, Cal Peyser, Trevor Strohman, Yanzhang He, David Rybach |
| 2021 | ASRU | Cross-Attention Conformer for Context Modeling in Speech Enhancement for ASR. | Arun Narayanan, Chung-Cheng Chiu, Tom O'Malley, Quan Wang, Yanzhang He |
| 2021 | ASRU | Multi-User Voicefilter-Lite via Attentive Speaker Embedding. | Rajeev Rikhye, Quan Wang, Qiao Liang, Yanzhang He, Ian McGraw |
| 2021 | ICASSP | A Better and Faster end-to-end Model for Streaming ASR. | Bo Li, Anmol Gulati, Jiahui Yu, Tara N. Sainath, Chung-Cheng Chiu, Arun Narayanan, Shuo-Yiin Chang, Ruoming Pang, Yanzhang He, James Qin, Wei Han, Qiao Liang, Yu Zhang, Trevor Strohman, Yonghui Wu |
| 2021 | ICASSP | Confidence Estimation for Attention-Based Sequence-to-Sequence Models for Speech Recognition. | Qiujia Li, David Qiu, Yu Zhang, Bo Li, Yanzhang He, Philip C. Woodland, Liangliang Cao, Trevor Strohman |
| 2021 | ICASSP | Less is More: Improved RNN-T Decoding Using Limited Label Context and Path Merging. | Rohit Prabhavalkar, Yanzhang He, David Rybach, Sean Campbell, Arun Narayanan, Trevor Strohman, Tara N. Sainath |
| 2021 | ICASSP | Learning Word-Level Confidence for Subword End-To-End ASR. | David Qiu, Qiujia Li, Yanzhang He, Yu Zhang, Bo Li, Liangliang Cao, Rohit Prabhavalkar, Deepti Bhatia, Wei Li, Ke Hu, Tara N. Sainath, Ian McGraw |
| 2021 | ICASSP | FastEmit: Low-Latency Streaming ASR with Sequence-Level Emission Regularization. | Jiahui Yu, Chung-Cheng Chiu, Bo Li, Shuo-Yiin Chang, Tara N. Sainath, Yanzhang He, Arun Narayanan, Wei Han, Anmol Gulati, Yonghui Wu, Ruoming Pang |
| 2021 | Interspeech | Tied & Reduced RNN-T Decoder. | Rami Botros, Tara N. Sainath, Robert David, Emmanuel Guzman, Wei Li, Yanzhang He |
| 2021 | Interspeech | Multi-Task Learning for End-to-End ASR Word and Utterance Confidence with Deletion Prediction. | David Qiu, Yanzhang He, Qiujia Li, Yu Zhang, Liangliang Cao, Ian McGraw |
| 2021 | Interspeech | Personalized Keyphrase Detection Using Speaker and Environment Information. | Rajeev Rikhye, Quan Wang, Qiao Liang, Yanzhang He, Ding Zhao, Yiteng Huang, Arun Narayanan, Ian McGraw |
| 2021 | Interspeech | An Efficient Streaming Non-Recurrent On-Device End-to-End Model with Improvements to Rare-Word Modeling. | Tara N. Sainath, Yanzhang He, Arun Narayanan, Rami Botros, Ruoming Pang, David Rybach, Cyril Allauzen, Ehsan Variani, James Qin, Quoc-Nam Le-The, Shuo-Yiin Chang, Bo Li, Anmol Gulati, Jiahui Yu, Chung-Cheng Chiu, Diamantino Caseiro, Wei Li, Qiao Liang, Pat Rondon |
| 2020 | ICASSP | Towards Fast and Accurate Streaming End-To-End ASR. | Bo Li, Shuo-Yiin Chang, Tara N. Sainath, Ruoming Pang, Yanzhang He, Trevor Strohman, Yonghui Wu |
| 2020 | ICASSP | A Streaming On-Device End-To-End Model Surpassing Server-Side Conventional Model Quality and Latency. | Tara N. Sainath, Yanzhang He, Bo Li, Arun Narayanan, Ruoming Pang, Antoine Bruguier, Shuo-Yiin Chang, Wei Li, Raziel Alvarez, Zhifeng Chen, Chung-Cheng Chiu, David Garcia, Alexander Gruenstein, Ke Hu, Anjuli Kannan, Qiao Liang, Ian McGraw, Cal Peyser, Rohit Prabhavalkar, Golan Pundak, David Rybach, Yuan Shangguan, Yash Sheth, Trevor Strohman, Mirk Visontai, Yonghui Wu, Yu Zhang, Ding Zhao |
| 2020 | ICASSP | An Attention-Based Joint Acoustic and Text on-Device End-To-End Model. | Tara N. Sainath, Ruoming Pang, Ron J. Weiss, Yanzhang He, Chung-Cheng Chiu, Trevor Strohman |
| 2020 | Interspeech | Low Latency Speech Recognition Using End-to-End Prefetching. | Shuo-Yiin Chang, Bo Li, David Rybach, Yanzhang He, Wei Li, Tara N. Sainath, Trevor Strohman |
| 2020 | Interspeech | Parallel Rescoring with Transformer for Streaming On-Device Speech Recognition. | Wei Li, James Qin, Chung-Cheng Chiu, Ruoming Pang, Yanzhang He |
| 2020 | Interspeech | Analyzing the Quality and Stability of a Streaming End-to-End On-Device Speech Recognizer. | Yuan Shangguan, Kate Knister, Yanzhang He, Ian McGraw, Franoise Beaufays |
| 2020 | Interspeech | VoiceFilter-Lite: Streaming Targeted Voice Separation for On-Device Speech Recognition. | Quan Wang, Ignacio Lpez-Moreno, Mert Saglam, Kevin W. Wilson, Alan Chiao, Renjie Liu, Yanzhang He, Wei Li, Jason Pelecanos, Marily Nika, Alexander Gruenstein |
| 2019 | ICASSP | Joint Endpointing and Decoding with End-to-end Models. | Shuo-Yiin Chang, Rohit Prabhavalkar, Yanzhang He, Tara N. Sainath, Gabor Simko |
| 2019 | ICASSP | Streaming End-to-end Speech Recognition for Mobile Devices. | Yanzhang He, Tara N. Sainath, Rohit Prabhavalkar, Ian McGraw, Raziel Alvarez, Ding Zhao, David Rybach, Anjuli Kannan, Yonghui Wu, Ruoming Pang, Qiao Liang, Deepti Bhatia, Yuan Shangguan, Bo Li, Golan Pundak, Khe Chai Sim, Tom Bagby, Shuo-Yiin Chang, Kanishka Rao, Alexander Gruenstein |
| 2019 | Interspeech | Two-Pass End-to-End Speech Recognition. | Tara N. Sainath, Ruoming Pang, David Rybach, Yanzhang He, Rohit Prabhavalkar, Wei Li, Mirk Visontai, Qiao Liang, Trevor Strohman, Yonghui Wu, Ian McGraw, Chung-Cheng Chiu |
| 2017 | ASRU | Streaming small-footprint keyword spotting using sequence-to-sequence models. | Yanzhang He, Rohit Prabhavalkar, Kanishka Rao, Wei Li, Anton Bakhtin, Ian McGraw |
| 2015 | ASRU | Combining spectral feature mapping and multi-channel model-based source separation for noise-robust automatic speech recognition. | Deblin Bagchi, Michael I. Mandel, Zhongqiu Wang, Yanzhang He, Andrew R. Plummer, Eric Fosler-Lussier |
| 2015 | ICASSP | Improvements on transducing syllable lattice to word lattice for keyword search. | Hang Su, Van Tung Pham, Yanzhang He, James Hieronymus |
| 2015 | Interspeech | Deep neural network based spectral feature mapping for robust speech recognition. | Kun Han, Yanzhang He, Deblin Bagchi, Eric Fosler-Lussier, DeLiang Wang |
| 2015 | Interspeech | Segmental conditional random fields with deep neural networks as acoustic models for first-pass word recognition. | Yanzhang He, Eric Fosler-Lussier |
| 2014 | HPCC | Virtual Machine Scheduling Considering Both Computing and Cooling Energy. | Xiang Li, Xiaohong Jiang, Yanzhang He |
| 2014 | ICASSP | Subword-based modeling for handling OOV words inkeyword spotting. | Yanzhang He, Brian Hutchinson, Peter Baumann, Mari Ostendorf, Eric Fosler-Lussier, Janet B. Pierrehumbert |
| 2012 | CLUSTER | vHadoop: A Scalable Hadoop Virtual Cluster Platform for MapReduce-Based Parallel Machine Learning with Performance Consideration. | Kejiang Ye, Xiaohong Jiang, Yanzhang He, Xiang Li, Haiming Yan, Peng Huang |
| 2012 | Interspeech | Efficient Segmental Conditional Random Fields for One-Pass Phone Recognition. | Yanzhang He, Eric Fosler-Lussier |