Rohit Prabhavalkar
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
70
Venues
4
Active years
2009–2025
Best venue rank
Multiconference
Where they publish
Papers
70 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICASSP | Weak-to-Strong Generalization in Speech Recognition. | Soheil Khorram, Qian Zhang, Rohit Prabhavalkar, Kartik Audhkhasi, Bhuvana Ramabhadran |
| 2024 | ICASSP | USM-Lite: Quantization and Sparsity Aware Fine-Tuning for Speech Recognition with Universal Speech Models. | Shaojin Ding, David Qiu, David Rim, Yanzhang He, Oleg Rybakov, Bo Li, Rohit Prabhavalkar, Weiran Wang, Tara N. Sainath, Zhonglin Han, Jian Li, Amir Yazdanbakhsh, Shivani Agrawal |
| 2024 | ICASSP | Extreme Encoder Output Frame Rate Reduction: Improving Computational Latencies of Large End-to-End Models. | Rohit Prabhavalkar, Zhong Meng, Weiran Wang, Adam Stooke, Xingyu Cai, Yanzhang He, Arun Narayanan, Dongseong Hwang, Tara N. Sainath, Pedro J. Moreno |
| 2024 | Interspeech | Efficiently Train ASR Models that Memorize Less and Perform Better with Per-core Clipping. | Lun Wang, Om Thakkar, Zhong Meng, Nicole Rafidi, Rohit Prabhavalkar, Arun Narayanan |
| 2024 | Interspeech | Text Injection for Neural Contextual Biasing. | Zhong Meng, Zelin Wu, Rohit Prabhavalkar, Cal Peyser, Weiran Wang, Nanxin Chen, Tara N. Sainath, Bhuvana Ramabhadran |
| 2024 | Interspeech | Contextual Biasing with the Knuth-Morris-Pratt Matching Algorithm. | Weiran Wang, Zelin Wu, Diamantino Caseiro, Tsendsuren Munkhdalai, Khe Chai Sim, Pat Rondon, Golan Pundak, Gan Song, Rohit Prabhavalkar, Zhong Meng, Ding Zhao, Tara Sainath, Yanzhang He, Pedro Moreno Mengibar |
| 2024 | NAACL | Massive End-to-end Speech Recognition Models with Time Reduction. | Weiran Wang, Rohit Prabhavalkar, Haozhe Shan, Zhong Meng, Dongseong Hwang, Qiujia Li, Khe Chai Sim, Bo Li, James Qin, Xingyu Cai, Adam Stooke, Chengjian Zheng, Yanzhang He, Tara N. Sainath, Pedro Moreno Mengibar |
| 2024 | NAACL | Deferred NAM: Low-latency Top-K Context Injection via Deferred Context Encoding for Non-Streaming ASR. | Zelin Wu, Gan Song, Christopher Li, Pat Rondon, Zhong Meng, Xavier Velez, Weiran Wang, Diamantino Caseiro, Golan Pundak, Tsendsuren Munkhdalai, Angad Chandorkar, Rohit Prabhavalkar |
| 2023 | ASRU | Improved Long-Form Speech Recognition By Jointly Modeling The Primary And Non-Primary Speakers. | Guru Prakash Arumugam, Shuo-Yiin Chang, Tara N. Sainath, Rohit Prabhavalkar, Quan Wang, Shaan Bijwadia |
| 2023 | ASRU | Efficient Cascaded Streaming ASR System Via Frame Rate Reduction. | Xingyu Cai, David Qiu, Shaojin Ding, Dongseong Hwang, Weiran Wang, Antoine Bruguier, Rohit Prabhavalkar, Tara N. Sainath, Yanzhang He |
| 2023 | ASRU | The Gift of Feedback: Improving ASR Model Quality by Learning from User Corrections Through Federated Learning. | Lillian Zhou, Yuxin Ding, Mingqing Chen, Harry Zhang, Rohit Prabhavalkar, Dhruv Guliani, Giovanni Motta, Rajiv Mathews |
| 2023 | ICASSP | Lego-Features: Exporting Modular Encoder Features for Streaming and Deliberation ASR. | Rami Botros, Rohit Prabhavalkar, Johan Schalkwyk, Ciprian Chelba, Tara N. Sainath, Franoise Beaufays |
| 2023 | ICASSP | Sharing Low Rank Conformer Weights for Tiny Always-On Ambient Speech Recognition Models. | Steven M. Hernandez, Ding Zhao, Shaojin Ding, Antoine Bruguier, Rohit Prabhavalkar, Tara N. Sainath, Yanzhang He, Ian McGraw |
| 2023 | ICASSP | E2E Segmentation in a Two-Pass Cascaded Encoder ASR Model. | W. Ronny Huang, Shuo-Yiin Chang, Tara N. Sainath, Yanzhang He, David Rybach, Robert David, Rohit Prabhavalkar, Cyril Allauzen, Cal Peyser, Trevor D. Strohman |
| 2023 | ICASSP | Cross-Training: A Semi-Supervised Training Scheme for Speech Recognition. | Soheil Khorram, Anshuman Tripathi, Jaeyoung Kim, Han Lu, Qian Zhang, Rohit Prabhavalkar, Hasim Sak |
| 2023 | ICASSP | JEIT: Joint End-to-End Model and Internal Language Model Training for Speech Recognition. | Zhong Meng, Weiran Wang, Rohit Prabhavalkar, Tara N. Sainath, Tongzhou Chen, Ehsan Variani, Yu Zhang, Bo Li, Andrew Rosenberg, Bhuvana Ramabhadran |
| 2023 | ICASSP | A Comparison of Semi-Supervised Learning Techniques for Streaming ASR at Scale. | Cal Peyser, Michael Picheny, Kyunghyun Cho, Rohit Prabhavalkar, W. Ronny Huang, Tara N. Sainath |
| 2023 | ICASSP | Improving Contextual Biasing with Text Injection. | Tara N. Sainath, Rohit Prabhavalkar, Diamantino Caseiro, Pat Rondon, Cyril Allauzen |
| 2023 | ICASSP | From English to More Languages: Parameter-Efficient Model Reprogramming for Cross-Lingual Speech Recognition. | Chao-Han Huck Yang, Bo Li, Yu Zhang, Nanxin Chen, Rohit Prabhavalkar, Tara N. Sainath, Trevor Strohman |
| 2023 | Interspeech | How to Estimate Model Transferability of Pre-Trained Speech Models? | Zih-Ching Chen, Chao-Han Huck Yang, Bo Li, Yu Zhang, Nanxin Chen, Shuo-Yiin Chang, Rohit Prabhavalkar, Hung-yi Lee, Tara N. Sainath |
| 2023 | Interspeech | Improving Joint Speech-Text Representations Without Alignment. | Cal Peyser, Zhong Meng, Rohit Prabhavalkar, Andrew Rosenberg, Tara N. Sainath, Michael Picheny, Kyunghyun Cho, Ke Hu |
| 2022 | ICASSP | Neural-FST Class Language Model for End-to-End Speech Recognition. | Antoine Bruguier, Duc Le, Rohit Prabhavalkar, Dangna Li, Zhe Liu, Bo Wang, Eun Chang, Fuchun Peng, Ozlem Kalinli, Michael L. Seltzer |
| 2022 | ICASSP | Improving The Latency And Quality Of Cascaded Encoders. | Tara N. Sainath, Yanzhang He, Arun Narayanan, Rami Botros, Weiran Wang, David Qiu, Chung-Cheng Chiu, Rohit Prabhavalkar, Alexander Gruenstein, Anmol Gulati, Bo Li, David Rybach, Emmanuel Guzman, Ian McGraw, James Qin, Krzysztof Choromanski, Qiao Liang, Robert David, Ruoming Pang, Shuo-Yiin Chang, Trevor Strohman, W. Ronny Huang, Wei Han, Yonghui Wu, Yu Zhang |
| 2022 | Interspeech | A Unified Cascaded Encoder ASR Model for Dynamic Model Sizes. | Shaojin Ding, Weiran Wang, Ding Zhao, Tara N. Sainath, Yanzhang He, Robert David, Rami Botros, Xin Wang, Rina Panigrahy, Qiao Liang, Dongseong Hwang, Ian McGraw, Rohit Prabhavalkar, Trevor Strohman |
| 2022 | Interspeech | E2E Segmenter: Joint Segmenting and Decoding for Long-Form ASR. | W. Ronny Huang, Shuo-Yiin Chang, David Rybach, Tara N. Sainath, Rohit Prabhavalkar, Cal Peyser, Zhiyun Lu, Cyril Allauzen |
| 2022 | Interspeech | Improving Deliberation by Text-Only and Semi-Supervised Training. | Ke Hu, Tara N. Sainath, Yanzhang He, Rohit Prabhavalkar, Trevor Strohman, Sepand Mavandadi, Weiran Wang |
| 2022 | Interspeech | Improving Rare Word Recognition with LM-aware MWER Training. | Weiran Wang, Tongzhou Chen, Tara N. Sainath, Ehsan Variani, Rohit Prabhavalkar, W. Ronny Huang, Bhuvana Ramabhadran, Neeraj Gaur, Sepand Mavandadi, Cal Peyser, Trevor Strohman, Yanzhang He, David Rybach |
| 2021 | ICASSP | A Neural Acoustic Echo Canceller Optimized Using An Automatic Speech Recognizer and Large Scale Synthetic Data. | Nathan Howard, Alex Park, Turaj Zakizadeh Shabestary, Alexander Gruenstein, Rohit Prabhavalkar |
| 2021 | ICASSP | Cascaded Encoders for Unifying Streaming and Non-Streaming ASR. | Arun Narayanan, Tara N. Sainath, Ruoming Pang, Jiahui Yu, Chung-Cheng Chiu, Rohit Prabhavalkar, Ehsan Variani, Trevor Strohman |
| 2021 | ICASSP | Less is More: Improved RNN-T Decoding Using Limited Label Context and Path Merging. | Rohit Prabhavalkar, Yanzhang He, David Rybach, Sean Campbell, Arun Narayanan, Trevor Strohman, Tara N. Sainath |
| 2021 | ICASSP | Learning Word-Level Confidence for Subword End-To-End ASR. | David Qiu, Qiujia Li, Yanzhang He, Yu Zhang, Bo Li, Liangliang Cao, Rohit Prabhavalkar, Deepti Bhatia, Wei Li, Ke Hu, Tara N. Sainath, Ian McGraw |
| 2021 | ICASSP | Replacing Human Audio with Synthetic Audio for on-Device Unspoken Punctuation Prediction. | Daria Soboleva, Ondrej Skopek, Mrius Sajgalk, Victor Carbune, Felix Weissenberger, Julia Proskurnia, Bogdan Prisacari, Daniel Valcarce, Justin Lu, Rohit Prabhavalkar, Balint Miklos |
| 2021 | Interspeech | Dissecting User-Perceived Latency of On-Device E2E Speech Recognition. | Yuan Shangguan, Rohit Prabhavalkar, Hang Su, Jay Mahadeokar, Yangyang Shi, Jiatong Zhou, Chunyang Wu, Duc Le, Ozlem Kalinli, Christian Fuegen, Michael L. Seltzer |
| 2021 | Interspeech | Dynamic Encoder Transducer: A Flexible Solution for Trading Off Accuracy for Latency. | Yangyang Shi, Varun Nagaraja, Chunyang Wu, Jay Mahadeokar, Duc Le, Rohit Prabhavalkar, Alex Xiao, Ching-Feng Yeh, Julian Chan, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer |
| 2020 | ICASSP | Deliberation Model Based Two-Pass End-To-End Speech Recognition. | Ke Hu, Tara N. Sainath, Ruoming Pang, Rohit Prabhavalkar |
| 2020 | ICASSP | A Streaming On-Device End-To-End Model Surpassing Server-Side Conventional Model Quality and Latency. | Tara N. Sainath, Yanzhang He, Bo Li, Arun Narayanan, Ruoming Pang, Antoine Bruguier, Shuo-Yiin Chang, Wei Li, Raziel Alvarez, Zhifeng Chen, Chung-Cheng Chiu, David Garcia, Alexander Gruenstein, Ke Hu, Anjuli Kannan, Qiao Liang, Ian McGraw, Cal Peyser, Rohit Prabhavalkar, Golan Pundak, David Rybach, Yuan Shangguan, Yash Sheth, Trevor Strohman, Mirk Visontai, Yonghui Wu, Yu Zhang, Ding Zhao |
| 2020 | Interspeech | Anti-Aliasing Regularization in Stacking Layers. | Antoine Bruguier, Ananya Misra, Arun Narayanan, Rohit Prabhavalkar |
| 2019 | ASRU | A Comparison of End-to-End Models for Long-Form Speech Recognition. | Chung-Cheng Chiu, Anjuli Kannan, Rohit Prabhavalkar, Zhifeng Chen, Tara N. Sainath, Yonghui Wu, Wei Han, Yu Zhang, Ruoming Pang, Sergey Kishchenko, Patrick Nguyen, Arun Narayanan, Hank Liao, Shuyuan Zhang |
| 2019 | ASRU | Recognizing Long-Form Speech Using Streaming End-to-End Models. | Arun Narayanan, Rohit Prabhavalkar, Chung-Cheng Chiu, David Rybach, Tara N. Sainath, Trevor Strohman |
| 2019 | ICASSP | Phoebe: Pronunciation-aware Contextualization for End-to-end Speech Recognition. | Antoine Bruguier, Rohit Prabhavalkar, Golan Pundak, Tara N. Sainath |
| 2019 | ICASSP | Joint Endpointing and Decoding with End-to-end Models. | Shuo-Yiin Chang, Rohit Prabhavalkar, Yanzhang He, Tara N. Sainath, Gabor Simko |
| 2019 | ICASSP | Streaming End-to-end Speech Recognition for Mobile Devices. | Yanzhang He, Tara N. Sainath, Rohit Prabhavalkar, Ian McGraw, Raziel Alvarez, Ding Zhao, David Rybach, Anjuli Kannan, Yonghui Wu, Ruoming Pang, Qiao Liang, Deepti Bhatia, Yuan Shangguan, Bo Li, Golan Pundak, Khe Chai Sim, Tom Bagby, Shuo-Yiin Chang, Kanishka Rao, Alexander Gruenstein |
| 2019 | Interspeech | Phoneme-Based Contextualization for Cross-Lingual Speech Recognition in End-to-End Models. | Ke Hu, Antoine Bruguier, Tara N. Sainath, Rohit Prabhavalkar, Golan Pundak |
| 2019 | Interspeech | On the Choice of Modeling Unit for Sequence-to-Sequence Speech Recognition. | Kazuki Irie, Rohit Prabhavalkar, Anjuli Kannan, Antoine Bruguier, David Rybach, Patrick Nguyen |
| 2019 | Interspeech | Two-Pass End-to-End Speech Recognition. | Tara N. Sainath, Ruoming Pang, David Rybach, Yanzhang He, Rohit Prabhavalkar, Wei Li, Mirk Visontai, Qiao Liang, Trevor Strohman, Yonghui Wu, Ian McGraw, Chung-Cheng Chiu |
| 2018 | ICASSP | State-of-the-Art Speech Recognition with Sequence-to-Sequence Models. | Chung-Cheng Chiu, Tara N. Sainath, Yonghui Wu, Rohit Prabhavalkar, Patrick Nguyen, Zhifeng Chen, Anjuli Kannan, Ron J. Weiss, Kanishka Rao, Ekaterina Gonina, Navdeep Jaitly, Bo Li, Jan Chorowski, Michiel Bacchiani |
| 2018 | ICASSP | Exploring Speech Enhancement with Generative Adversarial Networks for Robust Speech Recognition. | Chris Donahue, Bo Li, Rohit Prabhavalkar |
| 2018 | ICASSP | An Analysis of Incorporating an External Language Model into a Sequence-to-Sequence Model. | Anjuli Kannan, Yonghui Wu, Patrick Nguyen, Tara N. Sainath, Zhifeng Chen, Rohit Prabhavalkar |
| 2018 | ICASSP | Minimum Word Error Rate Training for Attention-Based Sequence-to-Sequence Models. | Rohit Prabhavalkar, Tara N. Sainath, Yonghui Wu, Patrick Nguyen, Zhifeng Chen, Chung-Cheng Chiu, Anjuli Kannan |
| 2018 | ICASSP | Improving the Performance of Online Neural Transducer Models. | Tara N. Sainath, Chung-Cheng Chiu, Rohit Prabhavalkar, Anjuli Kannan, Yonghui Wu, Patrick Nguyen, Zhifeng Chen |
| 2018 | ICASSP | No Need for a Lexicon? Evaluating the Value of the Pronunciation Lexica in End-to-End Models. | Tara N. Sainath, Rohit Prabhavalkar, Shankar Kumar, Seungji Lee, Anjuli Kannan, David Rybach, Vlad Schogol, Patrick Nguyen, Bo Li, Yonghui Wu, Zhifeng Chen, Chung-Cheng Chiu |
| 2018 | Interspeech | Compression of End-to-End Models. | Ruoming Pang, Tara N. Sainath, Rohit Prabhavalkar, Suyog Gupta, Yonghui Wu, Shuyuan Zhang, Chung-Cheng Chiu |
| 2017 | ASRU | Streaming small-footprint keyword spotting using sequence-to-sequence models. | Yanzhang He, Rohit Prabhavalkar, Kanishka Rao, Wei Li, Anton Bakhtin, Ian McGraw |
| 2017 | ASRU | Exploring architectures, data and units for streaming end-to-end speech recognition with RNN-transducer. | Kanishka Rao, Hasim Sak, Rohit Prabhavalkar |
| 2017 | Interspeech | A Comparison of Sequence-to-Sequence Models for Speech Recognition. | Rohit Prabhavalkar, Kanishka Rao, Tara N. Sainath, Bo Li, Leif Johnson, Navdeep Jaitly |
| 2017 | Interspeech | An Analysis of "Attention" in Sequence-to-Sequence Models. | Rohit Prabhavalkar, Tara N. Sainath, Bo Li, Kanishka Rao, Navdeep Jaitly |
| 2016 | ICASSP | Personalized speech recognition on mobile devices. | Ian McGraw, Rohit Prabhavalkar, Raziel Alvarez, Montse Gonzalez Arenas, Kanishka Rao, David Rybach, Ouais Alsharif, Hasim Sak, Alexander Gruenstein, Franoise Beaufays, Carolina Parada |
| 2016 | ICASSP | On the compression of recurrent neural networks with an application to LVCSR acoustic modeling for embedded speech recognition. | Rohit Prabhavalkar, Ouais Alsharif, Antoine Bruguier, Ian McGraw |
| 2016 | Interspeech | On the Efficient Representation and Execution of Deep Acoustic Models. | Raziel Alvarez, Rohit Prabhavalkar, Anton Bakhtin |
| 2015 | ICASSP | Automatic gain control and multi-style training for robust small-footprint keyword spotting with deep neural networks. | Rohit Prabhavalkar, Raziel Alvarez, Carolina Parada, Preetum Nakkiran, Tara N. Sainath |
| 2015 | Interspeech | Compressing deep neural networks using a rank-constrained topology. | Preetum Nakkiran, Raziel Alvarez, Rohit Prabhavalkar, Carolina Parada |
| 2013 | ICASSP | Discriminative articulatory models for spoken term detection in low-resource conversational settings. | Rohit Prabhavalkar, Karen Livescu, Eric Fosler-Lussier, Joseph Keshet |
| 2013 | ICASSP | An evaluation of posterior modeling techniques for phonetic recognition. | Rohit Prabhavalkar, Tara N. Sainath, David Nahamoo, Bhuvana Ramabhadran, Dimitri Kanevsky |
| 2012 | ICASSP | A chunk-based phonetic score for mobile voice search. | Rohit Prabhavalkar, Jasha Droppo |
| 2011 | ASRU | A factored conditional random field model for articulatory feature forced transcription. | Rohit Prabhavalkar, Eric Fosler-Lussier, Karen Livescu |
| 2011 | Interspeech | Articulatory Feature Classification Using Nearest Neighbors. | Arild Brandrud Nss, Karen Livescu, Rohit Prabhavalkar |
| 2010 | ICASSP | Backpropagation training for multilayer conditional random field based phone recognition. | Rohit Prabhavalkar, Eric Fosler-Lussier |
| 2010 | Interspeech | Combining monaural and binaural evidence for reverberant speech segregation. | John Woodruff, Rohit Prabhavalkar, Eric Fosler-Lussier, DeLiang Wang |
| 2010 | NAACL | Investigations into the Crandem Approach to Word Recognition. | Rohit Prabhavalkar, Preethi Jyothi, William Hartmann, Jeremy Morris, Eric Fosler-Lussier |
| 2009 | Interspeech | Monaural segregation of voiced speech using discriminative random fields. | Rohit Prabhavalkar, Zhaozhang Jin, Eric Fosler-Lussier |