Skip to content

Rohit Prabhavalkar

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

70

Venues

4

Active years

2009–2025

Best venue rank

Multiconference

Where they publish

Papers

70 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPWeak-to-Strong Generalization in Speech Recognition.Soheil Khorram, Qian Zhang, Rohit Prabhavalkar, Kartik Audhkhasi, Bhuvana Ramabhadran
2024ICASSPUSM-Lite: Quantization and Sparsity Aware Fine-Tuning for Speech Recognition with Universal Speech Models.Shaojin Ding, David Qiu, David Rim, Yanzhang He, Oleg Rybakov, Bo Li, Rohit Prabhavalkar, Weiran Wang, Tara N. Sainath, Zhonglin Han, Jian Li, Amir Yazdanbakhsh, Shivani Agrawal
2024ICASSPExtreme Encoder Output Frame Rate Reduction: Improving Computational Latencies of Large End-to-End Models.Rohit Prabhavalkar, Zhong Meng, Weiran Wang, Adam Stooke, Xingyu Cai, Yanzhang He, Arun Narayanan, Dongseong Hwang, Tara N. Sainath, Pedro J. Moreno
2024InterspeechEfficiently Train ASR Models that Memorize Less and Perform Better with Per-core Clipping.Lun Wang, Om Thakkar, Zhong Meng, Nicole Rafidi, Rohit Prabhavalkar, Arun Narayanan
2024InterspeechText Injection for Neural Contextual Biasing.Zhong Meng, Zelin Wu, Rohit Prabhavalkar, Cal Peyser, Weiran Wang, Nanxin Chen, Tara N. Sainath, Bhuvana Ramabhadran
2024InterspeechContextual Biasing with the Knuth-Morris-Pratt Matching Algorithm.Weiran Wang, Zelin Wu, Diamantino Caseiro, Tsendsuren Munkhdalai, Khe Chai Sim, Pat Rondon, Golan Pundak, Gan Song, Rohit Prabhavalkar, Zhong Meng, Ding Zhao, Tara Sainath, Yanzhang He, Pedro Moreno Mengibar
2024NAACLMassive End-to-end Speech Recognition Models with Time Reduction.Weiran Wang, Rohit Prabhavalkar, Haozhe Shan, Zhong Meng, Dongseong Hwang, Qiujia Li, Khe Chai Sim, Bo Li, James Qin, Xingyu Cai, Adam Stooke, Chengjian Zheng, Yanzhang He, Tara N. Sainath, Pedro Moreno Mengibar
2024NAACLDeferred NAM: Low-latency Top-K Context Injection via Deferred Context Encoding for Non-Streaming ASR.Zelin Wu, Gan Song, Christopher Li, Pat Rondon, Zhong Meng, Xavier Velez, Weiran Wang, Diamantino Caseiro, Golan Pundak, Tsendsuren Munkhdalai, Angad Chandorkar, Rohit Prabhavalkar
2023ASRUImproved Long-Form Speech Recognition By Jointly Modeling The Primary And Non-Primary Speakers.Guru Prakash Arumugam, Shuo-Yiin Chang, Tara N. Sainath, Rohit Prabhavalkar, Quan Wang, Shaan Bijwadia
2023ASRUEfficient Cascaded Streaming ASR System Via Frame Rate Reduction.Xingyu Cai, David Qiu, Shaojin Ding, Dongseong Hwang, Weiran Wang, Antoine Bruguier, Rohit Prabhavalkar, Tara N. Sainath, Yanzhang He
2023ASRUThe Gift of Feedback: Improving ASR Model Quality by Learning from User Corrections Through Federated Learning.Lillian Zhou, Yuxin Ding, Mingqing Chen, Harry Zhang, Rohit Prabhavalkar, Dhruv Guliani, Giovanni Motta, Rajiv Mathews
2023ICASSPLego-Features: Exporting Modular Encoder Features for Streaming and Deliberation ASR.Rami Botros, Rohit Prabhavalkar, Johan Schalkwyk, Ciprian Chelba, Tara N. Sainath, Franoise Beaufays
2023ICASSPSharing Low Rank Conformer Weights for Tiny Always-On Ambient Speech Recognition Models.Steven M. Hernandez, Ding Zhao, Shaojin Ding, Antoine Bruguier, Rohit Prabhavalkar, Tara N. Sainath, Yanzhang He, Ian McGraw
2023ICASSPE2E Segmentation in a Two-Pass Cascaded Encoder ASR Model.W. Ronny Huang, Shuo-Yiin Chang, Tara N. Sainath, Yanzhang He, David Rybach, Robert David, Rohit Prabhavalkar, Cyril Allauzen, Cal Peyser, Trevor D. Strohman
2023ICASSPCross-Training: A Semi-Supervised Training Scheme for Speech Recognition.Soheil Khorram, Anshuman Tripathi, Jaeyoung Kim, Han Lu, Qian Zhang, Rohit Prabhavalkar, Hasim Sak
2023ICASSPJEIT: Joint End-to-End Model and Internal Language Model Training for Speech Recognition.Zhong Meng, Weiran Wang, Rohit Prabhavalkar, Tara N. Sainath, Tongzhou Chen, Ehsan Variani, Yu Zhang, Bo Li, Andrew Rosenberg, Bhuvana Ramabhadran
2023ICASSPA Comparison of Semi-Supervised Learning Techniques for Streaming ASR at Scale.Cal Peyser, Michael Picheny, Kyunghyun Cho, Rohit Prabhavalkar, W. Ronny Huang, Tara N. Sainath
2023ICASSPImproving Contextual Biasing with Text Injection.Tara N. Sainath, Rohit Prabhavalkar, Diamantino Caseiro, Pat Rondon, Cyril Allauzen
2023ICASSPFrom English to More Languages: Parameter-Efficient Model Reprogramming for Cross-Lingual Speech Recognition.Chao-Han Huck Yang, Bo Li, Yu Zhang, Nanxin Chen, Rohit Prabhavalkar, Tara N. Sainath, Trevor Strohman
2023InterspeechHow to Estimate Model Transferability of Pre-Trained Speech Models?Zih-Ching Chen, Chao-Han Huck Yang, Bo Li, Yu Zhang, Nanxin Chen, Shuo-Yiin Chang, Rohit Prabhavalkar, Hung-yi Lee, Tara N. Sainath
2023InterspeechImproving Joint Speech-Text Representations Without Alignment.Cal Peyser, Zhong Meng, Rohit Prabhavalkar, Andrew Rosenberg, Tara N. Sainath, Michael Picheny, Kyunghyun Cho, Ke Hu
2022ICASSPNeural-FST Class Language Model for End-to-End Speech Recognition.Antoine Bruguier, Duc Le, Rohit Prabhavalkar, Dangna Li, Zhe Liu, Bo Wang, Eun Chang, Fuchun Peng, Ozlem Kalinli, Michael L. Seltzer
2022ICASSPImproving The Latency And Quality Of Cascaded Encoders.Tara N. Sainath, Yanzhang He, Arun Narayanan, Rami Botros, Weiran Wang, David Qiu, Chung-Cheng Chiu, Rohit Prabhavalkar, Alexander Gruenstein, Anmol Gulati, Bo Li, David Rybach, Emmanuel Guzman, Ian McGraw, James Qin, Krzysztof Choromanski, Qiao Liang, Robert David, Ruoming Pang, Shuo-Yiin Chang, Trevor Strohman, W. Ronny Huang, Wei Han, Yonghui Wu, Yu Zhang
2022InterspeechA Unified Cascaded Encoder ASR Model for Dynamic Model Sizes.Shaojin Ding, Weiran Wang, Ding Zhao, Tara N. Sainath, Yanzhang He, Robert David, Rami Botros, Xin Wang, Rina Panigrahy, Qiao Liang, Dongseong Hwang, Ian McGraw, Rohit Prabhavalkar, Trevor Strohman
2022InterspeechE2E Segmenter: Joint Segmenting and Decoding for Long-Form ASR.W. Ronny Huang, Shuo-Yiin Chang, David Rybach, Tara N. Sainath, Rohit Prabhavalkar, Cal Peyser, Zhiyun Lu, Cyril Allauzen
2022InterspeechImproving Deliberation by Text-Only and Semi-Supervised Training.Ke Hu, Tara N. Sainath, Yanzhang He, Rohit Prabhavalkar, Trevor Strohman, Sepand Mavandadi, Weiran Wang
2022InterspeechImproving Rare Word Recognition with LM-aware MWER Training.Weiran Wang, Tongzhou Chen, Tara N. Sainath, Ehsan Variani, Rohit Prabhavalkar, W. Ronny Huang, Bhuvana Ramabhadran, Neeraj Gaur, Sepand Mavandadi, Cal Peyser, Trevor Strohman, Yanzhang He, David Rybach
2021ICASSPA Neural Acoustic Echo Canceller Optimized Using An Automatic Speech Recognizer and Large Scale Synthetic Data.Nathan Howard, Alex Park, Turaj Zakizadeh Shabestary, Alexander Gruenstein, Rohit Prabhavalkar
2021ICASSPCascaded Encoders for Unifying Streaming and Non-Streaming ASR.Arun Narayanan, Tara N. Sainath, Ruoming Pang, Jiahui Yu, Chung-Cheng Chiu, Rohit Prabhavalkar, Ehsan Variani, Trevor Strohman
2021ICASSPLess is More: Improved RNN-T Decoding Using Limited Label Context and Path Merging.Rohit Prabhavalkar, Yanzhang He, David Rybach, Sean Campbell, Arun Narayanan, Trevor Strohman, Tara N. Sainath
2021ICASSPLearning Word-Level Confidence for Subword End-To-End ASR.David Qiu, Qiujia Li, Yanzhang He, Yu Zhang, Bo Li, Liangliang Cao, Rohit Prabhavalkar, Deepti Bhatia, Wei Li, Ke Hu, Tara N. Sainath, Ian McGraw
2021ICASSPReplacing Human Audio with Synthetic Audio for on-Device Unspoken Punctuation Prediction.Daria Soboleva, Ondrej Skopek, Mrius Sajgalk, Victor Carbune, Felix Weissenberger, Julia Proskurnia, Bogdan Prisacari, Daniel Valcarce, Justin Lu, Rohit Prabhavalkar, Balint Miklos
2021InterspeechDissecting User-Perceived Latency of On-Device E2E Speech Recognition.Yuan Shangguan, Rohit Prabhavalkar, Hang Su, Jay Mahadeokar, Yangyang Shi, Jiatong Zhou, Chunyang Wu, Duc Le, Ozlem Kalinli, Christian Fuegen, Michael L. Seltzer
2021InterspeechDynamic Encoder Transducer: A Flexible Solution for Trading Off Accuracy for Latency.Yangyang Shi, Varun Nagaraja, Chunyang Wu, Jay Mahadeokar, Duc Le, Rohit Prabhavalkar, Alex Xiao, Ching-Feng Yeh, Julian Chan, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer
2020ICASSPDeliberation Model Based Two-Pass End-To-End Speech Recognition.Ke Hu, Tara N. Sainath, Ruoming Pang, Rohit Prabhavalkar
2020ICASSPA Streaming On-Device End-To-End Model Surpassing Server-Side Conventional Model Quality and Latency.Tara N. Sainath, Yanzhang He, Bo Li, Arun Narayanan, Ruoming Pang, Antoine Bruguier, Shuo-Yiin Chang, Wei Li, Raziel Alvarez, Zhifeng Chen, Chung-Cheng Chiu, David Garcia, Alexander Gruenstein, Ke Hu, Anjuli Kannan, Qiao Liang, Ian McGraw, Cal Peyser, Rohit Prabhavalkar, Golan Pundak, David Rybach, Yuan Shangguan, Yash Sheth, Trevor Strohman, Mirk Visontai, Yonghui Wu, Yu Zhang, Ding Zhao
2020InterspeechAnti-Aliasing Regularization in Stacking Layers.Antoine Bruguier, Ananya Misra, Arun Narayanan, Rohit Prabhavalkar
2019ASRUA Comparison of End-to-End Models for Long-Form Speech Recognition.Chung-Cheng Chiu, Anjuli Kannan, Rohit Prabhavalkar, Zhifeng Chen, Tara N. Sainath, Yonghui Wu, Wei Han, Yu Zhang, Ruoming Pang, Sergey Kishchenko, Patrick Nguyen, Arun Narayanan, Hank Liao, Shuyuan Zhang
2019ASRURecognizing Long-Form Speech Using Streaming End-to-End Models.Arun Narayanan, Rohit Prabhavalkar, Chung-Cheng Chiu, David Rybach, Tara N. Sainath, Trevor Strohman
2019ICASSPPhoebe: Pronunciation-aware Contextualization for End-to-end Speech Recognition.Antoine Bruguier, Rohit Prabhavalkar, Golan Pundak, Tara N. Sainath
2019ICASSPJoint Endpointing and Decoding with End-to-end Models.Shuo-Yiin Chang, Rohit Prabhavalkar, Yanzhang He, Tara N. Sainath, Gabor Simko
2019ICASSPStreaming End-to-end Speech Recognition for Mobile Devices.Yanzhang He, Tara N. Sainath, Rohit Prabhavalkar, Ian McGraw, Raziel Alvarez, Ding Zhao, David Rybach, Anjuli Kannan, Yonghui Wu, Ruoming Pang, Qiao Liang, Deepti Bhatia, Yuan Shangguan, Bo Li, Golan Pundak, Khe Chai Sim, Tom Bagby, Shuo-Yiin Chang, Kanishka Rao, Alexander Gruenstein
2019InterspeechPhoneme-Based Contextualization for Cross-Lingual Speech Recognition in End-to-End Models.Ke Hu, Antoine Bruguier, Tara N. Sainath, Rohit Prabhavalkar, Golan Pundak
2019InterspeechOn the Choice of Modeling Unit for Sequence-to-Sequence Speech Recognition.Kazuki Irie, Rohit Prabhavalkar, Anjuli Kannan, Antoine Bruguier, David Rybach, Patrick Nguyen
2019InterspeechTwo-Pass End-to-End Speech Recognition.Tara N. Sainath, Ruoming Pang, David Rybach, Yanzhang He, Rohit Prabhavalkar, Wei Li, Mirk Visontai, Qiao Liang, Trevor Strohman, Yonghui Wu, Ian McGraw, Chung-Cheng Chiu
2018ICASSPState-of-the-Art Speech Recognition with Sequence-to-Sequence Models.Chung-Cheng Chiu, Tara N. Sainath, Yonghui Wu, Rohit Prabhavalkar, Patrick Nguyen, Zhifeng Chen, Anjuli Kannan, Ron J. Weiss, Kanishka Rao, Ekaterina Gonina, Navdeep Jaitly, Bo Li, Jan Chorowski, Michiel Bacchiani
2018ICASSPExploring Speech Enhancement with Generative Adversarial Networks for Robust Speech Recognition.Chris Donahue, Bo Li, Rohit Prabhavalkar
2018ICASSPAn Analysis of Incorporating an External Language Model into a Sequence-to-Sequence Model.Anjuli Kannan, Yonghui Wu, Patrick Nguyen, Tara N. Sainath, Zhifeng Chen, Rohit Prabhavalkar
2018ICASSPMinimum Word Error Rate Training for Attention-Based Sequence-to-Sequence Models.Rohit Prabhavalkar, Tara N. Sainath, Yonghui Wu, Patrick Nguyen, Zhifeng Chen, Chung-Cheng Chiu, Anjuli Kannan
2018ICASSPImproving the Performance of Online Neural Transducer Models.Tara N. Sainath, Chung-Cheng Chiu, Rohit Prabhavalkar, Anjuli Kannan, Yonghui Wu, Patrick Nguyen, Zhifeng Chen
2018ICASSPNo Need for a Lexicon? Evaluating the Value of the Pronunciation Lexica in End-to-End Models.Tara N. Sainath, Rohit Prabhavalkar, Shankar Kumar, Seungji Lee, Anjuli Kannan, David Rybach, Vlad Schogol, Patrick Nguyen, Bo Li, Yonghui Wu, Zhifeng Chen, Chung-Cheng Chiu
2018InterspeechCompression of End-to-End Models.Ruoming Pang, Tara N. Sainath, Rohit Prabhavalkar, Suyog Gupta, Yonghui Wu, Shuyuan Zhang, Chung-Cheng Chiu
2017ASRUStreaming small-footprint keyword spotting using sequence-to-sequence models.Yanzhang He, Rohit Prabhavalkar, Kanishka Rao, Wei Li, Anton Bakhtin, Ian McGraw
2017ASRUExploring architectures, data and units for streaming end-to-end speech recognition with RNN-transducer.Kanishka Rao, Hasim Sak, Rohit Prabhavalkar
2017InterspeechA Comparison of Sequence-to-Sequence Models for Speech Recognition.Rohit Prabhavalkar, Kanishka Rao, Tara N. Sainath, Bo Li, Leif Johnson, Navdeep Jaitly
2017InterspeechAn Analysis of "Attention" in Sequence-to-Sequence Models.Rohit Prabhavalkar, Tara N. Sainath, Bo Li, Kanishka Rao, Navdeep Jaitly
2016ICASSPPersonalized speech recognition on mobile devices.Ian McGraw, Rohit Prabhavalkar, Raziel Alvarez, Montse Gonzalez Arenas, Kanishka Rao, David Rybach, Ouais Alsharif, Hasim Sak, Alexander Gruenstein, Franoise Beaufays, Carolina Parada
2016ICASSPOn the compression of recurrent neural networks with an application to LVCSR acoustic modeling for embedded speech recognition.Rohit Prabhavalkar, Ouais Alsharif, Antoine Bruguier, Ian McGraw
2016InterspeechOn the Efficient Representation and Execution of Deep Acoustic Models.Raziel Alvarez, Rohit Prabhavalkar, Anton Bakhtin
2015ICASSPAutomatic gain control and multi-style training for robust small-footprint keyword spotting with deep neural networks.Rohit Prabhavalkar, Raziel Alvarez, Carolina Parada, Preetum Nakkiran, Tara N. Sainath
2015InterspeechCompressing deep neural networks using a rank-constrained topology.Preetum Nakkiran, Raziel Alvarez, Rohit Prabhavalkar, Carolina Parada
2013ICASSPDiscriminative articulatory models for spoken term detection in low-resource conversational settings.Rohit Prabhavalkar, Karen Livescu, Eric Fosler-Lussier, Joseph Keshet
2013ICASSPAn evaluation of posterior modeling techniques for phonetic recognition.Rohit Prabhavalkar, Tara N. Sainath, David Nahamoo, Bhuvana Ramabhadran, Dimitri Kanevsky
2012ICASSPA chunk-based phonetic score for mobile voice search.Rohit Prabhavalkar, Jasha Droppo
2011ASRUA factored conditional random field model for articulatory feature forced transcription.Rohit Prabhavalkar, Eric Fosler-Lussier, Karen Livescu
2011InterspeechArticulatory Feature Classification Using Nearest Neighbors.Arild Brandrud Nss, Karen Livescu, Rohit Prabhavalkar
2010ICASSPBackpropagation training for multilayer conditional random field based phone recognition.Rohit Prabhavalkar, Eric Fosler-Lussier
2010InterspeechCombining monaural and binaural evidence for reverberant speech segregation.John Woodruff, Rohit Prabhavalkar, Eric Fosler-Lussier, DeLiang Wang
2010NAACLInvestigations into the Crandem Approach to Word Recognition.Rohit Prabhavalkar, Preethi Jyothi, William Hartmann, Jeremy Morris, Eric Fosler-Lussier
2009InterspeechMonaural segregation of voiced speech using discriminative random fields.Rohit Prabhavalkar, Zhaozhang Jin, Eric Fosler-Lussier