| 2025 | EMNLP | The Role of Outgoing Connection Heterogeneity in Feedforward Layers of Large Language Models. | Felix Stahlberg, Shankar Kumar |
| 2025 | ICASSP | Predicting Compact Phrasal Rewrites with Large Language Models for ASR Post Editing. | Hao Zhang, Felix Stahlberg, Shankar Kumar |
| 2024 | NAACL | Towards an On-device Agent for Text Rewriting. | Yun Zhu, Yinxiao Liu, Felix Stahlberg, Shankar Kumar, Yu-Hui Chen, Liangchen Luo, Lei Shu, Renjie Liu, Jindong Chen, Lei Meng |
| 2023 | EMNLP | Long-Form Speech Translation through Segmentation with Finite-State Decoding Constraints on Large Language Models. | Arya McCarthy, Hao Zhang, Shankar Kumar, Felix Stahlberg, Ke Wu |
| 2023 | ICASSP | Multi-Output RNN-T Joint Networks for Multi-Task Learning of ASR and Auxiliary Tasks. | Weiran Wang, Ding Zhao, Shaojin Ding, Hao Zhang, Shuo-Yiin Chang, David Rybach, Tara N. Sainath, Yanzhang He, Ian McGraw, Shankar Kumar |
| 2023 | Interspeech | Semantic Segmentation with Bidirectional Language Models Improves Long-form ASR. | W. Ronny Huang, Hao Zhang, Shankar Kumar, Shuo-Yiin Chang, Tara N. Sainath |
| 2023 | KDD | Fast Text Generation with Text-Editing Models. | Eric Malmi, Yue Dong, Jonathan Mallinson, Aleksandr Chuklin, Jakub Admek, Daniil Mirylenka, Felix Stahlberg, Sebastian Krause, Shankar Kumar, Aliaksei Severyn |
| 2022 | ACL | Uncertainty Determines the Adequacy of the Mode and the Tractability of Decoding in Sequence-to-Sequence Models. | Felix Stahlberg, Ilia Kulikov, Shankar Kumar |
| 2022 | ICASSP | Capitalization Normalization for Language Modeling with an Accurate and Efficient Hierarchical RNN Model. | Hao Zhang, You-Chi Cheng, Shankar Kumar, W. Ronny Huang, Mingqing Chen, Rajiv Mathews |
| 2022 | Interspeech | Sentence-Select: Large-Scale Language Model Data Selection for Rare-Word Speech Recognition. | W. Ronny Huang, Cal Peyser, Tara N. Sainath, Ruoming Pang, Trevor D. Strohman, Shankar Kumar |
| 2022 | NAACL | Jam or Cream First? Modeling Ambiguity in Neural Machine Translation with SCONES. | Felix Stahlberg, Shankar Kumar |
| 2021 | Interspeech | Lookup-Table Recurrent Language Models for Long Tail Speech Recognition. | W. Ronny Huang, Tara N. Sainath, Cal Peyser, Shankar Kumar, David Rybach, Trevor Strohman |
| 2020 | EMNLP | Seq2Edits: Sequence Transduction Using Span-level Edit Operations. | Felix Stahlberg, Shankar Kumar |
| 2020 | ICASSP | Transformer Transducer: A Streamable Speech Recognition Model with Transformer Encoders and RNN-T Loss. | Qian Zhang, Han Lu, Hasim Sak, Anshuman Tripathi, Erik McDermott, Stephen Koo, Shankar Kumar |
| 2020 | Interspeech | Improving Tail Performance of a Deliberation E2E ASR Model Using a Large Text Corpus. | Cal Peyser, Sepand Mavandadi, Tara N. Sainath, James Apfel, Ruoming Pang, Shankar Kumar |
| 2019 | NAACL | Corpora Generation for Grammatical Error Correction. | Jared Lichtarge, Chris Alberti, Shankar Kumar, Noam Shazeer, Niki Parmar, Simon Tong |
| 2018 | ICASSP | A Conversational Neural Language Model for Speech Recognition in Digital Assistants. | Eunjoon Cho, Shankar Kumar |
| 2018 | ICASSP | RADMM: Recurrent Adaptive Mixture Model with Applications to Domain Robust Language Modeling. | Kazuki Irie, Shankar Kumar, Michael Nirschl, Hank Liao |
| 2018 | ICASSP | Modeling Non-Linguistic Contextual Signals in LSTM Language Models Via Domain Adaptation. | Min Ma, Shankar Kumar, Fadi Biadsy, Michael Nirschl, Tomas Vykruta, Pedro J. Moreno |
| 2018 | ICASSP | No Need for a Lexicon? Evaluating the Value of the Pronunciation Lexica in End-to-End Models. | Tara N. Sainath, Rohit Prabhavalkar, Shankar Kumar, Seungji Lee, Anjuli Kannan, David Rybach, Vlad Schogol, Patrick Nguyen, Bo Li, Yonghui Wu, Zhifeng Chen, Chung-Cheng Chiu |
| 2017 | ASRU | Lattice rescoring strategies for long short term memory language models in speech recognition. | Shankar Kumar, Michael Nirschl, Daniel Niels Holtmann-Rice, Hank Liao, Ananda Theertha Suresh, Felix X. Yu |
| 2017 | Interspeech | Approaches for Neural-Network Language Model Adaptation. | Min Ma, Michael Nirschl, Fadi Biadsy, Shankar Kumar |
| 2016 | Interspeech | NN-Grams: Unifying Neural Network and n-Gram Language Models for Speech Recognition. | Babak Damavandi, Shankar Kumar, Noam Shazeer, Antoine Bruguier |
| 2015 | NAACL | Multilingual Open Relation Extraction Using Cross-lingual Projection. | Manaal Faruqui, Shankar Kumar |
| 2010 | NAACL | Expected Sequence Similarity Maximization. | Cyril Allauzen, Shankar Kumar, Wolfgang Macherey, Mehryar Mohri, Michael Riley |
| 2010 | NAACL | Model Combination for Machine Translation. | John DeNero, Shankar Kumar, Ciprian Chelba, Franz Josef Och |
| 2009 | ACL | Efficient Minimum Error Rate Training and Minimum Bayes-Risk Decoding for Translation Hypergraphs and Lattices. | Shankar Kumar, Wolfgang Macherey, Chris Dyer, Franz Josef Och |
| 2008 | EMNLP | Lattice Minimum Bayes-Risk Decoding for Statistical Machine Translation. | Roy Tromble, Shankar Kumar, Franz Josef Och, Wolfgang Macherey |
| 2008 | WWW | Video suggestion and discovery for youtube: taking random walks through the view graph. | Shumeet Baluja, Rohan Seth, D. Sivakumar, Yushi Jing, Jay Yagnik, Shankar Kumar, Deepak Ravichandran, Mohamed Aly |
| 2007 | EMNLP | Improving Word Alignment with Bridge Languages. | Shankar Kumar, Franz Josef Och, Wolfgang Macherey |
| 2005 | NAACL | Local Phrase Reordering Models for Statistical Machine Translation. | Shankar Kumar, William J. Byrne |
| 2004 | NAACL | Minimum Bayes-Risk Decoding for Statistical Machine Translation. | Shankar Kumar, William J. Byrne |
| 2004 | NAACL | A Smorgasbord of Features for Statistical Machine Translation. | Franz Josef Och, Daniel Gildea, Sanjeev Khudanpur, Anoop Sarkar, Kenji Yamada, Alexander M. Fraser, Shankar Kumar, Libin Shen, David Smith, Katherine Eng, Viren Jain, Zhen Jin, Dragomir R. Radev |
| 2003 | NAACL | A Weighted Finite State Transducer Implementation of the Alignment Template Model for Statistical Machine Translation. | Shankar Kumar, William J. Byrne |
| 2002 | EMNLP | Minimum Bayes-Risk Word Alignments of Bilingual Texts. | Shankar Kumar, William Byrne |
| 2002 | Interspeech | Risk based lattice cutting for segmental minimum Bayes-risk decoding. | Shankar Kumar, William Byrne |
| 2001 | Interspeech | Confidence based lattice segmentation and minimum Bayes-risk decoding. | Vaibhava Goel, Shankar Kumar, William Byrne |
| 2000 | Interspeech | Segmental minimum Bayes-risk ASR voting strategies. | Vaibhava Goel, Shankar Kumar, William Byrne |
| 2000 | Interspeech | Unifying HMM and phone-pair segment models. | Hsiao-Wuen Hon, Shankar Kumar, Kuansan Wang |