Skip to content

Nitish Shirish Keskar

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

15

Venues

6

Active years

2015–2022

Best venue rank

A*

Where they publish

Papers

15 indexed papers, newest first.

YearVenueTitleAuthors
2022ACLModeling Multi-hop Question Answering as Single Sequence Prediction.Semih Yavuz, Kazuma Hashimoto, Yingbo Zhou, Nitish Shirish Keskar, Caiming Xiong
2021EMNLPChar2Subword: Extending the Subword Embedding Space Using Robust Character Compositionality.Gustavo Aguilar, Bryan McCann, Tong Niu, Nazneen Rajani, Nitish Shirish Keskar, Thamar Solorio
2021EMNLPGeDi: Generative Discriminator Guided Sequence Generation.Ben Krause, Akhilesh Deepak Gotmare, Bryan McCann, Nitish Shirish Keskar, Shafiq R. Joty, Richard Socher, Nazneen Fatema Rajani
2021EMNLPUnsupervised Paraphrasing with Pretrained Language Models.Tong Niu, Semih Yavuz, Yingbo Zhou, Nitish Shirish Keskar, Huan Wang, Caiming Xiong
2021ICLRMirostat: a Neural Text decoding Algorithm that directly controls perplexity.Sourya Basu, Govardana Sachitanandam Ramachandran, Nitish Shirish Keskar, Lav R. Varshney
2020AISTATSAssessing Local Generalization Capability in Deep Models.Huan Wang, Nitish Shirish Keskar, Caiming Xiong, Richard Socher
2020EMNLPThe Thieves on Sesame Street are Polyglots - Extracting Multilingual Models from Monolingual APIs.Nitish Shirish Keskar, Bryan McCann, Caiming Xiong, Richard Socher
2020EMNLPSimple Data Augmentation with the Mask Token Improves Domain Adaptation for Dialog Act Tagging.Semih Yavuz, Kazuma Hashimoto, Wenhao Liu, Nitish Shirish Keskar, Richard Socher, Caiming Xiong
2020ITALimits of Detecting Text Generated by Large-Scale Language Models.Lav R. Varshney, Nitish Shirish Keskar, Richard Socher
2019EMNLPNeural Text Summarization: A Critical Evaluation.Wojciech Kryscinski, Nitish Shirish Keskar, Bryan McCann, Caiming Xiong, Richard Socher
2019ICLRA Closer Look at Deep Learning Heuristics: Learning rate restarts, Warmup and Distillation.Akhilesh Gotmare, Nitish Shirish Keskar, Caiming Xiong, Richard Socher
2019ICLRCoarse-grain Fine-grain Coattention Network for Multi-evidence Question Answering.Victor Zhong, Caiming Xiong, Nitish Shirish Keskar, Richard Socher
2018ICLRRegularizing and Optimizing LSTM Language Models.Stephen Merity, Nitish Shirish Keskar, Richard Socher
2017ICLROn Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima.Nitish Shirish Keskar, Dheevatsa Mudigere, Jorge Nocedal, Mikhail Smelyanskiy, Ping Tak Peter Tang
2015ICASSPA nonmonotone learning rate strategy for SGD training of deep neural networks.Nitish Shirish Keskar, George Saon