Nitish Shirish Keskar
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
15
Venues
6
Active years
2015–2022
Best venue rank
A*
Where they publish
Papers
15 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2022 | ACL | Modeling Multi-hop Question Answering as Single Sequence Prediction. | Semih Yavuz, Kazuma Hashimoto, Yingbo Zhou, Nitish Shirish Keskar, Caiming Xiong |
| 2021 | EMNLP | Char2Subword: Extending the Subword Embedding Space Using Robust Character Compositionality. | Gustavo Aguilar, Bryan McCann, Tong Niu, Nazneen Rajani, Nitish Shirish Keskar, Thamar Solorio |
| 2021 | EMNLP | GeDi: Generative Discriminator Guided Sequence Generation. | Ben Krause, Akhilesh Deepak Gotmare, Bryan McCann, Nitish Shirish Keskar, Shafiq R. Joty, Richard Socher, Nazneen Fatema Rajani |
| 2021 | EMNLP | Unsupervised Paraphrasing with Pretrained Language Models. | Tong Niu, Semih Yavuz, Yingbo Zhou, Nitish Shirish Keskar, Huan Wang, Caiming Xiong |
| 2021 | ICLR | Mirostat: a Neural Text decoding Algorithm that directly controls perplexity. | Sourya Basu, Govardana Sachitanandam Ramachandran, Nitish Shirish Keskar, Lav R. Varshney |
| 2020 | AISTATS | Assessing Local Generalization Capability in Deep Models. | Huan Wang, Nitish Shirish Keskar, Caiming Xiong, Richard Socher |
| 2020 | EMNLP | The Thieves on Sesame Street are Polyglots - Extracting Multilingual Models from Monolingual APIs. | Nitish Shirish Keskar, Bryan McCann, Caiming Xiong, Richard Socher |
| 2020 | EMNLP | Simple Data Augmentation with the Mask Token Improves Domain Adaptation for Dialog Act Tagging. | Semih Yavuz, Kazuma Hashimoto, Wenhao Liu, Nitish Shirish Keskar, Richard Socher, Caiming Xiong |
| 2020 | ITA | Limits of Detecting Text Generated by Large-Scale Language Models. | Lav R. Varshney, Nitish Shirish Keskar, Richard Socher |
| 2019 | EMNLP | Neural Text Summarization: A Critical Evaluation. | Wojciech Kryscinski, Nitish Shirish Keskar, Bryan McCann, Caiming Xiong, Richard Socher |
| 2019 | ICLR | A Closer Look at Deep Learning Heuristics: Learning rate restarts, Warmup and Distillation. | Akhilesh Gotmare, Nitish Shirish Keskar, Caiming Xiong, Richard Socher |
| 2019 | ICLR | Coarse-grain Fine-grain Coattention Network for Multi-evidence Question Answering. | Victor Zhong, Caiming Xiong, Nitish Shirish Keskar, Richard Socher |
| 2018 | ICLR | Regularizing and Optimizing LSTM Language Models. | Stephen Merity, Nitish Shirish Keskar, Richard Socher |
| 2017 | ICLR | On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima. | Nitish Shirish Keskar, Dheevatsa Mudigere, Jorge Nocedal, Mikhail Smelyanskiy, Ping Tak Peter Tang |
| 2015 | ICASSP | A nonmonotone learning rate strategy for SGD training of deep neural networks. | Nitish Shirish Keskar, George Saon |