Nishant Balepur
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
17
Venues
3
Active years
2023–2026
Best venue rank
A*
Where they publish
Papers
17 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Test-Time Reasoners Are Strategic Multiple-Choice Test-Takers. | Nishant Balepur, Atrey Desai, Rachel Rudinger |
| 2026 | ACL | Language Models Don't Know What You Want: Evaluating Personalization in Deep Research Needs Real Users. | Nishant Balepur, Malachi Hamada, Varsha Kishore, Sergey Feldman, Amanpreet Singh, Pao Siangliulue, Joseph Chee Chang, Eunsol Choi, Jordan Lee Boyd-Graber, Aakanksha Naik |
| 2026 | ACL | BenchMarker: An Education-Inspired Toolkit for Highlighting Flaws in Multiple-Choice Benchmarks. | Nishant Balepur, Bhavya Rajasekaran, Hyunjin Jane Oh, Michael Xie, Atrey Desai, Vipul Gupta, Steven James Moore, Eunsol Choi, Rachel Rudinger, Jordan Lee Boyd-Graber |
| 2026 | ACL | Measuring User's Mental Models of Speech Translation in Human-AI Collaboration. | Hyojung Han, Nishant Balepur, Jordan Lee Boyd-Graber, Marine Carpuat |
| 2025 | ACL | Whose Boat Does it Float? Improving Personalization in Preference Tuning via Inferred User Personas. | Nishant Balepur, Vishakh Padmakumar, Fumeng Yang, Shi Feng, Rachel Rudinger, Jordan Lee Boyd-Graber |
| 2025 | ACL | Which of These Best Describes Multiple Choice Evaluation with LLMs? A) Forced B) Flawed C) Fixable D) All of the Above. | Nishant Balepur, Rachel Rudinger, Jordan Lee Boyd-Graber |
| 2025 | EMNLP | A Good Plan is Hard to Find: Aligning Models with Preferences is Misaligned with What Helps Users. | Nishant Balepur, Matthew Shu, Yoo Yeon Sung, Seraphina Goldfarb-Tarrant, Shi Feng, Fumeng Yang, Rachel Rudinger, Jordan Lee Boyd-Graber |
| 2025 | NAACL | Reverse Question Answering: Can an LLM Write a Question so Hard (or Bad) that it Can't Answer? | Nishant Balepur, Feng Gu, Abhilasha Ravichander, Shi Feng, Jordan Lee Boyd-Graber, Rachel Rudinger |
| 2025 | NAACL | MoDS: Moderating a Mixture of Document Speakers to Summarize Debatable Queries in Document Collections. | Nishant Balepur, Alexa F. Siu, Nedim Lipka, Franck Dernoncourt, Tong Sun, Jordan Lee Boyd-Graber, Puneet Mathur |
| 2024 | ACL | It's Not Easy Being Wrong: Large Language Models Struggle with Process of Elimination Reasoning. | Nishant Balepur, Shramay Palta, Rachel Rudinger |
| 2024 | ACL | Artifacts or Abduction: How Do LLMs Answer Multiple-Choice Questions Without the Question? | Nishant Balepur, Abhilasha Ravichander, Rachel Rudinger |
| 2024 | EMNLP | A SMART Mnemonic Sounds like "Glue Tonic": Mixing LLMs with Student Feedback to Make Mnemonic Learning Stick. | Nishant Balepur, Matthew Shu, Alexander Miserlis Hoyle, Alison Robey, Shi Feng, Seraphina Goldfarb-Tarrant, Jordan L. Boyd-Graber |
| 2024 | EMNLP | Plausibly Problematic Questions in Multiple-Choice Benchmarks for Commonsense Reasoning. | Shramay Palta, Nishant Balepur, Peter Rankel, Sarah Wiegreffe, Marine Carpuat, Rachel Rudinger |
| 2024 | EMNLP | KARL: Knowledge-Aware Retrieval and Representations aid Retention and Learning in Students. | Matthew Shu, Nishant Balepur, Shi Feng, Jordan L. Boyd-Graber |
| 2023 | ACL | DynaMiTE: Discovering Explosive Topic Evolutions with User Guidance. | Nishant Balepur, Shivam Agarwal, Karthik Venkat Ramanan, Susik Yoon, Diyi Yang, Jiawei Han |
| 2023 | EMNLP | Text Fact Transfer. | Nishant Balepur, Jie Huang, Kevin Chen-Chuan Chang |
| 2023 | EMNLP | Expository Text Generation: Imitate, Retrieve, Paraphrase. | Nishant Balepur, Jie Huang, Kevin Chen-Chuan Chang |