Skip to content

Nishant Balepur

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

17

Venues

3

Active years

2023–2026

Best venue rank

A*

Where they publish

Papers

17 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLTest-Time Reasoners Are Strategic Multiple-Choice Test-Takers.Nishant Balepur, Atrey Desai, Rachel Rudinger
2026ACLLanguage Models Don't Know What You Want: Evaluating Personalization in Deep Research Needs Real Users.Nishant Balepur, Malachi Hamada, Varsha Kishore, Sergey Feldman, Amanpreet Singh, Pao Siangliulue, Joseph Chee Chang, Eunsol Choi, Jordan Lee Boyd-Graber, Aakanksha Naik
2026ACLBenchMarker: An Education-Inspired Toolkit for Highlighting Flaws in Multiple-Choice Benchmarks.Nishant Balepur, Bhavya Rajasekaran, Hyunjin Jane Oh, Michael Xie, Atrey Desai, Vipul Gupta, Steven James Moore, Eunsol Choi, Rachel Rudinger, Jordan Lee Boyd-Graber
2026ACLMeasuring User's Mental Models of Speech Translation in Human-AI Collaboration.Hyojung Han, Nishant Balepur, Jordan Lee Boyd-Graber, Marine Carpuat
2025ACLWhose Boat Does it Float? Improving Personalization in Preference Tuning via Inferred User Personas.Nishant Balepur, Vishakh Padmakumar, Fumeng Yang, Shi Feng, Rachel Rudinger, Jordan Lee Boyd-Graber
2025ACLWhich of These Best Describes Multiple Choice Evaluation with LLMs? A) Forced B) Flawed C) Fixable D) All of the Above.Nishant Balepur, Rachel Rudinger, Jordan Lee Boyd-Graber
2025EMNLPA Good Plan is Hard to Find: Aligning Models with Preferences is Misaligned with What Helps Users.Nishant Balepur, Matthew Shu, Yoo Yeon Sung, Seraphina Goldfarb-Tarrant, Shi Feng, Fumeng Yang, Rachel Rudinger, Jordan Lee Boyd-Graber
2025NAACLReverse Question Answering: Can an LLM Write a Question so Hard (or Bad) that it Can't Answer?Nishant Balepur, Feng Gu, Abhilasha Ravichander, Shi Feng, Jordan Lee Boyd-Graber, Rachel Rudinger
2025NAACLMoDS: Moderating a Mixture of Document Speakers to Summarize Debatable Queries in Document Collections.Nishant Balepur, Alexa F. Siu, Nedim Lipka, Franck Dernoncourt, Tong Sun, Jordan Lee Boyd-Graber, Puneet Mathur
2024ACLIt's Not Easy Being Wrong: Large Language Models Struggle with Process of Elimination Reasoning.Nishant Balepur, Shramay Palta, Rachel Rudinger
2024ACLArtifacts or Abduction: How Do LLMs Answer Multiple-Choice Questions Without the Question?Nishant Balepur, Abhilasha Ravichander, Rachel Rudinger
2024EMNLPA SMART Mnemonic Sounds like "Glue Tonic": Mixing LLMs with Student Feedback to Make Mnemonic Learning Stick.Nishant Balepur, Matthew Shu, Alexander Miserlis Hoyle, Alison Robey, Shi Feng, Seraphina Goldfarb-Tarrant, Jordan L. Boyd-Graber
2024EMNLPPlausibly Problematic Questions in Multiple-Choice Benchmarks for Commonsense Reasoning.Shramay Palta, Nishant Balepur, Peter Rankel, Sarah Wiegreffe, Marine Carpuat, Rachel Rudinger
2024EMNLPKARL: Knowledge-Aware Retrieval and Representations aid Retention and Learning in Students.Matthew Shu, Nishant Balepur, Shi Feng, Jordan L. Boyd-Graber
2023ACLDynaMiTE: Discovering Explosive Topic Evolutions with User Guidance.Nishant Balepur, Shivam Agarwal, Karthik Venkat Ramanan, Susik Yoon, Diyi Yang, Jiawei Han
2023EMNLPText Fact Transfer.Nishant Balepur, Jie Huang, Kevin Chen-Chuan Chang
2023EMNLPExpository Text Generation: Imitate, Retrieve, Paraphrase.Nishant Balepur, Jie Huang, Kevin Chen-Chuan Chang