| 2025 | ACL | Nudging: Inference-time Alignment of LLMs via Guided Decoding. | Yu Fei, Yasaman Razeghi, Sameer Singh |
| 2025 | NAACL | TurtleBench: A Visual Programming Benchmark in Turtle Geometry. | Sina Rismanchian, Yasaman Razeghi, Sameer Singh, Shayan Doroudi |
| 2024 | EMNLP | Plot Twist: Multimodal Models Don't Comprehend Simple Chart Details. | Yasaman Razeghi, Ishita Dasgupta, Fangyu Liu, Vinay Ramasesh, Sameer Singh |
| 2024 | ICLR | Are Models Biased on Text without Gender-related Language? | Catarina G. Belm, Preethi Seshadri, Yasaman Razeghi, Sameer Singh |
| 2024 | ICLR | Backtracking Mathematical Reasoning of Language Models to the Pretraining Data. | Yasaman Razeghi, Hamish Ivison, Sameer Singh, Yanai Elazar |
| 2024 | NAACL | EchoPrompt: Instructing the Model to Rephrase Queries for Improved In-context Learning. | Raja Sekhar Reddy Mekala, Yasaman Razeghi, Sameer Singh |
| 2024 | NAACL | Selective Perception: Learning Concise State Descriptions for Language Model Actors. | Kolby Nottingham, Yasaman Razeghi, Kyungmin Kim, JB Lanier, Pierre Baldi, Roy Fox, Sameer Singh |
| 2022 | EMNLP | Impact of Pretraining Term Frequencies on Few-Shot Numerical Reasoning. | Yasaman Razeghi, Robert L. Logan IV, Matt Gardner, Sameer Singh |
| 2022 | EMNLP | Snoopy: An Online Interface for Exploring the Effect of Pretraining Term Frequencies on Few-Shot LM Performance. | Yasaman Razeghi, Raja Sekhar Reddy Mekala, Robert L. Logan IV, Matt Gardner, Sameer Singh |
| 2021 | IJCAI | Deep Bucket Elimination. | Yasaman Razeghi, Kalev Kask, Yadong Lu, Pierre Baldi, Sakshi Agarwal, Rina Dechter |
| 2020 | EMNLP | AutoPrompt: Eliciting Knowledge from Language Models with Automatically Generated Prompts. | Taylor Shin, Yasaman Razeghi, Robert L. Logan IV, Eric Wallace, Sameer Singh |