Skip to content

Ninareh Mehrabi

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

18

Venues

6

Active years

2021–2026

Best venue rank

A*

Where they publish

Papers

18 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLSWAN: Semantic Watermarking with Abstract Meaning Representation.Ziping Ye, Gourab Dey, Christos Christodoulopoulos, Charith Peris, Anil Ramakrishna, Weitong Ruan, Aram Galstyan, Kai-Wei Chang, Rahul Gupta, Ninareh Mehrabi
2026LRECBreaking the Benchmark: Revealing LLM Bias via Minimal Contextual Augmentation.Kaveh Eskandari Miandoab, Mahammed Kamruzzaman, Arshia Gharooni, Gene Louis Kim, Vasanth Sarathy, Ninareh Mehrabi
2025ACLTowards Safety Reasoning in LLMs: AI-agentic Deliberation for Policy-embedded CoT Data Creation.Tharindu Kumarage, Ninareh Mehrabi, Anil Ramakrishna, Xinyan Zhao, Richard S. Zemel, Kai-Wei Chang, Aram Galstyan, Rahul Gupta, Charith Peris
2025EMNLPDiagnosing Memorization in Chain-of-Thought Reasoning, One Token at a Time.Huihan Li, You Chen, Siyuan Wang, Yixin He, Ninareh Mehrabi, Rahul Gupta, Xiang Ren
2025EMNLPDiCoRe: Enhancing Zero-shot Event Detection via Divergent-Convergent LLM Reasoning.Tanmay Parekh, Kartik Mehta, Ninareh Mehrabi, Kai-Wei Chang, Nanyun Peng
2025NAACLOn Localizing and Deleting Toxic Memories in Large Language Models.Anubrata Das, Manoj Kumar, Ninareh Mehrabi, Anil Ramakrishna, Anna Rumshisky, Kai-Wei Chang, Aram Galstyan, Morteza Ziyadi, Rahul Gupta
2024ACLTree-of-Traversals: A Zero-Shot Reasoning Algorithm for Augmenting Black-box Language Models with Knowledge Graphs.Elan Markowitz, Anil Ramakrishna, Jwala Dhamala, Ninareh Mehrabi, Charith Peris, Rahul Gupta, Kai-Wei Chang, Aram Galstyan
2024EACLPrompt Perturbation Consistency Learning for Robust Language Models.Yao Qiang, Subhrangshu Nandi, Ninareh Mehrabi, Greg Ver Steeg, Anoop Kumar, Anna Rumshisky, Aram Galstyan
2024EMNLPFLIRT: Feedback Loop In-context Red Teaming.Ninareh Mehrabi, Palash Goyal, Christophe Dupuy, Qian Hu, Shalini Ghosh, Richard S. Zemel, Kai-Wei Chang, Aram Galstyan, Rahul Gupta
2024EMNLPAttribute Controlled Fine-tuning for Large Language Models: A Case Study on Detoxification.Tao Meng, Ninareh Mehrabi, Palash Goyal, Anil Ramakrishna, Aram Galstyan, Richard S. Zemel, Kai-Wei Chang, Rahul Gupta, Charith Peris
2024EMNLPData Advisor: Dynamic Data Curation for Safety Alignment of Large Language Models.Fei Wang, Ninareh Mehrabi, Palash Goyal, Rahul Gupta, Kai-Wei Chang, Aram Galstyan
2024NAACLThe steerability of large language models toward data-driven personas.Junyi Li, Charith Peris, Ninareh Mehrabi, Palash Goyal, Kai-Wei Chang, Aram Galstyan, Richard S. Zemel, Rahul Gupta
2024NAACLTokenization Matters: Navigating Data-Scarce Tokenization for Gender Inclusive Language Technologies.Anaelia Ovalle, Ninareh Mehrabi, Palash Goyal, Jwala Dhamala, Kai-Wei Chang, Richard S. Zemel, Aram Galstyan, Yuval Pinter, Rahul Gupta
2024NAACLMICo: Preventative Detoxification of Large Language Models through Inhibition Control.Roy Siegelmann, Ninareh Mehrabi, Palash Goyal, Prasoon Goyal, Lisa Bauer, Jwala Dhamala, Aram Galstyan, Rahul Gupta, Reza Ghanadan
2023ACLResolving Ambiguities in Text-to-Image Generative Models.Ninareh Mehrabi, Palash Goyal, Apurv Verma, Jwala Dhamala, Varun Kumar, Qian Hu, Kai-Wei Chang, Richard S. Zemel, Aram Galstyan, Rahul Gupta
2022NAACLRobust Conversational Agents against Imperceptible Toxicity Triggers.Ninareh Mehrabi, Ahmad Beirami, Fred Morstatter, Aram Galstyan
2021AAAIExacerbating Algorithmic Bias through Fairness Attacks.Ninareh Mehrabi, Muhammad Naveed, Fred Morstatter, Aram Galstyan
2021EMNLPLawyers are Dishonest? Quantifying Representational Harms in Commonsense Knowledge Resources.Ninareh Mehrabi, Pei Zhou, Fred Morstatter, Jay Pujara, Xiang Ren, Aram Galstyan