Ninareh Mehrabi
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
18
Venues
6
Active years
2021–2026
Best venue rank
A*
Where they publish
Papers
18 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | SWAN: Semantic Watermarking with Abstract Meaning Representation. | Ziping Ye, Gourab Dey, Christos Christodoulopoulos, Charith Peris, Anil Ramakrishna, Weitong Ruan, Aram Galstyan, Kai-Wei Chang, Rahul Gupta, Ninareh Mehrabi |
| 2026 | LREC | Breaking the Benchmark: Revealing LLM Bias via Minimal Contextual Augmentation. | Kaveh Eskandari Miandoab, Mahammed Kamruzzaman, Arshia Gharooni, Gene Louis Kim, Vasanth Sarathy, Ninareh Mehrabi |
| 2025 | ACL | Towards Safety Reasoning in LLMs: AI-agentic Deliberation for Policy-embedded CoT Data Creation. | Tharindu Kumarage, Ninareh Mehrabi, Anil Ramakrishna, Xinyan Zhao, Richard S. Zemel, Kai-Wei Chang, Aram Galstyan, Rahul Gupta, Charith Peris |
| 2025 | EMNLP | Diagnosing Memorization in Chain-of-Thought Reasoning, One Token at a Time. | Huihan Li, You Chen, Siyuan Wang, Yixin He, Ninareh Mehrabi, Rahul Gupta, Xiang Ren |
| 2025 | EMNLP | DiCoRe: Enhancing Zero-shot Event Detection via Divergent-Convergent LLM Reasoning. | Tanmay Parekh, Kartik Mehta, Ninareh Mehrabi, Kai-Wei Chang, Nanyun Peng |
| 2025 | NAACL | On Localizing and Deleting Toxic Memories in Large Language Models. | Anubrata Das, Manoj Kumar, Ninareh Mehrabi, Anil Ramakrishna, Anna Rumshisky, Kai-Wei Chang, Aram Galstyan, Morteza Ziyadi, Rahul Gupta |
| 2024 | ACL | Tree-of-Traversals: A Zero-Shot Reasoning Algorithm for Augmenting Black-box Language Models with Knowledge Graphs. | Elan Markowitz, Anil Ramakrishna, Jwala Dhamala, Ninareh Mehrabi, Charith Peris, Rahul Gupta, Kai-Wei Chang, Aram Galstyan |
| 2024 | EACL | Prompt Perturbation Consistency Learning for Robust Language Models. | Yao Qiang, Subhrangshu Nandi, Ninareh Mehrabi, Greg Ver Steeg, Anoop Kumar, Anna Rumshisky, Aram Galstyan |
| 2024 | EMNLP | FLIRT: Feedback Loop In-context Red Teaming. | Ninareh Mehrabi, Palash Goyal, Christophe Dupuy, Qian Hu, Shalini Ghosh, Richard S. Zemel, Kai-Wei Chang, Aram Galstyan, Rahul Gupta |
| 2024 | EMNLP | Attribute Controlled Fine-tuning for Large Language Models: A Case Study on Detoxification. | Tao Meng, Ninareh Mehrabi, Palash Goyal, Anil Ramakrishna, Aram Galstyan, Richard S. Zemel, Kai-Wei Chang, Rahul Gupta, Charith Peris |
| 2024 | EMNLP | Data Advisor: Dynamic Data Curation for Safety Alignment of Large Language Models. | Fei Wang, Ninareh Mehrabi, Palash Goyal, Rahul Gupta, Kai-Wei Chang, Aram Galstyan |
| 2024 | NAACL | The steerability of large language models toward data-driven personas. | Junyi Li, Charith Peris, Ninareh Mehrabi, Palash Goyal, Kai-Wei Chang, Aram Galstyan, Richard S. Zemel, Rahul Gupta |
| 2024 | NAACL | Tokenization Matters: Navigating Data-Scarce Tokenization for Gender Inclusive Language Technologies. | Anaelia Ovalle, Ninareh Mehrabi, Palash Goyal, Jwala Dhamala, Kai-Wei Chang, Richard S. Zemel, Aram Galstyan, Yuval Pinter, Rahul Gupta |
| 2024 | NAACL | MICo: Preventative Detoxification of Large Language Models through Inhibition Control. | Roy Siegelmann, Ninareh Mehrabi, Palash Goyal, Prasoon Goyal, Lisa Bauer, Jwala Dhamala, Aram Galstyan, Rahul Gupta, Reza Ghanadan |
| 2023 | ACL | Resolving Ambiguities in Text-to-Image Generative Models. | Ninareh Mehrabi, Palash Goyal, Apurv Verma, Jwala Dhamala, Varun Kumar, Qian Hu, Kai-Wei Chang, Richard S. Zemel, Aram Galstyan, Rahul Gupta |
| 2022 | NAACL | Robust Conversational Agents against Imperceptible Toxicity Triggers. | Ninareh Mehrabi, Ahmad Beirami, Fred Morstatter, Aram Galstyan |
| 2021 | AAAI | Exacerbating Algorithmic Bias through Fairness Attacks. | Ninareh Mehrabi, Muhammad Naveed, Fred Morstatter, Aram Galstyan |
| 2021 | EMNLP | Lawyers are Dishonest? Quantifying Representational Harms in Commonsense Knowledge Resources. | Ninareh Mehrabi, Pei Zhou, Fred Morstatter, Jay Pujara, Xiang Ren, Aram Galstyan |