Seraphina Goldfarb-Tarrant
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
15
Venues
5
Active years
2019–2026
Best venue rank
A*
Where they publish
Papers
15 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Lost in Simulation: LLM-Simulated Users are Unreliable Proxies for Human Users in Agentic Evaluations. | Preethi Seshadri, Samuel Cahyawijaya, Ayomide Odumakinde, Sameer Singh, Seraphina Goldfarb-Tarrant |
| 2026 | EACL | MAPS: A Multilingual Benchmark for Agent Performance and Security. | Omer Hofman, Jonathan Brokman, Oren Rachmil, Shamik Bose, Vikas Pahuja, Toshiya Shimizu, Trisha Starostina, Kelly Marchisio, Seraphina Goldfarb-Tarrant, Roman Vainshtein |
| 2025 | ACL | Safer or Luckier? LLMs as Safety Evaluators Are Not Robust to Artifacts. | Hongyu Chen, Seraphina Goldfarb-Tarrant |
| 2025 | EMNLP | A Good Plan is Hard to Find: Aligning Models with Preferences is Misaligned with What Helps Users. | Nishant Balepur, Matthew Shu, Yoo Yeon Sung, Seraphina Goldfarb-Tarrant, Shi Feng, Fumeng Yang, Rachel Rudinger, Jordan Lee Boyd-Graber |
| 2025 | IJCNLP | Small Changes, Large Consequences: Analyzing the Allocational Fairness of LLMs in Hiring Contexts. | Preethi Seshadri, Hongyu Chen, Sameer Singh, Seraphina Goldfarb-Tarrant |
| 2024 | EMNLP | The Multilingual Alignment Prism: Aligning Global and Local Preferences to Reduce Harm. | Aakanksha, Arash Ahmadian, Beyza Ermis, Seraphina Goldfarb-Tarrant, Julia Kreutzer, Marzieh Fadaee, Sara Hooker |
| 2024 | EMNLP | A SMART Mnemonic Sounds like "Glue Tonic": Mixing LLMs with Student Feedback to Make Mnemonic Learning Stick. | Nishant Balepur, Matthew Shu, Alexander Miserlis Hoyle, Alison Robey, Shi Feng, Seraphina Goldfarb-Tarrant, Jordan L. Boyd-Graber |
| 2023 | ACL | This prompt is measuring \textlessmask\textgreater: evaluating bias evaluation in language models. | Seraphina Goldfarb-Tarrant, Eddie Ungless, Esma Balkir, Su Lin Blodgett |
| 2023 | ACL | Bias Beyond English: Counterfactual Tests for Bias in Sentiment Analysis in Four Languages. | Seraphina Goldfarb-Tarrant, Adam Lopez, Roi Blanco, Diego Marcheggiani |
| 2023 | EMNLP | Cross-lingual Transfer Can Worsen Bias in Sentiment Analysis. | Seraphina Goldfarb-Tarrant, Bjrn Ross, Adam Lopez |
| 2022 | NAACL | How Gender Debiasing Affects Internal Model Representations, and Why It Matters. | Hadas Orgad, Seraphina Goldfarb-Tarrant, Yonatan Belinkov |
| 2021 | ACL | Intrinsic Bias Metrics Do Not Correlate with Application Bias. | Seraphina Goldfarb-Tarrant, Rebecca Marchant, Ricardo Muoz Snchez, Mugdha Pandya, Adam Lopez |
| 2020 | EMNLP | Content Planning for Neural Story Generation with Aristotelian Rescoring. | Seraphina Goldfarb-Tarrant, Tuhin Chakrabarty, Ralph M. Weischedel, Nanyun Peng |
| 2020 | EMNLP | Scaling Systematic Literature Reviews with Machine Learning Pipelines. | Seraphina Goldfarb-Tarrant, Alexander Robertson, Jasmina Lazic, Theodora Tsouloufi, Louise Donnison, Karen Smyth |
| 2019 | NAACL | Plan, Write, and Revise: an Interactive System for Open-Domain Story Generation. | Seraphina Goldfarb-Tarrant, Haining Feng, Nanyun Peng |