Skip to content

Seraphina Goldfarb-Tarrant

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

15

Venues

5

Active years

2019–2026

Best venue rank

A*

Where they publish

Papers

15 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLLost in Simulation: LLM-Simulated Users are Unreliable Proxies for Human Users in Agentic Evaluations.Preethi Seshadri, Samuel Cahyawijaya, Ayomide Odumakinde, Sameer Singh, Seraphina Goldfarb-Tarrant
2026EACLMAPS: A Multilingual Benchmark for Agent Performance and Security.Omer Hofman, Jonathan Brokman, Oren Rachmil, Shamik Bose, Vikas Pahuja, Toshiya Shimizu, Trisha Starostina, Kelly Marchisio, Seraphina Goldfarb-Tarrant, Roman Vainshtein
2025ACLSafer or Luckier? LLMs as Safety Evaluators Are Not Robust to Artifacts.Hongyu Chen, Seraphina Goldfarb-Tarrant
2025EMNLPA Good Plan is Hard to Find: Aligning Models with Preferences is Misaligned with What Helps Users.Nishant Balepur, Matthew Shu, Yoo Yeon Sung, Seraphina Goldfarb-Tarrant, Shi Feng, Fumeng Yang, Rachel Rudinger, Jordan Lee Boyd-Graber
2025IJCNLPSmall Changes, Large Consequences: Analyzing the Allocational Fairness of LLMs in Hiring Contexts.Preethi Seshadri, Hongyu Chen, Sameer Singh, Seraphina Goldfarb-Tarrant
2024EMNLPThe Multilingual Alignment Prism: Aligning Global and Local Preferences to Reduce Harm.Aakanksha, Arash Ahmadian, Beyza Ermis, Seraphina Goldfarb-Tarrant, Julia Kreutzer, Marzieh Fadaee, Sara Hooker
2024EMNLPA SMART Mnemonic Sounds like "Glue Tonic": Mixing LLMs with Student Feedback to Make Mnemonic Learning Stick.Nishant Balepur, Matthew Shu, Alexander Miserlis Hoyle, Alison Robey, Shi Feng, Seraphina Goldfarb-Tarrant, Jordan L. Boyd-Graber
2023ACLThis prompt is measuring \textlessmask\textgreater: evaluating bias evaluation in language models.Seraphina Goldfarb-Tarrant, Eddie Ungless, Esma Balkir, Su Lin Blodgett
2023ACLBias Beyond English: Counterfactual Tests for Bias in Sentiment Analysis in Four Languages.Seraphina Goldfarb-Tarrant, Adam Lopez, Roi Blanco, Diego Marcheggiani
2023EMNLPCross-lingual Transfer Can Worsen Bias in Sentiment Analysis.Seraphina Goldfarb-Tarrant, Bjrn Ross, Adam Lopez
2022NAACLHow Gender Debiasing Affects Internal Model Representations, and Why It Matters.Hadas Orgad, Seraphina Goldfarb-Tarrant, Yonatan Belinkov
2021ACLIntrinsic Bias Metrics Do Not Correlate with Application Bias.Seraphina Goldfarb-Tarrant, Rebecca Marchant, Ricardo Muoz Snchez, Mugdha Pandya, Adam Lopez
2020EMNLPContent Planning for Neural Story Generation with Aristotelian Rescoring.Seraphina Goldfarb-Tarrant, Tuhin Chakrabarty, Ralph M. Weischedel, Nanyun Peng
2020EMNLPScaling Systematic Literature Reviews with Machine Learning Pipelines.Seraphina Goldfarb-Tarrant, Alexander Robertson, Jasmina Lazic, Theodora Tsouloufi, Louise Donnison, Karen Smyth
2019NAACLPlan, Write, and Revise: an Interactive System for Open-Domain Story Generation.Seraphina Goldfarb-Tarrant, Haining Feng, Nanyun Peng