Skip to content

NLP Evaluation in trouble: On the Need to Measure LLM Data Contamination for each Benchmark.

Oscar Sainz, Jon Ander Campos, Iker Garca-Ferrero, Julen Etxaniz, Oier Lopez de Lacalle, Eneko Agirre

VenueA*EMNLP
Year2023
ProceedingsEMNLP (Findings)

Browse the full EMNLP paper archive.