Ragability Benchmark: A Dataset and Library to Test LLMs on Inter-context Conflicts.
Stephanie Gross, Johann Petrak, Brigitte Krenn
Browse the full LREC paper archive.
Stephanie Gross, Johann Petrak, Brigitte Krenn
Browse the full LREC paper archive.