Skip to content

OR-Bench: An Over-Refusal Benchmark for Large Language Models.

Justin Cui, Wei-Lin Chiang, Ion Stoica, Cho-Jui Hsieh

VenueA*ICML
Year2025
ProceedingsICML

Browse the full ICML paper archive.