Skip to content

EquiBench: Benchmarking Large Language Models' Reasoning about Program Semantics via Equivalence Checking.

Anjiang Wei, Jiannan Cao, Ran Li, Hongyu Chen, Yuhui Zhang, Ziheng Wang, Yuan Liu, Thiago S. F. X. Teixeira, Diyi Yang, Ke Wang, Alex Aiken

VenueA*EMNLP
Year2025
ProceedingsEMNLP

Browse the full EMNLP paper archive.