Skip to content

GraphEval36K: Benchmarking Coding and Reasoning Capabilities of Large Language Models on Graph Datasets.

Qiming Wu, Zichen Chen, Will Corcoran, Misha Sra, Ambuj K. Singh

VenueANAACL
Year2025
ProceedingsNAACL (Findings)

Browse the full NAACL paper archive.