Skip to content

NPHardEval: Dynamic Benchmark on Reasoning Ability of Large Language Models via Complexity Classes.

Lizhou Fan, Wenyue Hua, Lingyao Li, Haoyang Ling, Yongfeng Zhang

VenueA*ACL
Year2024
ProceedingsACL (1)

Browse the full ACL paper archive.