Skip to content

HumanEval Pro and MBPP Pro: Evaluating Large Language Models on Self-invoking Code Generation Task.

Zhaojian Yu, Yilun Zhao, Arman Cohan, Xiaoping Zhang

VenueA*ACL
Year2025
ProceedingsACL (Findings)

Browse the full ACL paper archive.