HumanEval Pro and MBPP Pro: Evaluating Large Language Models on Self-invoking Code Generation Task.
Zhaojian Yu, Yilun Zhao, Arman Cohan, Xiaoping Zhang
Browse the full ACL paper archive.
Zhaojian Yu, Yilun Zhao, Arman Cohan, Xiaoping Zhang
Browse the full ACL paper archive.