Skip to content

NESTFUL: A Benchmark for Evaluating LLMs on Nested Sequences of API Calls.

Kinjal Basu, Ibrahim Abdelaziz, Kiran Kate, Mayank Agarwal, Maxwell Crouse, Yara Rizk, Kelsey Bradford, Asim Munawar, Sadhana Kumaravel, Saurabh Goyal, Xin Wang, Luis A. Lastras, Pavan Kapanipathi

VenueA*EMNLP
Year2025
ProceedingsEMNLP

Browse the full EMNLP paper archive.