MetaTool Benchmark for Large Language Models: Deciding Whether to Use Tools and Which to Use.
Yue Huang, Jiawen Shi, Yuan Li, Chenrui Fan, Siyuan Wu, Qihui Zhang, Yixin Liu, Pan Zhou, Yao Wan, Neil Zhenqiang Gong, Lichao Sun
Browse the full ICLR paper archive.