Skip to content

StableToolBench: Towards Stable Large-Scale Benchmarking on Tool Learning of Large Language Models.

Zhicheng Guo, Sijie Cheng, Hao Wang, Shihao Liang, Yujia Qin, Peng Li, Zhiyuan Liu, Maosong Sun, Yang Liu

VenueA*ACL
Year2024
ProceedingsACL (Findings)

Browse the full ACL paper archive.