WTU-EVAL: A Whether-or-Not Tool Usage Evaluation Benchmark for Large Language Models.
Jian Liu, Kangyun Ning, Yisong Su, Wenjuan Han, Jinan Xu, Yuanzhe Zhang
Browse the full ICASSP paper archive.
Jian Liu, Kangyun Ning, Yisong Su, Wenjuan Han, Jinan Xu, Yuanzhe Zhang
Browse the full ICASSP paper archive.