Skip to content

Benchmarking Failures in Tool-Augmented Language Models.

Eduardo Trevio, Hugo Contant, James Ngai, Graham Neubig, Zora Zhiruo Wang

VenueANAACL
Year2025
ProceedingsNAACL (Long Papers)

Browse the full NAACL paper archive.