Seeing the Whole Elephant: A Benchmark for Failure Attribution in LLM-based Multi-Agent Systems.
Mengzhuo Chen, Junjie Wang, Fangwen Mu, Yawen Wang, Zhe Liu, Huanxiang Feng, Qing Wang
Browse the full ACL paper archive.
Mengzhuo Chen, Junjie Wang, Fangwen Mu, Yawen Wang, Zhe Liu, Huanxiang Feng, Qing Wang
Browse the full ACL paper archive.