DialogBench: Evaluating LLMs as Human-like Dialogue Systems.
Jiao Ou, Junda Lu, Che Liu, Yihong Tang, Fuzheng Zhang, Di Zhang, Kun Gai
Browse the full NAACL paper archive.
Jiao Ou, Junda Lu, Che Liu, Yihong Tang, Fuzheng Zhang, Di Zhang, Kun Gai
Browse the full NAACL paper archive.