Skip to content

MT-Eval: A Multi-Turn Capabilities Evaluation Benchmark for Large Language Models.

Wai-Chung Kwan, Xingshan Zeng, Yuxin Jiang, Yufei Wang, Liangyou Li, Lifeng Shang, Xin Jiang, Qun Liu, Kam-Fai Wong

VenueA*EMNLP
Year2024
ProceedingsEMNLP

Browse the full EMNLP paper archive.