Skip to content

LLMEval: A Preliminary Study on How to Evaluate Large Language Models.

Yue Zhang, Ming Zhang, Haipeng Yuan, Shichun Liu, Yongyao Shi, Tao Gui, Qi Zhang, Xuanjing Huang

VenueA*AAAI
Year2024
ProceedingsAAAI

Browse the full AAAI paper archive.