LLMsPark: A Benchmark for Evaluating Large Language Models in Strategic Gaming Contexts.
Junhao Chen, Jingbo Sun, Xiang Li, Haidong Xin, Yuhao Xue, Yibin Xu, Hao Zhao
Browse the full EMNLP paper archive.
Junhao Chen, Jingbo Sun, Xiang Li, Haidong Xin, Yuhao Xue, Yibin Xu, Hao Zhao
Browse the full EMNLP paper archive.