Skip to content

Yifan Mai

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

8

Venues

6

Active years

2024–2026

Best venue rank

A*

Where they publish

Papers

8 indexed papers, newest first.

YearVenueTitleAuthors
2026EACLOCR or Not? Rethinking Document Information Extraction in the MLLMs Era with Real-World Large-Scale Datasets.Jiyuan Shen, Yuan Peiyue, Atin Ghosh, Yifan Mai, Daniel Dahlmeier
2025ACLOptimization before Evaluation: Evaluation with Unoptimized Prompts Can be Misleading.Nicholas Sadjoli, Tim Siefken, Atin Ghosh, Yifan Mai, Daniel Dahlmeier
2025ACLSEA-HELM: Southeast Asian Holistic Evaluation of Language Models.Yosephine Susanto, Adithya Venkatadri Hulagadri, Jann Railey Montalan, Jian Gang Ngui, Xianbin Yong, Wei Qi Leong, Hamsawardhini Rengarajan, Peerat Limkonchotiwat, Yifan Mai, William-Chandra Tjhi
2025ICLRAIR-BENCH 2024: A Safety Benchmark based on Regulation and Policies Specified Risk Categories.Yi Zeng, Yu Yang, Andy Zhou, Jeffrey Ziwei Tan, Yuheng Tu, Yifan Mai, Kevin Klyman, Minzhou Pan, Ruoxi Jia, Dawn Song, Percy Liang, Bo Li
2025ICLRAutoBencher: Towards Declarative Benchmark Construction.Xiang Lisa Li, Farzaan Kaiyom, Evan Zheran Liu, Yifan Mai, Percy Liang, Tatsunori Hashimoto
2025ICMLPosition: Language model developers should report train-test overlap.Andy K. Zhang, Kevin Klyman, Yifan Mai, Yoav Levine, Yian Zhang, Rishi Bommasani, Percy Liang
2025NAACLEvaluating Large Language Models with Enterprise Benchmarks.Bing Zhang, Mikio Takeuchi, Ryo Kawahara, Shubhi Asthana, Md. Maruf Hossain, Guang-Jie Ren, Kate Soule, Yifan Mai, Yada Zhu
2024ICERUsing Benchmarking Infrastructure to Evaluate LLM Performance on CS Concept Inventories: Challenges, Opportunities, and Critiques.Murtaza Ali, Prerna Rao, Yifan Mai, Benjamin Xie