Yifan Mai
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
8
Venues
6
Active years
2024–2026
Best venue rank
A*
Where they publish
Papers
8 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | EACL | OCR or Not? Rethinking Document Information Extraction in the MLLMs Era with Real-World Large-Scale Datasets. | Jiyuan Shen, Yuan Peiyue, Atin Ghosh, Yifan Mai, Daniel Dahlmeier |
| 2025 | ACL | Optimization before Evaluation: Evaluation with Unoptimized Prompts Can be Misleading. | Nicholas Sadjoli, Tim Siefken, Atin Ghosh, Yifan Mai, Daniel Dahlmeier |
| 2025 | ACL | SEA-HELM: Southeast Asian Holistic Evaluation of Language Models. | Yosephine Susanto, Adithya Venkatadri Hulagadri, Jann Railey Montalan, Jian Gang Ngui, Xianbin Yong, Wei Qi Leong, Hamsawardhini Rengarajan, Peerat Limkonchotiwat, Yifan Mai, William-Chandra Tjhi |
| 2025 | ICLR | AIR-BENCH 2024: A Safety Benchmark based on Regulation and Policies Specified Risk Categories. | Yi Zeng, Yu Yang, Andy Zhou, Jeffrey Ziwei Tan, Yuheng Tu, Yifan Mai, Kevin Klyman, Minzhou Pan, Ruoxi Jia, Dawn Song, Percy Liang, Bo Li |
| 2025 | ICLR | AutoBencher: Towards Declarative Benchmark Construction. | Xiang Lisa Li, Farzaan Kaiyom, Evan Zheran Liu, Yifan Mai, Percy Liang, Tatsunori Hashimoto |
| 2025 | ICML | Position: Language model developers should report train-test overlap. | Andy K. Zhang, Kevin Klyman, Yifan Mai, Yoav Levine, Yian Zhang, Rishi Bommasani, Percy Liang |
| 2025 | NAACL | Evaluating Large Language Models with Enterprise Benchmarks. | Bing Zhang, Mikio Takeuchi, Ryo Kawahara, Shubhi Asthana, Md. Maruf Hossain, Guang-Jie Ren, Kate Soule, Yifan Mai, Yada Zhu |
| 2024 | ICER | Using Benchmarking Infrastructure to Evaluate LLM Performance on CS Concept Inventories: Challenges, Opportunities, and Critiques. | Murtaza Ali, Prerna Rao, Yifan Mai, Benjamin Xie |