KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations.
Junyu Liu, Lawrence KQ Yan, Tianyang Wang, Qian Niu, Momoko Nagai-Tanima, Tomoki Aoyama
VenueAMICCAI
Year2025
ProceedingsAgentic AI/CREATE/Clinical MLLMs@MICCAI
DBLP recordconf/miccai/LiuYWNNA25 ↗
Browse the full MICCAI paper archive.