| 2026 | AAAI | Error Correction in Radiology Reports: A Knowledge Distillation-Based Multi-Stage Framework. | Jinge Wu, Zhaolong Wu, Ruizhe Li, Tong Chen, Abul Hasan, Yunsoo Kim, Jason Pui Yin Cheung, Teng Zhang, Honghan Wu |
| 2025 | ACL | BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain. | Yunsoo Kim, Yusuf Abdulle, Honghan Wu |
| 2025 | ACL | Look & Mark: Leveraging Radiologist Eye Fixations and Bounding boxes in Multimodal Large Language Models for Chest X-ray Report Generation. | Yunsoo Kim, Jinge Wu, Su Hwan Kim, Pardeep Vasudev, Jiashu Shen, Honghan Wu |
| 2025 | EMNLP | HARE: an entity and relation centric evaluation framework for histopathology reports. | Yunsoo Kim, Michal W. S. Ong, Alex Shavick, Honghan Wu, Adam P. Levine |
| 2024 | ACL | Foundation Model for Biomedical Graphs: Integrating Knowledge Graphs and Protein Structures to Large Language Models. | Yunsoo Kim |
| 2024 | ICLR | Hallucination Benchmark in Medical Visual Question Answering. | Jinge Wu, Yunsoo Kim, Honghan Wu |
| 2024 | MICCAI | Enhancing Human-Computer Interaction in Chest X-Ray Analysis Using Vision and Language Model with Eye Gaze Patterns. | Yunsoo Kim, Jinge Wu, Yusuf Abdulle, Yue Gao, Honghan Wu |
| 2023 | ACL | Chemical Language Understanding Benchmark. | Yunsoo Kim, Hyuk Ko, Jane Lee, Hyun Young Heo, Jinyoung Yang, Sungsoo Lee, Kyu-Hwang Lee |