Skip to content

Evaluating Multi-Hop Reasoning in Large Language Models: A Chemistry-Centric Benchmark.

Mohammad Khodadad, Ali Shiraee Kasmaee, Mahdi Astaraki, Nicholas Sherck, Hamidreza Mahyar, Soheila Samiee

VenueAEACL
Year2026
ProceedingsEACL (Findings)

Browse the full EACL paper archive.