Skip to content

MARS: Benchmarking the Metaphysical Reasoning Abilities of Language Models with a Multi-task Evaluation Dataset.

Weiqi Wang, Yangqiu Song

VenueA*ACL
Year2025
ProceedingsACL (1)

Browse the full ACL paper archive.