Skip to content

LR²Bench: Evaluating Long-chain Reflective Reasoning Capabilities of Large Language Models via Constraint Satisfaction Problems.

Jianghao Chen, Zhenlin Wei, Zhenjiang Ren, Ziyong Li, Jiajun Zhang

VenueA*ACL
Year2025
ProceedingsACL (Findings)

Browse the full ACL paper archive.