Skip to content

GRPO-CARE: Consistency-Aware Reinforcement Learning for Multimodal Reasoning.

Yi Chen, Yuying Ge, Rui Wang, Yixiao Ge, Junhao Cheng, Ying Shan, Xihui Liu

VenueA*ACL
Year2026
ProceedingsACL (Findings)

Browse the full ACL paper archive.