Skip to content

A Rolling Stone Gathers No Moss: Adaptive Policy Optimization for Stable Self-Evaluation in Large Multimodal Models.

Wenkai Wang, Hongcan Guo, Zheqi Lv, Shengyu Zhang

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.