A Rolling Stone Gathers No Moss: Adaptive Policy Optimization for Stable Self-Evaluation in Large Multimodal Models.
Wenkai Wang, Hongcan Guo, Zheqi Lv, Shengyu Zhang
Browse the full AAAI paper archive.
Wenkai Wang, Hongcan Guo, Zheqi Lv, Shengyu Zhang
Browse the full AAAI paper archive.