Glance-or-Gaze: Incentivizing LMMs to Adaptively Focus Search via Reinforcement Learning.
Hongbo Bai, Yujin Zhou, Yile Wu, Chi-Min Chan, Pengcheng Wen, Kunhao Pan, Sirui Han, Yike Guo
Browse the full ACL paper archive.
Hongbo Bai, Yujin Zhou, Yile Wu, Chi-Min Chan, Pengcheng Wen, Kunhao Pan, Sirui Han, Yike Guo
Browse the full ACL paper archive.