Structured Policy Optimization: Enhance Large Vision-Language Model via Self-Referenced Dialogue.
Guohao Sun, Can Qin, Yihao Feng, Zeyuan Chen, Ran Xu, Sohail A. Dianat, Majid Rabbani, Raghuveer Rao, Zhiqiang Tao
Browse the full ICCV paper archive.
Guohao Sun, Can Qin, Yihao Feng, Zeyuan Chen, Ran Xu, Sohail A. Dianat, Majid Rabbani, Raghuveer Rao, Zhiqiang Tao
Browse the full ICCV paper archive.