Modularized Self-Reflected Video Reasoner for Multimodal LLM with Application to Video Question Answering.
Zihan Song, Xin Wang, Zi Qian, Hong Chen, Longtao Huang, Hui Xue, Wenwu Zhu
Browse the full ICML paper archive.
Zihan Song, Xin Wang, Zi Qian, Hong Chen, Longtao Huang, Hui Xue, Wenwu Zhu
Browse the full ICML paper archive.