Skip to content

ViCToR: Improving Visual Comprehension via Token Reconstruction for Pretraining LMMs.

Yin Xie, Kaicheng Yang, Peirou Liang, Xiang An, Yongle Zhao, Yumeng Wang, Ziyong Feng, Roy Miles, Ismail Elezi, Jiankang Deng

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.