Recoverable Compression: A Multimodal Vision Token Recovery Mechanism Guided by Text Information.
Yi Chen, Jian Xu, Xu-Yao Zhang, Wen-Zhuo Liu, Yang-Yang Liu, Cheng-Lin Liu
Browse the full AAAI paper archive.
Yi Chen, Jian Xu, Xu-Yao Zhang, Wen-Zhuo Liu, Yang-Yang Liu, Cheng-Lin Liu
Browse the full AAAI paper archive.