Skip to content

GeminiFusion: Efficient Pixel-wise Multimodal Fusion for Vision Transformer.

Ding Jia, Jianyuan Guo, Kai Han, Han Wu, Chao Zhang, Chang Xu, Xinghao Chen

VenueA*ICML
Year2024
ProceedingsICML

Browse the full ICML paper archive.