Skip to content

Visual Latent Captioning - Towards Verbalizing Vision Transformer Encoders.

Sogol Haghighat, Tim Daniel Metzler, Santosh Thoduka, Sebastian Houben

VenueAECIR
Year2025
ProceedingsECIR (2)

Browse the full ECIR paper archive.