Skip to content

How do Multimodal Foundation Models Encode Text and Speech? An Analysis of Cross-Lingual and Cross-Modal Representations.

Hyunji Lee, Danni Liu, Supriti Sinhamahapatra, Jan Niehues

VenueANAACL
Year2025
ProceedingsNAACL (Short Papers)

Browse the full NAACL paper archive.