Skip to content

Cat-MoD: Accelerating Multimodal Alignment via Caption Token Guided Asymmetric Mixture-of-Depths.

Yijie Huang, Xiaocui Yang, Shi Feng, Wen Zhang, Kaisong Song, Yifei Zhang, Daling Wang

VenueA*ACL
Year2026
ProceedingsACL (1)

Browse the full ACL paper archive.