Skip to content

HiMo-CLIP: Modeling Semantic Hierarchy and Monotonicity in Vision-Language Alignment.

Ruijia Wu, Ping Chen, Fei Shen, Shaoan Zhao, Qiang Hui, Huanlin Gao, Ting Lu, Zhaoxiang Liu, Fang Zhao, Kai Wang, Shiguo Lian

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.