Cross-Modal Projection in Multimodal LLMs Doesn't Really Project Visual Attributes to Textual Space.
Gaurav Verma, Minje Choi, Kartik Sharma, Jamelle Watson-Daniels, Sejoon Oh, Srijan Kumar
Browse the full ACL paper archive.
Gaurav Verma, Minje Choi, Kartik Sharma, Jamelle Watson-Daniels, Sejoon Oh, Srijan Kumar
Browse the full ACL paper archive.