CoreGaze: Core Subgraph-Driven Visual Gaze Diffusion for Training-Free Referring Multimodal Large Language Models.
Xiaoyang Yi, Jing Chen, Yuru Bao, Jian Zhang
Browse the full ACL paper archive.
Xiaoyang Yi, Jing Chen, Yuru Bao, Jian Zhang
Browse the full ACL paper archive.