Skip to content

Attention-Driven GUI Grounding: Leveraging Pretrained Multimodal Large Language Models Without Fine-Tuning.

Hai-Ming Xu, Qi Chen, Lei Wang, Lingqiao Liu

VenueA*AAAI
Year2025
ProceedingsAAAI

Browse the full AAAI paper archive.