Attention-driven GUI Grounding: Leveraging Pretrained Multimodal Large Language Models without Fine-Tuning

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Xu, Hai-Ming, Chen, Qi, Wang, Lei, Liu, Lingqiao
Format: Preprint
Publié: 2024
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!