Do MLLMs Really See It: Reinforcing Visual Attention in Multimodal LLMs

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Ou, Siqu, Wan, Tianrui, Zhao, Zhiyuan, Gao, Junyu, Li, Xuelong
Format: Preprint
Publié: 2026
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!