Why We Look Where We Look: Emergent Human-like Fixations of a Foveated Visual Language Model Maximizing Scene Understanding

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Murlidaran, Shravan, Wen, Ziqi, Shehabi, Sana, Eckstein, Miguel P.
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!

Documenti analoghi