Vision language models are unreliable at trivial spatial cognition

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Khemlani, Sangeet, Tran, Tyler, Gyory, Nathaniel, Harrison, Anthony M., Lawson, Wallace E., Thielstrom, Ravenna, Thompson, Hunter, Singh, Taaren, Trafton, J. Gregory
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!