Vision language models are unreliable at trivial spatial cognition

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Khemlani, Sangeet, Tran, Tyler, Gyory, Nathaniel, Harrison, Anthony M., Lawson, Wallace E., Thielstrom, Ravenna, Thompson, Hunter, Singh, Taaren, Trafton, J. Gregory
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!