The Limits of Learning from Pictures and Text: Vision-Language Models and Embodied Scene Understanding

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Rosenberg, Gillian, Stadhard, Skylar, Hansen, Bruce C., Greene, Michelle R.
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!