PRISM: A Multi-View Multi-Capability Retail Video Dataset for Embodied Vision-Language Models

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Rouhi, Amirreza, Sakurikar, Parikshit, Reddy, Satya Sai, Menga, Narsimha, Govil, Anirudh, Chittajallu, Sri Harsha, Aggarwal, Rajat, Namboodiri, Anoop, Reddi, Sashi
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!