VATSA: Video, Audio, Text, Sensory, Action - A Unified Five-Modality Architecture for Human-Level Perception and Action

Fuente: Zenodo
Salvato in:
Dettagli Bibliografici
Autore principale: K V (Kengeri Vijaya Kumar), Vinay Kumar
Natura: Recurso digital
Lingua:inglese
Pubblicazione: Zenodo 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!