VATSA: Video, Audio, Text, Sensory, Action - A Unified Five-Modality Architecture for Human-Level Perception and Action

Fuente: Zenodo
Enregistré dans:
Détails bibliographiques
Auteur principal: K V (Kengeri Vijaya Kumar), Vinay Kumar
Format: Recurso digital
Langue:anglais
Publié: Zenodo 2026
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!