Focusing on What Matters: Object-Agent-centric Tokenization for Vision Language Action models

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Bendikas, Rokas, Dijkman, Daniel, Peschl, Markus, Haresh, Sanjay, Mazzaglia, Pietro
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!