CLAP: Contrastive Latent Action Pretraining for Learning Vision-Language-Action Models from Human Videos

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Zhang, Chubin, Wang, Jianan, Gao, Zifeng, Su, Yue, Dai, Tianru, Zhou, Cai, Lu, Jiwen, Tang, Yansong
Format: Preprint
Publié: 2026
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!