CLAP: Contrastive Latent Action Pretraining for Learning Vision-Language-Action Models from Human Videos

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Zhang, Chubin, Wang, Jianan, Gao, Zifeng, Su, Yue, Dai, Tianru, Zhou, Cai, Lu, Jiwen, Tang, Yansong
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!

Documenti analoghi