Zhang, C., Wang, J., Gao, Z., Su, Y., Dai, T., Zhou, C., . . . Tang, Y. (2026). CLAP: Contrastive Latent Action Pretraining for Learning Vision-Language-Action Models from Human Videos.
Chicago-Zitierstil (17. Ausg.)Zhang, Chubin, Jianan Wang, Zifeng Gao, Yue Su, Tianru Dai, Cai Zhou, Jiwen Lu, und Yansong Tang. CLAP: Contrastive Latent Action Pretraining for Learning Vision-Language-Action Models from Human Videos. 2026.
MLA-Zitierstil (9. Ausg.)Zhang, Chubin, et al. CLAP: Contrastive Latent Action Pretraining for Learning Vision-Language-Action Models from Human Videos. 2026.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.