SCALE-VLP: Soft-Weighted Contrastive Volumetric Vision-Language Pre-training with Spatial-Knowledge Semantics

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Mahdizadeh, Ailar, Moghadam, Puria Azadi, He, Xiangteng, Mirabbasi, Shahriar, Nasiopoulos, Panos, Sigal, Leonid
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!