SCALE-VLP: Soft-Weighted Contrastive Volumetric Vision-Language Pre-training with Spatial-Knowledge Semantics

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Mahdizadeh, Ailar, Moghadam, Puria Azadi, He, Xiangteng, Mirabbasi, Shahriar, Nasiopoulos, Panos, Sigal, Leonid
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!