DINOv2 Meets Text: A Unified Framework for Image- and Pixel-Level Vision-Language Alignment

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Jose, Cijo, Moutakanni, Théo, Kang, Dahyun, Baldassarre, Federico, Darcet, Timothée, Xu, Hu, Li, Daniel, Szafraniec, Marc, Ramamonjisoa, Michaël, Oquab, Maxime, Siméoni, Oriane, Vo, Huy V., Labatut, Patrick, Bojanowski, Piotr
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!

Similar Items