Aligning Information Capacity Between Vision and Language via Dense-to-Sparse Feature Distillation for Image-Text Matching

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Liu, Yang, Feng, Wentao, Liu, Zhuoyao, Huang, Shudong, Lv, Jiancheng
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!