MCoT-MVS: Multi-level Vision Selection by Multi-modal Chain-of-Thought Reasoning for Composed Image Retrieval

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Ge, Xuri, Wang, Chunhao, Wang, Xindi, Qin, Zheyun, Chen, Zhumin, Xin, Xin
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!

Documenti analoghi