See It, Say It, Sorted: An Iterative Training-Free Framework for Visually-Grounded Multimodal Reasoning in LVLMs

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Zhang, Yongchang, Ma, Oliver, Liu, Tianyi, Zhou, Guangquan, Chen, Yang
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!