Boosting Multi-modal Keyphrase Prediction with Dynamic Chain-of-Thought in Vision-Language Models

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Ma, Qihang, Li, Shengyu, Tang, Jie, Yang, Dingkang, Chen, Shaodong, Zhang, Yingyi, Feng, Chao, Ran, Jiao
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!