MIMO: A medical vision language model with visual referring multimodal input and pixel grounding multimodal output

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Chen, Yanyuan, Xu, Dexuan, Huang, Yu, Zhan, Songkun, Wang, Hanpin, Chen, Dongxue, Wang, Xueping, Qiu, Meikang, Li, Hang
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!