FALCON: Resolving Visual Redundancy and Fragmentation in High-resolution Multimodal Large Language Models via Visual Registers

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Zhang, Renshan, Shao, Rui, Chen, Gongwei, Zhang, Miao, Zhou, Kaiwen, Guan, Weili, Nie, Liqiang
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!