GoT: Unleashing Reasoning Capability of Multimodal Large Language Model for Visual Generation and Editing

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Fang, Rongyao, Duan, Chengqi, Wang, Kun, Huang, Linjiang, Li, Hao, Yan, Shilin, Tian, Hao, Zeng, Xingyu, Zhao, Rui, Dai, Jifeng, Liu, Xihui, Li, Hongsheng
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!