GoT: Unleashing Reasoning Capability of Multimodal Large Language Model for Visual Generation and Editing

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Fang, Rongyao, Duan, Chengqi, Wang, Kun, Huang, Linjiang, Li, Hao, Yan, Shilin, Tian, Hao, Zeng, Xingyu, Zhao, Rui, Dai, Jifeng, Liu, Xihui, Li, Hongsheng
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!