CoF-T2I: Video Models as Pure Visual Reasoners for Text-to-Image Generation

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Tong, Chengzhuo, Chang, Mingkun, Zhang, Shenglong, Wang, Yuran, Liang, Cheng, Zhao, Zhizheng, An, Ruichuan, Zeng, Bohan, Shi, Yang, Dai, Yifan, Zhao, Ziming, Li, Guanbin, Wan, Pengfei, Zhang, Yuanxing, Zhang, Wentao
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!