CoF-T2I: Video Models as Pure Visual Reasoners for Text-to-Image Generation

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Tong, Chengzhuo, Chang, Mingkun, Zhang, Shenglong, Wang, Yuran, Liang, Cheng, Zhao, Zhizheng, An, Ruichuan, Zeng, Bohan, Shi, Yang, Dai, Yifan, Zhao, Ziming, Li, Guanbin, Wan, Pengfei, Zhang, Yuanxing, Zhang, Wentao
Format: Preprint
Veröffentlicht: 2026
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!