Easier Painting Than Thinking: Can Text-to-Image Models Set the Stage, but Not Direct the Play?
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Ouxiang, Wang, Yuan, Hu, Xinting, Huang, Huijuan, Chen, Rui, Ou, Jiarong, Tao, Xin, Wan, Pengfei, Qi, Xiaojuan, Feng, Fuli |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Aligning Text to Image in Diffusion Models is Easier Than You Think
di: Lee, Jaa-Yeon, et al.
Pubblicazione: (2025)
di: Lee, Jaa-Yeon, et al.
Pubblicazione: (2025)
SPEED: Scalable, Precise, and Efficient Concept Erasure for Diffusion Models
di: Li, Ouxiang, et al.
Pubblicazione: (2025)
di: Li, Ouxiang, et al.
Pubblicazione: (2025)
Multimodal Representation Alignment for Image Generation: Text-Image Interleaved Control Is Easier Than You Think
di: Chen, Liang, et al.
Pubblicazione: (2025)
di: Chen, Liang, et al.
Pubblicazione: (2025)
BadVideo: Stealthy Backdoor Attack against Text-to-Video Generation
di: Wang, Ruotong, et al.
Pubblicazione: (2025)
di: Wang, Ruotong, et al.
Pubblicazione: (2025)
Identification in (Endogenously) Nonlinear SVARs Is Easier Than You Think
di: Duffy, James A., et al.
Pubblicazione: (2026)
di: Duffy, James A., et al.
Pubblicazione: (2026)
Fine-tuning MLLMs Without Forgetting Is Easier Than You Think
di: Li, He, et al.
Pubblicazione: (2026)
di: Li, He, et al.
Pubblicazione: (2026)
Extrapolating and Decoupling Image-to-Video Generation Models: Motion Modeling is Easier Than You Think
di: Tian, Jie, et al.
Pubblicazione: (2025)
di: Tian, Jie, et al.
Pubblicazione: (2025)
CRAFT: Aligning Diffusion Models with Fine-Tuning Is Easier Than You Think
di: Sun, Zening, et al.
Pubblicazione: (2026)
di: Sun, Zening, et al.
Pubblicazione: (2026)
Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think
di: Yu, Sihyun, et al.
Pubblicazione: (2024)
di: Yu, Sihyun, et al.
Pubblicazione: (2024)
Representation Entanglement for Generation: Training Diffusion Transformers Is Much Easier Than You Think
di: Wu, Ge, et al.
Pubblicazione: (2025)
di: Wu, Ge, et al.
Pubblicazione: (2025)
Thinking with Frames: Generative Video Distortion Evaluation via Frame Reward Model
di: Wang, Yuan, et al.
Pubblicazione: (2026)
di: Wang, Yuan, et al.
Pubblicazione: (2026)
Improving Synthetic Image Detection Towards Generalization: An Image Transformation Perspective
di: Li, Ouxiang, et al.
Pubblicazione: (2024)
di: Li, Ouxiang, et al.
Pubblicazione: (2024)
ZeroFlow: Overcoming Catastrophic Forgetting is Easier than You Think
di: Feng, Tao, et al.
Pubblicazione: (2025)
di: Feng, Tao, et al.
Pubblicazione: (2025)
Alchemist: Unlocking Efficiency in Text-to-Image Model Training via Meta-Gradient Data Selection
di: Ding, Kaixin, et al.
Pubblicazione: (2025)
di: Ding, Kaixin, et al.
Pubblicazione: (2025)
To Copy or Not to Copy: Copying Is Easier to Induce Than Recall
di: Farahani, Mehrdad, et al.
Pubblicazione: (2026)
di: Farahani, Mehrdad, et al.
Pubblicazione: (2026)
Asymptotic Fair Division: Chores Are Easier Than Goods
di: Manurangsi, Pasin, et al.
Pubblicazione: (2025)
di: Manurangsi, Pasin, et al.
Pubblicazione: (2025)
Representation Alignment for Just Image Transformers is not Easier than You Think
di: Shin, Jaeyo, et al.
Pubblicazione: (2026)
di: Shin, Jaeyo, et al.
Pubblicazione: (2026)
Think, then Score: Decoupled Reasoning and Scoring for Video Reward Modeling
di: Wang, Yuan, et al.
Pubblicazione: (2026)
di: Wang, Yuan, et al.
Pubblicazione: (2026)
Min-Max Optimization Is Strictly Easier Than Variational Inequalities
di: Shugart, Henry, et al.
Pubblicazione: (2025)
di: Shugart, Henry, et al.
Pubblicazione: (2025)
Imbalance in Balance: Online Concept Balancing in Generation Models
di: Shi, Yukai, et al.
Pubblicazione: (2025)
di: Shi, Yukai, et al.
Pubblicazione: (2025)
Undermining Mental Proof: How AI Can Make Cooperation Harder by Making Thinking Easier
di: Wojtowicz, Zachary, et al.
Pubblicazione: (2024)
di: Wojtowicz, Zachary, et al.
Pubblicazione: (2024)
Fine-Tuning Image-Conditional Diffusion Models is Easier than You Think
di: Garcia, Gonzalo Martin, et al.
Pubblicazione: (2024)
di: Garcia, Gonzalo Martin, et al.
Pubblicazione: (2024)
Let Me Count the Ways: Teaching Math in the Library May Seem Like a Stretch. But It's Easier Than You Think
di: Fleming, Dan
Pubblicazione: (2004)
di: Fleming, Dan
Pubblicazione: (2004)
Easier to Mislead Than to Correct: Harmful and Beneficial Revision in LLM Conformity
di: Qu, Jiaming, et al.
Pubblicazione: (2026)
di: Qu, Jiaming, et al.
Pubblicazione: (2026)
Re-Thinking the Automatic Evaluation of Image-Text Alignment in Text-to-Image Models
di: Zhang, Huixuan, et al.
Pubblicazione: (2025)
di: Zhang, Huixuan, et al.
Pubblicazione: (2025)
Letter to: The Potential of Structured Active Play for Social and Personal Development in Preschoolers During Cancer Treatment: A Qualitative RePlay Study
di: Huijuan Yu
Pubblicazione: (2025)
di: Huijuan Yu
Pubblicazione: (2025)
Can We Change the Stroke Size for Easier Diffusion?
di: Bai, Yunwei, et al.
Pubblicazione: (2026)
di: Bai, Yunwei, et al.
Pubblicazione: (2026)
Stable Velocity: A Variance Perspective on Flow Matching
di: Yang, Donglin, et al.
Pubblicazione: (2026)
di: Yang, Donglin, et al.
Pubblicazione: (2026)
Caption Generation for Dongba Paintings via Prompt Learning and Semantic Fusion
di: Qian, Shuangwu, et al.
Pubblicazione: (2026)
di: Qian, Shuangwu, et al.
Pubblicazione: (2026)
Intermediate Outputs Are More Sensitive Than You Think
di: Huang, Tao, et al.
Pubblicazione: (2024)
di: Huang, Tao, et al.
Pubblicazione: (2024)
Interview With the Philosopher and Artist Mattin: It Is Easier to Imagine the End of the World Than an Alternative to the Liberal Individual
di: Cécile Malaspina, et al.
Pubblicazione: (2025)
di: Cécile Malaspina, et al.
Pubblicazione: (2025)
Rebuilding May Be Easier Than Maintaining Social and Cultural Cohesion After the L.A. Fires
di: Richard Little
Pubblicazione: (2025)
di: Richard Little
Pubblicazione: (2025)
Model Inversion Attacks Through Target-Specific Conditional Diffusion Models
di: Li, Ouxiang, et al.
Pubblicazione: (2024)
di: Li, Ouxiang, et al.
Pubblicazione: (2024)
Setting the Stage: Text-Driven Scene-Consistent Image Generation
di: Xie, Cong, et al.
Pubblicazione: (2025)
di: Xie, Cong, et al.
Pubblicazione: (2025)
UniPaint: Unified Space-time Video Inpainting via Mixture-of-Experts
di: Wan, Zhen, et al.
Pubblicazione: (2024)
di: Wan, Zhen, et al.
Pubblicazione: (2024)
Free Lunch Alignment of Text-to-Image Diffusion Models without Preference Image Pairs
di: Xian, Jia Jun Cheng, et al.
Pubblicazione: (2025)
di: Xian, Jia Jun Cheng, et al.
Pubblicazione: (2025)
Veda: Scalable Video Diffusion via Distilled Sparse Attention
di: Han, Shihao, et al.
Pubblicazione: (2026)
di: Han, Shihao, et al.
Pubblicazione: (2026)
Can OOD Object Detectors Learn from Foundation Models?
di: Liu, Jiahui, et al.
Pubblicazione: (2024)
di: Liu, Jiahui, et al.
Pubblicazione: (2024)
Guess What I am Thinking: A Benchmark for Inner Thought Reasoning of Role-Playing Language Agents
di: Xu, Rui, et al.
Pubblicazione: (2025)
di: Xu, Rui, et al.
Pubblicazione: (2025)
TROJail: Trajectory-Level Optimization for Multi-Turn Large Language Model Jailbreaks with Process Rewards
di: Xiong, Xiqiao, et al.
Pubblicazione: (2025)
di: Xiong, Xiqiao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Aligning Text to Image in Diffusion Models is Easier Than You Think
di: Lee, Jaa-Yeon, et al.
Pubblicazione: (2025) -
SPEED: Scalable, Precise, and Efficient Concept Erasure for Diffusion Models
di: Li, Ouxiang, et al.
Pubblicazione: (2025) -
Multimodal Representation Alignment for Image Generation: Text-Image Interleaved Control Is Easier Than You Think
di: Chen, Liang, et al.
Pubblicazione: (2025) -
BadVideo: Stealthy Backdoor Attack against Text-to-Video Generation
di: Wang, Ruotong, et al.
Pubblicazione: (2025) -
Identification in (Endogenously) Nonlinear SVARs Is Easier Than You Think
di: Duffy, James A., et al.
Pubblicazione: (2026)