Good Seed Makes a Good Crop: Discovering Secret Seeds in Text-to-Image Diffusion Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Xu, Katherine, Zhang, Lingzhi, Shi, Jianbo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Detecting Origin Attribution for Text-to-Image Diffusion Models
por: Xu, Katherine, et al.
Publicado: (2024)
por: Xu, Katherine, et al.
Publicado: (2024)
Seed-to-Seed: Image Translation in Diffusion Seed Space
por: Greenberg, Or, et al.
Publicado: (2024)
por: Greenberg, Or, et al.
Publicado: (2024)
Good Noise Makes Good Edits: A Training-Free Diffusion-Based Video Editing with Image and Text Prompts
por: Choi, Saemee, et al.
Publicado: (2025)
por: Choi, Saemee, et al.
Publicado: (2025)
What Makes for a Good Stereoscopic Image?
por: Tamir, Netanel Y., et al.
Publicado: (2024)
por: Tamir, Netanel Y., et al.
Publicado: (2024)
Stable Diffusion Models are Secretly Good at Visual In-Context Learning
por: Oorloff, Trevine, et al.
Publicado: (2025)
por: Oorloff, Trevine, et al.
Publicado: (2025)
What Makes for Good Image Captions?
por: Chen, Delong, et al.
Publicado: (2024)
por: Chen, Delong, et al.
Publicado: (2024)
How to Make Cross Encoder a Good Teacher for Efficient Image-Text Retrieval?
por: Chen, Yuxin, et al.
Publicado: (2024)
por: Chen, Yuxin, et al.
Publicado: (2024)
All Seeds Are Not Equal: Enhancing Compositional Text-to-Image Generation with Reliable Random Seeds
por: Li, Shuangqi, et al.
Publicado: (2024)
por: Li, Shuangqi, et al.
Publicado: (2024)
Image Understanding Makes for A Good Tokenizer for Image Generation
por: Wang, Luting, et al.
Publicado: (2024)
por: Wang, Luting, et al.
Publicado: (2024)
Boosting Text-to-Image Diffusion Models via Core Token Attention-Based Seed Selection
por: Zhang, Yunzhe, et al.
Publicado: (2026)
por: Zhang, Yunzhe, et al.
Publicado: (2026)
SeedVR: Seeding Infinity in Diffusion Transformer Towards Generic Video Restoration
por: Wang, Jianyi, et al.
Publicado: (2025)
por: Wang, Jianyi, et al.
Publicado: (2025)
Detecting Human Artifacts from Text-to-Image Models
por: Wang, Kaihong, et al.
Publicado: (2024)
por: Wang, Kaihong, et al.
Publicado: (2024)
SeedEdit: Align Image Re-Generation to Image Editing
por: Shi, Yichun, et al.
Publicado: (2024)
por: Shi, Yichun, et al.
Publicado: (2024)
Latent Denoising Makes Good Tokenizers
por: Yang, Jiawei, et al.
Publicado: (2025)
por: Yang, Jiawei, et al.
Publicado: (2025)
MedM-VL: What Makes a Good Medical LVLM?
por: Shi, Yiming, et al.
Publicado: (2025)
por: Shi, Yiming, et al.
Publicado: (2025)
Making Large Vision Language Models to be Good Few-shot Learners
por: Liu, Fan, et al.
Publicado: (2024)
por: Liu, Fan, et al.
Publicado: (2024)
Are Image-to-Video Models Good Zero-Shot Image Editors?
por: Zhang, Zechuan, et al.
Publicado: (2025)
por: Zhang, Zechuan, et al.
Publicado: (2025)
Is Large-Scale Pretraining the Secret to Good Domain Generalization?
por: Teterwak, Piotr, et al.
Publicado: (2024)
por: Teterwak, Piotr, et al.
Publicado: (2024)
Seed Selection for Human-Oriented Image Reconstruction via Guided Diffusion
por: Tatsumi, Yui, et al.
Publicado: (2025)
por: Tatsumi, Yui, et al.
Publicado: (2025)
What Makes a Good Dataset for Knowledge Distillation?
por: Frank, Logan, et al.
Publicado: (2024)
por: Frank, Logan, et al.
Publicado: (2024)
GoodDrag: Towards Good Practices for Drag Editing with Diffusion Models
por: Zhang, Zewei, et al.
Publicado: (2024)
por: Zhang, Zewei, et al.
Publicado: (2024)
What Makes a Good Generated Image? Investigating Human and Multimodal LLM Image Preference Alignment
por: Parthasarathy, Rishab, et al.
Publicado: (2025)
por: Parthasarathy, Rishab, et al.
Publicado: (2025)
What Makes Good Few-shot Examples for Vision-Language Models?
por: Guo, Zhaojun, et al.
Publicado: (2024)
por: Guo, Zhaojun, et al.
Publicado: (2024)
Diffusion Model is a Good Pose Estimator from 3D RF-Vision
por: Fan, Junqiao, et al.
Publicado: (2024)
por: Fan, Junqiao, et al.
Publicado: (2024)
EMMA: Your Text-to-Image Diffusion Model Can Secretly Accept Multi-Modal Prompts
por: Han, Yucheng, et al.
Publicado: (2024)
por: Han, Yucheng, et al.
Publicado: (2024)
Determinism of Randomness: Prompt-Residual Seed Shaping for Diffusion Generation
por: Yan, Song, et al.
Publicado: (2025)
por: Yan, Song, et al.
Publicado: (2025)
Versatile Diffusion: Text, Images and Variations All in One Diffusion Model
por: Xu, Xingqian, et al.
Publicado: (2022)
por: Xu, Xingqian, et al.
Publicado: (2022)
SeeDiff: Off-the-Shelf Seeded Mask Generation from Diffusion Models
por: Park, Joon Hyun, et al.
Publicado: (2025)
por: Park, Joon Hyun, et al.
Publicado: (2025)
ScImage: How Good Are Multimodal Large Language Models at Scientific Text-to-Image Generation?
por: Zhang, Leixin, et al.
Publicado: (2024)
por: Zhang, Leixin, et al.
Publicado: (2024)
Are Multimodal Large Language Models Good Annotators for Image Tagging?
por: Xie, Ming-Kun, et al.
Publicado: (2026)
por: Xie, Ming-Kun, et al.
Publicado: (2026)
FairGen: Enhancing Fairness in Text-to-Image Diffusion Models via Self-Discovering Latent Directions
por: Jiang, Yilei, et al.
Publicado: (2024)
por: Jiang, Yilei, et al.
Publicado: (2024)
IS-Diff: Improving Diffusion-Based Inpainting with Better Initial Seed
por: Lyu, Yongzhe, et al.
Publicado: (2025)
por: Lyu, Yongzhe, et al.
Publicado: (2025)
Video Generation Models Are Good Latent Reward Models
por: Mi, Xiaoyue, et al.
Publicado: (2025)
por: Mi, Xiaoyue, et al.
Publicado: (2025)
Beyond Accuracy: Metrics that Uncover What Makes a 'Good' Visual Descriptor
por: Lin, Ethan, et al.
Publicado: (2025)
por: Lin, Ethan, et al.
Publicado: (2025)
SeedEdit 3.0: Fast and High-Quality Generative Image Editing
por: Wang, Peng, et al.
Publicado: (2025)
por: Wang, Peng, et al.
Publicado: (2025)
VideoRoPE: What Makes for Good Video Rotary Position Embedding?
por: Wei, Xilin, et al.
Publicado: (2025)
por: Wei, Xilin, et al.
Publicado: (2025)
PKU-GoodsAD: A Supermarket Goods Dataset for Unsupervised Anomaly Detection and Segmentation
por: Zhang, Jian, et al.
Publicado: (2023)
por: Zhang, Jian, et al.
Publicado: (2023)
Discovering Divergent Representations between Text-to-Image Models
por: Dunlap, Lisa, et al.
Publicado: (2025)
por: Dunlap, Lisa, et al.
Publicado: (2025)
Self-Discovering Interpretable Diffusion Latent Directions for Responsible Text-to-Image Generation
por: Li, Hang, et al.
Publicado: (2023)
por: Li, Hang, et al.
Publicado: (2023)
NoiseCollage: A Layout-Aware Text-to-Image Diffusion Model Based on Noise Cropping and Merging
por: Shirakawa, Takahiro, et al.
Publicado: (2024)
por: Shirakawa, Takahiro, et al.
Publicado: (2024)
Ejemplares similares
-
Detecting Origin Attribution for Text-to-Image Diffusion Models
por: Xu, Katherine, et al.
Publicado: (2024) -
Seed-to-Seed: Image Translation in Diffusion Seed Space
por: Greenberg, Or, et al.
Publicado: (2024) -
Good Noise Makes Good Edits: A Training-Free Diffusion-Based Video Editing with Image and Text Prompts
por: Choi, Saemee, et al.
Publicado: (2025) -
What Makes for a Good Stereoscopic Image?
por: Tamir, Netanel Y., et al.
Publicado: (2024) -
Stable Diffusion Models are Secretly Good at Visual In-Context Learning
por: Oorloff, Trevine, et al.
Publicado: (2025)