Stylebreeder: Exploring and Democratizing Artistic Styles through Text-to-Image Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zheng, Matthew, Simsar, Enis, Yesiltepe, Hidir, Tombari, Federico, Simon, Joel, Yanardag, Pinar |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GANTASTIC: GAN-based Transfer of Interpretable Directions for Disentangled Image Editing in Text-to-Image Diffusion Models
par: Dalva, Yusuf, et autres
Publié: (2024)
par: Dalva, Yusuf, et autres
Publié: (2024)
MIST: Mitigating Intersectional Bias with Disentangled Cross-Attention Editing in Text-to-Image Diffusion Models
par: Yesiltepe, Hidir, et autres
Publié: (2024)
par: Yesiltepe, Hidir, et autres
Publié: (2024)
LoRACLR: Contrastive Adaptation for Customization of Diffusion Models
par: Simsar, Enis, et autres
Publié: (2024)
par: Simsar, Enis, et autres
Publié: (2024)
Dynamic View Synthesis as an Inverse Problem
par: Yesiltepe, Hidir, et autres
Publié: (2025)
par: Yesiltepe, Hidir, et autres
Publié: (2025)
The Curious Case of End Token: A Zero-Shot Disentangled Image Editing using CLIP
par: Yesiltepe, Hidir, et autres
Publié: (2024)
par: Yesiltepe, Hidir, et autres
Publié: (2024)
LoRAShop: Training-Free Multi-Concept Image Generation and Editing with Rectified Flow Transformers
par: Dalva, Yusuf, et autres
Publié: (2025)
par: Dalva, Yusuf, et autres
Publié: (2025)
Contrastive Test-Time Composition of Multiple LoRA Models for Image Generation
par: Meral, Tuna Han Salih, et autres
Publié: (2024)
par: Meral, Tuna Han Salih, et autres
Publié: (2024)
MotionFlow: Attention-Driven Motion Transfer in Video Diffusion Models
par: Meral, Tuna Han Salih, et autres
Publié: (2024)
par: Meral, Tuna Han Salih, et autres
Publié: (2024)
MotionShop: Zero-Shot Motion Transfer in Video Diffusion Models with Mixture of Score Guidance
par: Yesiltepe, Hidir, et autres
Publié: (2024)
par: Yesiltepe, Hidir, et autres
Publié: (2024)
Aligning Latent Geometry for Spherical Flow Matching in Image Generation
par: Meral, Tuna Han Salih, et autres
Publié: (2026)
par: Meral, Tuna Han Salih, et autres
Publié: (2026)
LIME: Localized Image Editing via Attention Regularization in Diffusion Models
par: Simsar, Enis, et autres
Publié: (2023)
par: Simsar, Enis, et autres
Publié: (2023)
Infinity-RoPE: Action-Controllable Infinite Video Generation Emerges From Autoregressive Self-Rollout
par: Yesiltepe, Hidir, et autres
Publié: (2025)
par: Yesiltepe, Hidir, et autres
Publié: (2025)
UIP2P: Unsupervised Instruction-based Image Editing via Edit Reversibility Constraint
par: Simsar, Enis, et autres
Publié: (2024)
par: Simsar, Enis, et autres
Publié: (2024)
DTG-Restore: Training-Free Diffusion Refinement for Generative Video Super-Resolution
par: Yesiltepe, Hidir, et autres
Publié: (2026)
par: Yesiltepe, Hidir, et autres
Publié: (2026)
FOCUS: Optimal Control for Multi-Entity World Modeling in Text-to-Image Generation
par: Bill, Eric Tillmann, et autres
Publié: (2025)
par: Bill, Eric Tillmann, et autres
Publié: (2025)
Personalized Image Editing in Text-to-Image Diffusion Models via Collaborative Direct Preference Optimization
par: Dunlop, Connor, et autres
Publié: (2025)
par: Dunlop, Connor, et autres
Publié: (2025)
Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models
par: Akdemir, Kiymet, et autres
Publié: (2025)
par: Akdemir, Kiymet, et autres
Publié: (2025)
LoRAverse: A Submodular Framework to Retrieve Diverse Adapters for Diffusion Models
par: Sonmezer, Mert, et autres
Publié: (2025)
par: Sonmezer, Mert, et autres
Publié: (2025)
Explaining in Diffusion: Explaining a Classifier Through Hierarchical Semantics with Text-to-Image Diffusion Models
par: Kazimi, Tahira, et autres
Publié: (2024)
par: Kazimi, Tahira, et autres
Publié: (2024)
VideoMLA: Low-Rank Latent KV Cache for Minute-Scale Autoregressive Video Diffusion
par: Yesiltepe, Hidir, et autres
Publié: (2026)
par: Yesiltepe, Hidir, et autres
Publié: (2026)
FullFlow: Upgrading Text-to-Image Flow Matching Models for Bidirectional Vision--Language Generation
par: Bill, Eric Tillmann, et autres
Publié: (2026)
par: Bill, Eric Tillmann, et autres
Publié: (2026)
From Zero to Hero: Training-Free Custom Concept Spawning in World Models
par: Akdemir, Kiymet, et autres
Publié: (2026)
par: Akdemir, Kiymet, et autres
Publié: (2026)
RefAM: Attention Magnets for Zero-Shot Referral Segmentation
par: Kukleva, Anna, et autres
Publié: (2025)
par: Kukleva, Anna, et autres
Publié: (2025)
SHYI: Action Support for Contrastive Learning in High-Fidelity Text-to-Image Generation
par: Xia, Tianxiang, et autres
Publié: (2025)
par: Xia, Tianxiang, et autres
Publié: (2025)
Plot'n Polish: Zero-shot Story Visualization and Disentangled Editing with Text-to-Image Diffusion Models
par: Akdemir, Kiymet, et autres
Publié: (2025)
par: Akdemir, Kiymet, et autres
Publié: (2025)
AdaState: Self-Evolving Anchors for Streaming Video Generation
par: Dalva, Yusuf, et autres
Publié: (2026)
par: Dalva, Yusuf, et autres
Publié: (2026)
CREA: A Collaborative Multi-Agent Framework for Creative Image Editing and Generation
par: Venkatesh, Kavana, et autres
Publié: (2025)
par: Venkatesh, Kavana, et autres
Publié: (2025)
ORACLE: Leveraging Mutual Information for Consistent Character Generation with LoRAs in Diffusion Models
par: Akdemir, Kiymet, et autres
Publié: (2024)
par: Akdemir, Kiymet, et autres
Publié: (2024)
JEDI: The Force of Jensen-Shannon Divergence in Disentangling Diffusion Models
par: Bill, Eric Tillmann, et autres
Publié: (2025)
par: Bill, Eric Tillmann, et autres
Publié: (2025)
MegaPortrait: Revisiting Diffusion Control for High-fidelity Portrait Generation
par: Yang, Han, et autres
Publié: (2024)
par: Yang, Han, et autres
Publié: (2024)
Diverse Video Generation with Determinantal Point Process-Guided Policy Optimization
par: Kazimi, Tahira, et autres
Publié: (2025)
par: Kazimi, Tahira, et autres
Publié: (2025)
FluxSpace: Disentangled Semantic Editing in Rectified Flow Transformers
par: Dalva, Yusuf, et autres
Publié: (2024)
par: Dalva, Yusuf, et autres
Publié: (2024)
StyleForge: Enhancing Text-to-Image Synthesis for Any Artistic Styles with Dual Binding
par: Park, Junseo, et autres
Publié: (2024)
par: Park, Junseo, et autres
Publié: (2024)
LayerFusion: Harmonized Multi-Layer Text-to-Image Generation with Generative Priors
par: Dalva, Yusuf, et autres
Publié: (2024)
par: Dalva, Yusuf, et autres
Publié: (2024)
StyleDecoupler: Generalizable Artistic Style Disentanglement
par: Jia, Zexi, et autres
Publié: (2026)
par: Jia, Zexi, et autres
Publié: (2026)
Recognizing Artistic Style of Archaeological Image Fragments Using Deep Style Extrapolation
par: Elkin, Gur, et autres
Publié: (2025)
par: Elkin, Gur, et autres
Publié: (2025)
WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization
par: Zhuoqi, Ma, et autres
Publié: (2024)
par: Zhuoqi, Ma, et autres
Publié: (2024)
IC-Portrait: In-Context Matching for View-Consistent Personalized Portrait
par: Yang, Han, et autres
Publié: (2025)
par: Yang, Han, et autres
Publié: (2025)
The Cow of Rembrandt - Analyzing Artistic Prompt Interpretation in Text-to-Image Models
par: Ferrara, Alfio, et autres
Publié: (2025)
par: Ferrara, Alfio, et autres
Publié: (2025)
RAVEL: Rare Concept Generation and Editing via Graph-driven Relational Guidance
par: Venkatesh, Kavana, et autres
Publié: (2024)
par: Venkatesh, Kavana, et autres
Publié: (2024)
Documents similaires
-
GANTASTIC: GAN-based Transfer of Interpretable Directions for Disentangled Image Editing in Text-to-Image Diffusion Models
par: Dalva, Yusuf, et autres
Publié: (2024) -
MIST: Mitigating Intersectional Bias with Disentangled Cross-Attention Editing in Text-to-Image Diffusion Models
par: Yesiltepe, Hidir, et autres
Publié: (2024) -
LoRACLR: Contrastive Adaptation for Customization of Diffusion Models
par: Simsar, Enis, et autres
Publié: (2024) -
Dynamic View Synthesis as an Inverse Problem
par: Yesiltepe, Hidir, et autres
Publié: (2025) -
The Curious Case of End Token: A Zero-Shot Disentangled Image Editing using CLIP
par: Yesiltepe, Hidir, et autres
Publié: (2024)