Lazy Diffusion Transformer for Interactive Image Editing
Fuente:
arXiv
Salvato in:
| Autori principali: | Nitzan, Yotam, Wu, Zongze, Zhang, Richard, Shechtman, Eli, Cohen-Or, Daniel, Park, Taesung, Gharbi, Michaël |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improved Baselines with Representation Autoencoders
di: Singh, Jaskirat, et al.
Pubblicazione: (2026)
di: Singh, Jaskirat, et al.
Pubblicazione: (2026)
VLM-Guided Adaptive Negative Prompting for Creative Generation
di: Golan, Shelly, et al.
Pubblicazione: (2025)
di: Golan, Shelly, et al.
Pubblicazione: (2025)
What matters for Representation Alignment: Global Information or Spatial Structure?
di: Singh, Jaskirat, et al.
Pubblicazione: (2025)
di: Singh, Jaskirat, et al.
Pubblicazione: (2025)
End-to-End Training for Unified Tokenization and Latent Denoising
di: Duggal, Shivam, et al.
Pubblicazione: (2026)
di: Duggal, Shivam, et al.
Pubblicazione: (2026)
SliderSpace: Decomposing the Visual Capabilities of Diffusion Models
di: Gandikota, Rohit, et al.
Pubblicazione: (2025)
di: Gandikota, Rohit, et al.
Pubblicazione: (2025)
Distilling Diffusion Models into Conditional GANs
di: Kang, Minguk, et al.
Pubblicazione: (2024)
di: Kang, Minguk, et al.
Pubblicazione: (2024)
In-Context Sync-LoRA for Portrait Video Editing
di: Polaczek, Sagi, et al.
Pubblicazione: (2025)
di: Polaczek, Sagi, et al.
Pubblicazione: (2025)
Training-Free Text-Guided Color Editing with Multi-Modal Diffusion Transformer
di: Yin, Zixin, et al.
Pubblicazione: (2025)
di: Yin, Zixin, et al.
Pubblicazione: (2025)
On-the-fly Repulsion in the Contextual Space for Rich Diversity in Diffusion Transformers
di: Dahary, Omer, et al.
Pubblicazione: (2026)
di: Dahary, Omer, et al.
Pubblicazione: (2026)
AnyTop: Character Animation Diffusion with Any Topology
di: Gat, Inbar, et al.
Pubblicazione: (2025)
di: Gat, Inbar, et al.
Pubblicazione: (2025)
Key-Locked Rank One Editing for Text-to-Image Personalization
di: Tewel, Yoad, et al.
Pubblicazione: (2023)
di: Tewel, Yoad, et al.
Pubblicazione: (2023)
PixelMan: Consistent Object Editing with Diffusion Models via Pixel Manipulation and Generation
di: Jiang, Liyao, et al.
Pubblicazione: (2024)
di: Jiang, Liyao, et al.
Pubblicazione: (2024)
Materialist: Physically Based Editing Using Single-Image Inverse Rendering
di: Wang, Lezhong, et al.
Pubblicazione: (2025)
di: Wang, Lezhong, et al.
Pubblicazione: (2025)
TurboEdit: Text-Based Image Editing Using Few-Step Diffusion Models
di: Deutch, Gilad, et al.
Pubblicazione: (2024)
di: Deutch, Gilad, et al.
Pubblicazione: (2024)
Object-level Visual Prompts for Compositional Image Generation
di: Parmar, Gaurav, et al.
Pubblicazione: (2025)
di: Parmar, Gaurav, et al.
Pubblicazione: (2025)
LuxDiT: Lighting Estimation with Video Diffusion Transformer
di: Liang, Ruofan, et al.
Pubblicazione: (2025)
di: Liang, Ruofan, et al.
Pubblicazione: (2025)
Not Like Transformers: Drop the Beat Representation for Dance Generation with Mamba-Based Diffusion Model
di: Park, Sangjune, et al.
Pubblicazione: (2026)
di: Park, Sangjune, et al.
Pubblicazione: (2026)
Monkey See, Monkey Do: Harnessing Self-attention in Motion Diffusion for Zero-shot Motion Transfer
di: Raab, Sigal, et al.
Pubblicazione: (2024)
di: Raab, Sigal, et al.
Pubblicazione: (2024)
Detection-Driven Object Count Optimization for Text-to-Image Diffusion Models
di: Zafar, Oz, et al.
Pubblicazione: (2024)
di: Zafar, Oz, et al.
Pubblicazione: (2024)
Interactive Character Control with Auto-Regressive Motion Diffusion Models
di: Shi, Yi, et al.
Pubblicazione: (2023)
di: Shi, Yi, et al.
Pubblicazione: (2023)
Auto-Regressive Diffusion for Generating 3D Human-Object Interactions
di: Geng, Zichen, et al.
Pubblicazione: (2025)
di: Geng, Zichen, et al.
Pubblicazione: (2025)
Navigating with Annealing Guidance Scale in Diffusion Space
di: Yehezkel, Shai, et al.
Pubblicazione: (2025)
di: Yehezkel, Shai, et al.
Pubblicazione: (2025)
SAEdit: Token-level control for continuous image editing via Sparse AutoEncoder
di: Kamenetsky, Ronen, et al.
Pubblicazione: (2025)
di: Kamenetsky, Ronen, et al.
Pubblicazione: (2025)
FaceParts: Segmentation and Editing of Gaussian Splatting
di: Zapała, Tymoteusz, et al.
Pubblicazione: (2026)
di: Zapała, Tymoteusz, et al.
Pubblicazione: (2026)
FabricDiffusion: High-Fidelity Texture Transfer for 3D Garments Generation from In-The-Wild Clothing Images
di: Zhang, Cheng, et al.
Pubblicazione: (2024)
di: Zhang, Cheng, et al.
Pubblicazione: (2024)
Be Yourself: Bounded Attention for Multi-Subject Text-to-Image Generation
di: Dahary, Omer, et al.
Pubblicazione: (2024)
di: Dahary, Omer, et al.
Pubblicazione: (2024)
Proc3D: Procedural 3D Generation and Parametric Editing of 3D Shapes with Large Language Models
di: Raji, Fadlullah, et al.
Pubblicazione: (2026)
di: Raji, Fadlullah, et al.
Pubblicazione: (2026)
ReLumix: Extending Image Relighting to Video via Video Diffusion Models
di: Wang, Lezhong, et al.
Pubblicazione: (2025)
di: Wang, Lezhong, et al.
Pubblicazione: (2025)
LatentEdit: Adaptive Latent Control for Consistent Semantic Editing
di: Liu, Siyi, et al.
Pubblicazione: (2025)
di: Liu, Siyi, et al.
Pubblicazione: (2025)
Image Generation from Contextually-Contradictory Prompts
di: Huberman, Saar, et al.
Pubblicazione: (2025)
di: Huberman, Saar, et al.
Pubblicazione: (2025)
ShapeUP: Scalable Image-Conditioned 3D Editing
di: Gat, Inbar, et al.
Pubblicazione: (2026)
di: Gat, Inbar, et al.
Pubblicazione: (2026)
Spatiotemporally Consistent Indoor Lighting Estimation with Diffusion Priors
di: Tong, Mutian, et al.
Pubblicazione: (2025)
di: Tong, Mutian, et al.
Pubblicazione: (2025)
Exploration and Improvement of Nerf-based 3D Scene Editing Techniques
di: Fang, Shun, et al.
Pubblicazione: (2024)
di: Fang, Shun, et al.
Pubblicazione: (2024)
One-step Diffusion with Distribution Matching Distillation
di: Yin, Tianwei, et al.
Pubblicazione: (2023)
di: Yin, Tianwei, et al.
Pubblicazione: (2023)
BootPIG: Bootstrapping Zero-shot Personalized Image Generation Capabilities in Pretrained Diffusion Models
di: Purushwalkam, Senthil, et al.
Pubblicazione: (2024)
di: Purushwalkam, Senthil, et al.
Pubblicazione: (2024)
Structure-Guided Image Completion with Image-level and Object-level Semantic Discriminators
di: Zheng, Haitian, et al.
Pubblicazione: (2022)
di: Zheng, Haitian, et al.
Pubblicazione: (2022)
LoMOE: Localized Multi-Object Editing via Multi-Diffusion
di: Chakrabarty, Goirik, et al.
Pubblicazione: (2024)
di: Chakrabarty, Goirik, et al.
Pubblicazione: (2024)
Geometric Algebra Meets Large Language Models: Instruction-Based Transformations of Separate Meshes in 3D, Interactive and Controllable Scenes
di: Kolyvakis, Prodromos, et al.
Pubblicazione: (2024)
di: Kolyvakis, Prodromos, et al.
Pubblicazione: (2024)
3DiFACE: Synthesizing and Editing Holistic 3D Facial Animation
di: Thambiraja, Balamurugan, et al.
Pubblicazione: (2025)
di: Thambiraja, Balamurugan, et al.
Pubblicazione: (2025)
VectorGym: A Multitask Benchmark for SVG Code Generation, Sketching, and Editing
di: Rodriguez, Juan, et al.
Pubblicazione: (2026)
di: Rodriguez, Juan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Improved Baselines with Representation Autoencoders
di: Singh, Jaskirat, et al.
Pubblicazione: (2026) -
VLM-Guided Adaptive Negative Prompting for Creative Generation
di: Golan, Shelly, et al.
Pubblicazione: (2025) -
What matters for Representation Alignment: Global Information or Spatial Structure?
di: Singh, Jaskirat, et al.
Pubblicazione: (2025) -
End-to-End Training for Unified Tokenization and Latent Denoising
di: Duggal, Shivam, et al.
Pubblicazione: (2026) -
SliderSpace: Decomposing the Visual Capabilities of Diffusion Models
di: Gandikota, Rohit, et al.
Pubblicazione: (2025)