Latent Space Disentanglement in Diffusion Transformers Enables Precise Zero-shot Semantic Editing
Fuente:
arXiv
Salvato in:
| Autori principali: | Shuai, Zitao, Wu, Chenwei, Tang, Zhengxu, Song, Bowen, Shen, Liyue |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Latent Space Disentanglement in Diffusion Transformers Enables Zero-shot Fine-grained Semantic Editing
di: Shuai, Zitao, et al.
Pubblicazione: (2024)
di: Shuai, Zitao, et al.
Pubblicazione: (2024)
Distributionally Robust Alignment for Medical Federated Vision-Language Pre-training Under Data Heterogeneity
di: Shuai, Zitao, et al.
Pubblicazione: (2024)
di: Shuai, Zitao, et al.
Pubblicazione: (2024)
Efficient In-Context Medical Segmentation with Meta-driven Visual Prompt Selection
di: Wu, Chenwei, et al.
Pubblicazione: (2024)
di: Wu, Chenwei, et al.
Pubblicazione: (2024)
SatDiffMoE: A Mixture of Estimation Method for Satellite Image Super-resolution with Latent Diffusion Models
di: Luo, Zhaoxu, et al.
Pubblicazione: (2024)
di: Luo, Zhaoxu, et al.
Pubblicazione: (2024)
Nodule-Aligned Latent Space Learning with LLM-Driven Multimodal Diffusion for Lung Nodule Progression Prediction
di: Song, James, et al.
Pubblicazione: (2026)
di: Song, James, et al.
Pubblicazione: (2026)
Solving Inverse Problems with Latent Diffusion Models via Hard Data Consistency
di: Song, Bowen, et al.
Pubblicazione: (2023)
di: Song, Bowen, et al.
Pubblicazione: (2023)
FluxSpace: Disentangled Semantic Editing in Rectified Flow Transformers
di: Dalva, Yusuf, et al.
Pubblicazione: (2024)
di: Dalva, Yusuf, et al.
Pubblicazione: (2024)
Plot'n Polish: Zero-shot Story Visualization and Disentangled Editing with Text-to-Image Diffusion Models
di: Akdemir, Kiymet, et al.
Pubblicazione: (2025)
di: Akdemir, Kiymet, et al.
Pubblicazione: (2025)
DiffusionBlend: Learning 3D Image Prior through Position-aware Diffusion Score Blending for 3D Computed Tomography Reconstruction
di: Song, Bowen, et al.
Pubblicazione: (2024)
di: Song, Bowen, et al.
Pubblicazione: (2024)
Zero-shot Image Editing with Reference Imitation
di: Chen, Xi, et al.
Pubblicazione: (2024)
di: Chen, Xi, et al.
Pubblicazione: (2024)
SeqBench: Benchmarking Sequential Narrative Generation in Text-to-Video Models
di: Tang, Zhengxu, et al.
Pubblicazione: (2025)
di: Tang, Zhengxu, et al.
Pubblicazione: (2025)
CoSIGN: Few-Step Guidance of ConSIstency Model to Solve General INverse Problems
di: Zhao, Jiankun, et al.
Pubblicazione: (2024)
di: Zhao, Jiankun, et al.
Pubblicazione: (2024)
Learning Image Priors through Patch-based Diffusion Models for Solving Inverse Problems
di: Hu, Jason, et al.
Pubblicazione: (2024)
di: Hu, Jason, et al.
Pubblicazione: (2024)
LORE: Latent Optimization for Precise Semantic Control in Rectified Flow-based Image Editing
di: Ouyang, Liangyang, et al.
Pubblicazione: (2025)
di: Ouyang, Liangyang, et al.
Pubblicazione: (2025)
Latent Diffusion Inversion Requires Understanding the Latent Space
di: Rao, Mingxing, et al.
Pubblicazione: (2025)
di: Rao, Mingxing, et al.
Pubblicazione: (2025)
DisControlFace: Adding Disentangled Control to Diffusion Autoencoder for One-shot Explicit Facial Image Editing
di: Jia, Haozhe, et al.
Pubblicazione: (2023)
di: Jia, Haozhe, et al.
Pubblicazione: (2023)
Alias-Free Latent Diffusion Models: Improving Fractional Shift Equivariance of Diffusion Latent Space
di: Zhou, Yifan, et al.
Pubblicazione: (2025)
di: Zhou, Yifan, et al.
Pubblicazione: (2025)
Patch-Based Diffusion Models Beat Whole-Image Models for Mismatched Distribution Inverse Problems
di: Hu, Jason, et al.
Pubblicazione: (2024)
di: Hu, Jason, et al.
Pubblicazione: (2024)
MotionDiff: Training-free Zero-shot Interactive Motion Editing via Flow-assisted Multi-view Diffusion
di: Ma, Yikun, et al.
Pubblicazione: (2025)
di: Ma, Yikun, et al.
Pubblicazione: (2025)
Image-to-Image Translation with Disentangled Latent Vectors for Face Editing
di: Dalva, Yusuf, et al.
Pubblicazione: (2023)
di: Dalva, Yusuf, et al.
Pubblicazione: (2023)
Disentangling Instruction Influence in Diffusion Transformers for Parallel Multi-Instruction-Guided Image Editing
di: Liu, Hui, et al.
Pubblicazione: (2025)
di: Liu, Hui, et al.
Pubblicazione: (2025)
In-Context Brush: Zero-shot Customized Subject Insertion with Context-Aware Latent Space Manipulation
di: Xu, Yu, et al.
Pubblicazione: (2025)
di: Xu, Yu, et al.
Pubblicazione: (2025)
KPNDepth: Depth Estimation of Lane Images under Complex Rainy Environment
di: Shi, Zhengxu
Pubblicazione: (2024)
di: Shi, Zhengxu
Pubblicazione: (2024)
Exploring Iterative Manifold Constraint for Zero-shot Image Editing
di: Li, Maomao, et al.
Pubblicazione: (2025)
di: Li, Maomao, et al.
Pubblicazione: (2025)
Isometric Representation Learning for Disentangled Latent Space of Diffusion Models
di: Hahm, Jaehoon, et al.
Pubblicazione: (2024)
di: Hahm, Jaehoon, et al.
Pubblicazione: (2024)
Boosting Latent Diffusion Models via Disentangled Representation Alignment
di: Page, John, et al.
Pubblicazione: (2026)
di: Page, John, et al.
Pubblicazione: (2026)
Part-aware Prompted Segment Anything Model for Adaptive Segmentation
di: Zhao, Chenhui, et al.
Pubblicazione: (2024)
di: Zhao, Chenhui, et al.
Pubblicazione: (2024)
HairDiffusion: Vivid Multi-Colored Hair Editing via Latent Diffusion
di: Zeng, Yu, et al.
Pubblicazione: (2024)
di: Zeng, Yu, et al.
Pubblicazione: (2024)
Couple to Control: Joint Initial Noise Design in Diffusion Models
di: Jia, Jing, et al.
Pubblicazione: (2026)
di: Jia, Jing, et al.
Pubblicazione: (2026)
LatentEdit: Adaptive Latent Control for Consistent Semantic Editing
di: Liu, Siyi, et al.
Pubblicazione: (2025)
di: Liu, Siyi, et al.
Pubblicazione: (2025)
Graph-guided Cross-composition Feature Disentanglement for Compositional Zero-shot Learning
di: Geng, Yuxia, et al.
Pubblicazione: (2024)
di: Geng, Yuxia, et al.
Pubblicazione: (2024)
PixPerfect: Seamless Latent Diffusion Local Editing with Discriminative Pixel-Space Refinement
di: Zheng, Haitian, et al.
Pubblicazione: (2025)
di: Zheng, Haitian, et al.
Pubblicazione: (2025)
D$^4$M: Dataset Distillation via Disentangled Diffusion Model
di: Su, Duo, et al.
Pubblicazione: (2024)
di: Su, Duo, et al.
Pubblicazione: (2024)
EVA: Zero-shot Accurate Attributes and Multi-Object Video Editing
di: Yang, Xiangpeng, et al.
Pubblicazione: (2024)
di: Yang, Xiangpeng, et al.
Pubblicazione: (2024)
Zero-shot Face Editing via ID-Attribute Decoupled Inversion
di: Hou, Yang, et al.
Pubblicazione: (2025)
di: Hou, Yang, et al.
Pubblicazione: (2025)
FlashEdit: Decoupling Speed, Structure, and Semantics for Precise Image Editing
di: Wu, Junyi, et al.
Pubblicazione: (2025)
di: Wu, Junyi, et al.
Pubblicazione: (2025)
Sissi: Zero-shot Style-guided Image Synthesis via Semantic-style Integration
di: Deng, Yingying, et al.
Pubblicazione: (2026)
di: Deng, Yingying, et al.
Pubblicazione: (2026)
Unleashing the Potential of the Semantic Latent Space in Diffusion Models for Image Dehazing
di: Yang, Zizheng, et al.
Pubblicazione: (2025)
di: Yang, Zizheng, et al.
Pubblicazione: (2025)
Split Matching for Inductive Zero-shot Semantic Segmentation
di: Chen, Jialei, et al.
Pubblicazione: (2025)
di: Chen, Jialei, et al.
Pubblicazione: (2025)
Prioritized Semantic Learning for Zero-shot Instance Navigation
di: Sun, Xinyu, et al.
Pubblicazione: (2024)
di: Sun, Xinyu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Latent Space Disentanglement in Diffusion Transformers Enables Zero-shot Fine-grained Semantic Editing
di: Shuai, Zitao, et al.
Pubblicazione: (2024) -
Distributionally Robust Alignment for Medical Federated Vision-Language Pre-training Under Data Heterogeneity
di: Shuai, Zitao, et al.
Pubblicazione: (2024) -
Efficient In-Context Medical Segmentation with Meta-driven Visual Prompt Selection
di: Wu, Chenwei, et al.
Pubblicazione: (2024) -
SatDiffMoE: A Mixture of Estimation Method for Satellite Image Super-resolution with Latent Diffusion Models
di: Luo, Zhaoxu, et al.
Pubblicazione: (2024) -
Nodule-Aligned Latent Space Learning with LLM-Driven Multimodal Diffusion for Lung Nodule Progression Prediction
di: Song, James, et al.
Pubblicazione: (2026)