The Curious Case of End Token: A Zero-Shot Disentangled Image Editing using CLIP
Fuente:
arXiv
Salvato in:
| Autori principali: | Yesiltepe, Hidir, Dalva, Yusuf, Yanardag, Pinar |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GANTASTIC: GAN-based Transfer of Interpretable Directions for Disentangled Image Editing in Text-to-Image Diffusion Models
di: Dalva, Yusuf, et al.
Pubblicazione: (2024)
di: Dalva, Yusuf, et al.
Pubblicazione: (2024)
LoRAShop: Training-Free Multi-Concept Image Generation and Editing with Rectified Flow Transformers
di: Dalva, Yusuf, et al.
Pubblicazione: (2025)
di: Dalva, Yusuf, et al.
Pubblicazione: (2025)
MIST: Mitigating Intersectional Bias with Disentangled Cross-Attention Editing in Text-to-Image Diffusion Models
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2024)
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2024)
Dynamic View Synthesis as an Inverse Problem
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2025)
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2025)
FluxSpace: Disentangled Semantic Editing in Rectified Flow Transformers
di: Dalva, Yusuf, et al.
Pubblicazione: (2024)
di: Dalva, Yusuf, et al.
Pubblicazione: (2024)
MotionShop: Zero-Shot Motion Transfer in Video Diffusion Models with Mixture of Score Guidance
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2024)
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2024)
AdaState: Self-Evolving Anchors for Streaming Video Generation
di: Dalva, Yusuf, et al.
Pubblicazione: (2026)
di: Dalva, Yusuf, et al.
Pubblicazione: (2026)
Stylebreeder: Exploring and Democratizing Artistic Styles through Text-to-Image Models
di: Zheng, Matthew, et al.
Pubblicazione: (2024)
di: Zheng, Matthew, et al.
Pubblicazione: (2024)
RAVEL: Rare Concept Generation and Editing via Graph-driven Relational Guidance
di: Venkatesh, Kavana, et al.
Pubblicazione: (2024)
di: Venkatesh, Kavana, et al.
Pubblicazione: (2024)
MotionFlow: Attention-Driven Motion Transfer in Video Diffusion Models
di: Meral, Tuna Han Salih, et al.
Pubblicazione: (2024)
di: Meral, Tuna Han Salih, et al.
Pubblicazione: (2024)
Aligning Latent Geometry for Spherical Flow Matching in Image Generation
di: Meral, Tuna Han Salih, et al.
Pubblicazione: (2026)
di: Meral, Tuna Han Salih, et al.
Pubblicazione: (2026)
Infinity-RoPE: Action-Controllable Infinite Video Generation Emerges From Autoregressive Self-Rollout
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2025)
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2025)
DTG-Restore: Training-Free Diffusion Refinement for Generative Video Super-Resolution
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2026)
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2026)
Plot'n Polish: Zero-shot Story Visualization and Disentangled Editing with Text-to-Image Diffusion Models
di: Akdemir, Kiymet, et al.
Pubblicazione: (2025)
di: Akdemir, Kiymet, et al.
Pubblicazione: (2025)
CREA: A Collaborative Multi-Agent Framework for Creative Image Editing and Generation
di: Venkatesh, Kavana, et al.
Pubblicazione: (2025)
di: Venkatesh, Kavana, et al.
Pubblicazione: (2025)
Image-to-Image Translation with Disentangled Latent Vectors for Face Editing
di: Dalva, Yusuf, et al.
Pubblicazione: (2023)
di: Dalva, Yusuf, et al.
Pubblicazione: (2023)
LayerFusion: Harmonized Multi-Layer Text-to-Image Generation with Generative Priors
di: Dalva, Yusuf, et al.
Pubblicazione: (2024)
di: Dalva, Yusuf, et al.
Pubblicazione: (2024)
From Zero to Hero: Training-Free Custom Concept Spawning in World Models
di: Akdemir, Kiymet, et al.
Pubblicazione: (2026)
di: Akdemir, Kiymet, et al.
Pubblicazione: (2026)
VideoMLA: Low-Rank Latent KV Cache for Minute-Scale Autoregressive Video Diffusion
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2026)
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2026)
Personalized Image Editing in Text-to-Image Diffusion Models via Collaborative Direct Preference Optimization
di: Dunlop, Connor, et al.
Pubblicazione: (2025)
di: Dunlop, Connor, et al.
Pubblicazione: (2025)
Canvas-to-Image: Compositional Image Generation with Multimodal Controls
di: Dalva, Yusuf, et al.
Pubblicazione: (2025)
di: Dalva, Yusuf, et al.
Pubblicazione: (2025)
Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models
di: Akdemir, Kiymet, et al.
Pubblicazione: (2025)
di: Akdemir, Kiymet, et al.
Pubblicazione: (2025)
Explaining in Diffusion: Explaining a Classifier Through Hierarchical Semantics with Text-to-Image Diffusion Models
di: Kazimi, Tahira, et al.
Pubblicazione: (2024)
di: Kazimi, Tahira, et al.
Pubblicazione: (2024)
ORACLE: Leveraging Mutual Information for Consistent Character Generation with LoRAs in Diffusion Models
di: Akdemir, Kiymet, et al.
Pubblicazione: (2024)
di: Akdemir, Kiymet, et al.
Pubblicazione: (2024)
LoRAverse: A Submodular Framework to Retrieve Diverse Adapters for Diffusion Models
di: Sonmezer, Mert, et al.
Pubblicazione: (2025)
di: Sonmezer, Mert, et al.
Pubblicazione: (2025)
Diverse Video Generation with Determinantal Point Process-Guided Policy Optimization
di: Kazimi, Tahira, et al.
Pubblicazione: (2025)
di: Kazimi, Tahira, et al.
Pubblicazione: (2025)
Dual-Image Enhanced CLIP for Zero-Shot Anomaly Detection
di: Zhang, Zhaoxiang, et al.
Pubblicazione: (2024)
di: Zhang, Zhaoxiang, et al.
Pubblicazione: (2024)
CLIP-Decoder : ZeroShot Multilabel Classification using Multimodal CLIP Aligned Representation
di: Ali, Muhammad, et al.
Pubblicazione: (2024)
di: Ali, Muhammad, et al.
Pubblicazione: (2024)
FB-CLIP: Fine-Grained Zero-Shot Anomaly Detection with Foreground-Background Disentanglement
di: Hu, Ming, et al.
Pubblicazione: (2026)
di: Hu, Ming, et al.
Pubblicazione: (2026)
LoRACLR: Contrastive Adaptation for Customization of Diffusion Models
di: Simsar, Enis, et al.
Pubblicazione: (2024)
di: Simsar, Enis, et al.
Pubblicazione: (2024)
Interpreting and Analysing CLIP's Zero-Shot Image Classification via Mutual Knowledge
di: Sammani, Fawaz, et al.
Pubblicazione: (2024)
di: Sammani, Fawaz, et al.
Pubblicazione: (2024)
FairerCLIP: Debiasing CLIP's Zero-Shot Predictions using Functions in RKHSs
di: Dehdashtian, Sepehr, et al.
Pubblicazione: (2024)
di: Dehdashtian, Sepehr, et al.
Pubblicazione: (2024)
Transductive Zero-Shot and Few-Shot CLIP
di: Martin, Ségolène, et al.
Pubblicazione: (2024)
di: Martin, Ségolène, et al.
Pubblicazione: (2024)
Zero-Shot Class Unlearning in CLIP with Synthetic Samples
di: Kravets, A., et al.
Pubblicazione: (2024)
di: Kravets, A., et al.
Pubblicazione: (2024)
TokenCLIP: Token-wise Prompt Learning for Zero-shot Anomaly Detection
di: Zhou, Qihang, et al.
Pubblicazione: (2025)
di: Zhou, Qihang, et al.
Pubblicazione: (2025)
CLAIR: CLIP-Aided Weakly Supervised Zero-Shot Cross-Domain Image Retrieval
di: Tan, Chor Boon, et al.
Pubblicazione: (2025)
di: Tan, Chor Boon, et al.
Pubblicazione: (2025)
AdaCLIP: Adapting CLIP with Hybrid Learnable Prompts for Zero-Shot Anomaly Detection
di: Cao, Yunkang, et al.
Pubblicazione: (2024)
di: Cao, Yunkang, et al.
Pubblicazione: (2024)
AF-CLIP: Zero-Shot Anomaly Detection via Anomaly-Focused CLIP Adaptation
di: Fang, Qingqing, et al.
Pubblicazione: (2025)
di: Fang, Qingqing, et al.
Pubblicazione: (2025)
Online Zero-Shot Classification with CLIP
di: Qian, Qi, et al.
Pubblicazione: (2024)
di: Qian, Qi, et al.
Pubblicazione: (2024)
Contrastive Test-Time Composition of Multiple LoRA Models for Image Generation
di: Meral, Tuna Han Salih, et al.
Pubblicazione: (2024)
di: Meral, Tuna Han Salih, et al.
Pubblicazione: (2024)
Documenti analoghi
-
GANTASTIC: GAN-based Transfer of Interpretable Directions for Disentangled Image Editing in Text-to-Image Diffusion Models
di: Dalva, Yusuf, et al.
Pubblicazione: (2024) -
LoRAShop: Training-Free Multi-Concept Image Generation and Editing with Rectified Flow Transformers
di: Dalva, Yusuf, et al.
Pubblicazione: (2025) -
MIST: Mitigating Intersectional Bias with Disentangled Cross-Attention Editing in Text-to-Image Diffusion Models
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2024) -
Dynamic View Synthesis as an Inverse Problem
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2025) -
FluxSpace: Disentangled Semantic Editing in Rectified Flow Transformers
di: Dalva, Yusuf, et al.
Pubblicazione: (2024)