E4C: Enhance Editability for Text-Based Image Editing by Harnessing Efficient CLIP Guidance
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Tianrui, Cao, Pu, Yang, Lu, Liu, Chun, Hu, Mengjie, Liu, Zhiwei, Song, Qing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Image is All You Need to Empower Large-scale Diffusion Models for In-Domain Generation
di: Cao, Pu, et al.
Pubblicazione: (2023)
di: Cao, Pu, et al.
Pubblicazione: (2023)
Are Watermarked Images Editable? SafeMark for Watermark-Preserving Text-Guided Image Editing
di: Wu, Xiaodong, et al.
Pubblicazione: (2026)
di: Wu, Xiaodong, et al.
Pubblicazione: (2026)
LSAP: Rethinking Inversion Fidelity, Perception and Editability in GAN Latent Space
di: Zhao, Xuekun, et al.
Pubblicazione: (2022)
di: Zhao, Xuekun, et al.
Pubblicazione: (2022)
Controllable Generation with Text-to-Image Diffusion Models: A Survey
di: Cao, Pu, et al.
Pubblicazione: (2024)
di: Cao, Pu, et al.
Pubblicazione: (2024)
Unified Diffusion-Based Rigid and Non-Rigid Editing with Text and Image Guidance
di: Wang, Jiacheng, et al.
Pubblicazione: (2024)
di: Wang, Jiacheng, et al.
Pubblicazione: (2024)
From Competition to Coopetition: Coopetitive Training-Free Image Editing Based on Text Guidance
di: Shen, Jinhao, et al.
Pubblicazione: (2026)
di: Shen, Jinhao, et al.
Pubblicazione: (2026)
Group Relative Attention Guidance for Image Editing
di: Zhang, Xuanpu, et al.
Pubblicazione: (2025)
di: Zhang, Xuanpu, et al.
Pubblicazione: (2025)
Enhancing Multimodal Understanding with CLIP-Based Image-to-Text Transformation
di: Che, Chang, et al.
Pubblicazione: (2024)
di: Che, Chang, et al.
Pubblicazione: (2024)
Multi-Perspective Subimage CLIP with Keyword Guidance for Remote Sensing Image-Text Retrieval
di: Li, Yifan, et al.
Pubblicazione: (2026)
di: Li, Yifan, et al.
Pubblicazione: (2026)
DreamMix: Decoupling Object Attributes for Enhanced Editability in Customized Image Inpainting
di: Yang, Yicheng, et al.
Pubblicazione: (2024)
di: Yang, Yicheng, et al.
Pubblicazione: (2024)
A Unified Neural Codec Language Model for Selective Editable Text to Speech Generation
di: Pei, Hanchen, et al.
Pubblicazione: (2026)
di: Pei, Hanchen, et al.
Pubblicazione: (2026)
SwinTextUNet: Integrating CLIP-Based Text Guidance into Swin Transformer U-Nets for Medical Image Segmentation
di: Yeafi, Ashfak, et al.
Pubblicazione: (2026)
di: Yeafi, Ashfak, et al.
Pubblicazione: (2026)
Total-Editing: Head Avatar with Editable Appearance, Motion, and Lighting
di: Zhao, Yizhou, et al.
Pubblicazione: (2025)
di: Zhao, Yizhou, et al.
Pubblicazione: (2025)
Text Prompt with Normality Guidance for Weakly Supervised Video Anomaly Detection
di: Yang, Zhiwei, et al.
Pubblicazione: (2024)
di: Yang, Zhiwei, et al.
Pubblicazione: (2024)
DiCLIP: Diffusion Model Enhances CLIP's Dense Knowledge for Weakly Supervised Semantic Segmentation
di: Yang, Zhiwei, et al.
Pubblicazione: (2026)
di: Yang, Zhiwei, et al.
Pubblicazione: (2026)
$E^{3}$Gen: Efficient, Expressive and Editable Avatars Generation
di: Zhang, Weitian, et al.
Pubblicazione: (2024)
di: Zhang, Weitian, et al.
Pubblicazione: (2024)
Harnessing Caption Detailness for Data-Efficient Text-to-Image Generation
di: Wang, Xinran, et al.
Pubblicazione: (2025)
di: Wang, Xinran, et al.
Pubblicazione: (2025)
Towards Understanding Cross and Self-Attention in Stable Diffusion for Text-Guided Image Editing
di: Liu, Bingyan, et al.
Pubblicazione: (2024)
di: Liu, Bingyan, et al.
Pubblicazione: (2024)
Tuning-Free Image Editing with Fidelity and Editability via Unified Latent Diffusion Model
di: Mao, Qi, et al.
Pubblicazione: (2025)
di: Mao, Qi, et al.
Pubblicazione: (2025)
ToxicTextCLIP: Text-Based Poisoning and Backdoor Attacks on CLIP Pre-training
di: Yao, Xin, et al.
Pubblicazione: (2025)
di: Yao, Xin, et al.
Pubblicazione: (2025)
EditCLIP: Representation Learning for Image Editing
di: Wang, Qian, et al.
Pubblicazione: (2025)
di: Wang, Qian, et al.
Pubblicazione: (2025)
3D Space as a Scratchpad for Editable Text-to-Image Generation
di: Saha, Oindrila, et al.
Pubblicazione: (2026)
di: Saha, Oindrila, et al.
Pubblicazione: (2026)
Diffusion Model-Based Image Editing: A Survey
di: Huang, Yi, et al.
Pubblicazione: (2024)
di: Huang, Yi, et al.
Pubblicazione: (2024)
Backdoor Attack on Unpaired Medical Image-Text Foundation Models: A Pilot Study on MedCLIP
di: Jin, Ruinan, et al.
Pubblicazione: (2024)
di: Jin, Ruinan, et al.
Pubblicazione: (2024)
MADiff: Text-Guided Fashion Image Editing with Mask Prediction and Attention-Enhanced Diffusion
di: Zhan, Zechao, et al.
Pubblicazione: (2024)
di: Zhan, Zechao, et al.
Pubblicazione: (2024)
RATLIP: Generative Adversarial CLIP Text-to-Image Synthesis Based on Recurrent Affine Transformations
di: Lin, Chengde, et al.
Pubblicazione: (2024)
di: Lin, Chengde, et al.
Pubblicazione: (2024)
Text-to-Image Generation Via Energy-Based CLIP
di: Ganz, Roy, et al.
Pubblicazione: (2024)
di: Ganz, Roy, et al.
Pubblicazione: (2024)
Large Language Model Enhanced Hard Sample Identification for Denoising Recommendation
di: Song, Tianrui, et al.
Pubblicazione: (2024)
di: Song, Tianrui, et al.
Pubblicazione: (2024)
MetaKE: Meta-Learning for Knowledge Editing Toward a Better Accuracy-Editability Trade-off
di: Liu, Shuxin, et al.
Pubblicazione: (2026)
di: Liu, Shuxin, et al.
Pubblicazione: (2026)
HARIVO: Harnessing Text-to-Image Models for Video Generation
di: Kwon, Mingi, et al.
Pubblicazione: (2024)
di: Kwon, Mingi, et al.
Pubblicazione: (2024)
Commonsense Knowledge Editing Based on Free-Text in LLMs
di: Huang, Xiusheng, et al.
Pubblicazione: (2024)
di: Huang, Xiusheng, et al.
Pubblicazione: (2024)
CEIA: CLIP-Based Event-Image Alignment for Open-World Event-Based Understanding
di: Xu, Wenhao, et al.
Pubblicazione: (2024)
di: Xu, Wenhao, et al.
Pubblicazione: (2024)
TexSliders: Diffusion-Based Texture Editing in CLIP Space
di: Guerrero-Viu, Julia, et al.
Pubblicazione: (2024)
di: Guerrero-Viu, Julia, et al.
Pubblicazione: (2024)
FairCLIP: Harnessing Fairness in Vision-Language Learning
di: Luo, Yan, et al.
Pubblicazione: (2024)
di: Luo, Yan, et al.
Pubblicazione: (2024)
LGCC: Enhancing Flow Matching Based Text-Guided Image Editing with Local Gaussian Coupling and Context Consistency
di: Liu, Fangbing, et al.
Pubblicazione: (2025)
di: Liu, Fangbing, et al.
Pubblicazione: (2025)
MasterWeaver: Taming Editability and Face Identity for Personalized Text-to-Image Generation
di: Wei, Yuxiang, et al.
Pubblicazione: (2024)
di: Wei, Yuxiang, et al.
Pubblicazione: (2024)
EditID: Training-Free Editable ID Customization for Text-to-Image Generation
di: Li, Guandong, et al.
Pubblicazione: (2025)
di: Li, Guandong, et al.
Pubblicazione: (2025)
Mind the Gap: Preserving and Compensating for the Modality Gap in CLIP-Based Continual Learning
di: Huang, Linlan, et al.
Pubblicazione: (2025)
di: Huang, Linlan, et al.
Pubblicazione: (2025)
VAGS: Velocity Adaptive Guidance Scale for Image Editing and Generation
di: Luo, Yan, et al.
Pubblicazione: (2026)
di: Luo, Yan, et al.
Pubblicazione: (2026)
Decoupling Template Bias in CLIP: Harnessing Empty Prompts for Enhanced Few-Shot Learning
di: Zhang, Zhenyu, et al.
Pubblicazione: (2025)
di: Zhang, Zhenyu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Image is All You Need to Empower Large-scale Diffusion Models for In-Domain Generation
di: Cao, Pu, et al.
Pubblicazione: (2023) -
Are Watermarked Images Editable? SafeMark for Watermark-Preserving Text-Guided Image Editing
di: Wu, Xiaodong, et al.
Pubblicazione: (2026) -
LSAP: Rethinking Inversion Fidelity, Perception and Editability in GAN Latent Space
di: Zhao, Xuekun, et al.
Pubblicazione: (2022) -
Controllable Generation with Text-to-Image Diffusion Models: A Survey
di: Cao, Pu, et al.
Pubblicazione: (2024) -
Unified Diffusion-Based Rigid and Non-Rigid Editing with Text and Image Guidance
di: Wang, Jiacheng, et al.
Pubblicazione: (2024)