Prompt-to-Prompt: Text-Based Image Editing Via Cross-Attention Mechanisms -- The Research of Hyperparameters and Novel Mechanisms to Enhance Existing Frameworks
Fuente:
arXiv
Salvato in:
| Autori principali: | Bieske, Linn, Lorente, Carla |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Batch-Instructed Gradient for Prompt Evolution:Systematic Prompt Optimization for Enhanced Text-to-Image Synthesis
di: Yang, Xinrui, et al.
Pubblicazione: (2024)
di: Yang, Xinrui, et al.
Pubblicazione: (2024)
LOCATEdit: Graph Laplacian Optimized Cross Attention for Localized Text-Guided Image Editing
di: Soni, Achint, et al.
Pubblicazione: (2025)
di: Soni, Achint, et al.
Pubblicazione: (2025)
Dynamic Prompt Optimizing for Text-to-Image Generation
di: Mo, Wenyi, et al.
Pubblicazione: (2024)
di: Mo, Wenyi, et al.
Pubblicazione: (2024)
Reinforcement Learning-Based Prompt Template Stealing for Text-to-Image Models
di: Zou, Xiaotian
Pubblicazione: (2025)
di: Zou, Xiaotian
Pubblicazione: (2025)
Hierarchical Prompt Learning for Image- and Text-Based Person Re-Identification
di: Zhou, Linhan, et al.
Pubblicazione: (2025)
di: Zhou, Linhan, et al.
Pubblicazione: (2025)
Attention Prompting on Image for Large Vision-Language Models
di: Yu, Runpeng, et al.
Pubblicazione: (2024)
di: Yu, Runpeng, et al.
Pubblicazione: (2024)
An Ensemble Model with Attention Based Mechanism for Image Captioning
di: Badarneh, Israa Al, et al.
Pubblicazione: (2025)
di: Badarneh, Israa Al, et al.
Pubblicazione: (2025)
PromptGuard: An Orchestrated Prompting Framework for Principled Synthetic Text Generation for Vulnerable Populations using LLMs with Enhanced Safety, Fairness, and Controllability
di: Vu, Tung, et al.
Pubblicazione: (2025)
di: Vu, Tung, et al.
Pubblicazione: (2025)
Prompt Decoupling for Text-to-Image Person Re-identification
di: Li, Weihao, et al.
Pubblicazione: (2024)
di: Li, Weihao, et al.
Pubblicazione: (2024)
Textual and Visual Prompt Fusion for Image Editing via Step-Wise Alignment
di: Feng, Zhanbo, et al.
Pubblicazione: (2023)
di: Feng, Zhanbo, et al.
Pubblicazione: (2023)
Prompt Mechanisms in Medical Imaging: A Comprehensive Survey
di: Yang, Hao, et al.
Pubblicazione: (2025)
di: Yang, Hao, et al.
Pubblicazione: (2025)
Reverse Prompt: Cracking the Recipe Inside Text-to-Image Generation
di: Ren, Zhiyao, et al.
Pubblicazione: (2025)
di: Ren, Zhiyao, et al.
Pubblicazione: (2025)
Long-Text-to-Image Generation via Compositional Prompt Decomposition
di: Huang, Jen-Yuan, et al.
Pubblicazione: (2026)
di: Huang, Jen-Yuan, et al.
Pubblicazione: (2026)
Memory-Inspired Temporal Prompt Interaction for Text-Image Classification
di: Yu, Xinyao, et al.
Pubblicazione: (2024)
di: Yu, Xinyao, et al.
Pubblicazione: (2024)
PromptForge-350k: A Large-Scale Dataset and Contrastive Framework for Prompt-Based AI Image Forgery Localization
di: Wang, Jianpeng, et al.
Pubblicazione: (2026)
di: Wang, Jianpeng, et al.
Pubblicazione: (2026)
Region Prompt Tuning: Fine-grained Scene Text Detection Utilizing Region Text Prompt
di: Lin, Xingtao, et al.
Pubblicazione: (2024)
di: Lin, Xingtao, et al.
Pubblicazione: (2024)
Optimizing Negative Prompts for Enhanced Aesthetics and Fidelity in Text-To-Image Generation
di: Ogezi, Michael, et al.
Pubblicazione: (2024)
di: Ogezi, Michael, et al.
Pubblicazione: (2024)
A User-Friendly Framework for Generating Model-Preferred Prompts in Text-to-Image Synthesis
di: Hei, Nailei, et al.
Pubblicazione: (2024)
di: Hei, Nailei, et al.
Pubblicazione: (2024)
FairQueue: Rethinking Prompt Learning for Fair Text-to-Image Generation
di: Teo, Christopher T. H, et al.
Pubblicazione: (2024)
di: Teo, Christopher T. H, et al.
Pubblicazione: (2024)
Face-MakeUp: Multimodal Facial Prompts for Text-to-Image Generation
di: Dai, Dawei, et al.
Pubblicazione: (2025)
di: Dai, Dawei, et al.
Pubblicazione: (2025)
Multimodal Prompt Decoupling Attack on the Safety Filters in Text-to-Image Models
di: Peng, Xingkai, et al.
Pubblicazione: (2025)
di: Peng, Xingkai, et al.
Pubblicazione: (2025)
Guiding What Not to Generate: Automated Negative Prompting for Text-Image Alignment
di: Park, Sangha, et al.
Pubblicazione: (2025)
di: Park, Sangha, et al.
Pubblicazione: (2025)
Progressive Prompt Detailing for Improved Alignment in Text-to-Image Generative Models
di: Saichandran, Ketan Suhaas, et al.
Pubblicazione: (2025)
di: Saichandran, Ketan Suhaas, et al.
Pubblicazione: (2025)
Position: Towards Implicit Prompt For Text-To-Image Models
di: Yang, Yue, et al.
Pubblicazione: (2024)
di: Yang, Yue, et al.
Pubblicazione: (2024)
CannyEdit: Selective Canny Control and Dual-Prompt Guidance for Training-Free Image Editing
di: Xie, Weiyan, et al.
Pubblicazione: (2025)
di: Xie, Weiyan, et al.
Pubblicazione: (2025)
Efficient 3D-Aware Facial Image Editing via Attribute-Specific Prompt Learning
di: Kumar, Amandeep, et al.
Pubblicazione: (2024)
di: Kumar, Amandeep, et al.
Pubblicazione: (2024)
When the Prompt Becomes Visual: Vision-Centric Jailbreak Attacks for Large Image Editing Models
di: Hou, Jiacheng, et al.
Pubblicazione: (2026)
di: Hou, Jiacheng, et al.
Pubblicazione: (2026)
MASTER: Multimodal Segmentation with Text Prompts
di: Liu, Fuyang, et al.
Pubblicazione: (2025)
di: Liu, Fuyang, et al.
Pubblicazione: (2025)
Image Captions are Natural Prompts for Text-to-Image Models
di: Lei, Shiye, et al.
Pubblicazione: (2023)
di: Lei, Shiye, et al.
Pubblicazione: (2023)
PhyPrompt: RL-based Prompt Refinement for Physically Plausible Text-to-Video Generation
di: Wu, Shang, et al.
Pubblicazione: (2026)
di: Wu, Shang, et al.
Pubblicazione: (2026)
Culture-TRIP: Culturally-Aware Text-to-Image Generation with Iterative Prompt Refinement
di: Jeong, Suchae, et al.
Pubblicazione: (2025)
di: Jeong, Suchae, et al.
Pubblicazione: (2025)
DetailMaster: Can Your Text-to-Image Model Handle Long Prompts?
di: Jiao, Qirui, et al.
Pubblicazione: (2025)
di: Jiao, Qirui, et al.
Pubblicazione: (2025)
CVPT: Cross Visual Prompt Tuning
di: Huang, Lingyun, et al.
Pubblicazione: (2024)
di: Huang, Lingyun, et al.
Pubblicazione: (2024)
PromptGuard: Soft Prompt-Guided Unsafe Content Moderation for Text-to-Image Models
di: Yuan, Lingzhi, et al.
Pubblicazione: (2025)
di: Yuan, Lingzhi, et al.
Pubblicazione: (2025)
MULTITEXTEDIT: Benchmarking Cross-Lingual Degradation in Text-in-Image Editing
di: Cheng, Liwei, et al.
Pubblicazione: (2026)
di: Cheng, Liwei, et al.
Pubblicazione: (2026)
Enhancing Few-Shot Image Classification through Learnable Multi-Scale Embedding and Attention Mechanisms
di: Askari, Fatemeh, et al.
Pubblicazione: (2024)
di: Askari, Fatemeh, et al.
Pubblicazione: (2024)
Visual Prompting for One-shot Controllable Video Editing without Inversion
di: Zhang, Zhengbo, et al.
Pubblicazione: (2025)
di: Zhang, Zhengbo, et al.
Pubblicazione: (2025)
Adaptive Prompt Tuning: Vision Guided Prompt Tuning with Cross-Attention for Fine-Grained Few-Shot Learning
di: Brouwer, Eric, et al.
Pubblicazione: (2024)
di: Brouwer, Eric, et al.
Pubblicazione: (2024)
Towards Efficient Diffusion-Based Image Editing with Instant Attention Masks
di: Zou, Siyu, et al.
Pubblicazione: (2024)
di: Zou, Siyu, et al.
Pubblicazione: (2024)
MetaLogic: Robustness Evaluation of Text-to-Image Models via Logically Equivalent Prompts
di: Shen, Yifan, et al.
Pubblicazione: (2025)
di: Shen, Yifan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Batch-Instructed Gradient for Prompt Evolution:Systematic Prompt Optimization for Enhanced Text-to-Image Synthesis
di: Yang, Xinrui, et al.
Pubblicazione: (2024) -
LOCATEdit: Graph Laplacian Optimized Cross Attention for Localized Text-Guided Image Editing
di: Soni, Achint, et al.
Pubblicazione: (2025) -
Dynamic Prompt Optimizing for Text-to-Image Generation
di: Mo, Wenyi, et al.
Pubblicazione: (2024) -
Reinforcement Learning-Based Prompt Template Stealing for Text-to-Image Models
di: Zou, Xiaotian
Pubblicazione: (2025) -
Hierarchical Prompt Learning for Image- and Text-Based Person Re-Identification
di: Zhou, Linhan, et al.
Pubblicazione: (2025)