Object-Conditioned Energy-Based Attention Map Alignment in Text-to-Image Diffusion Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yasi, Yu, Peiyu, Wu, Ying Nian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Unlocking the Potential of Text-to-Image Diffusion with PAC-Bayesian Theory
di: Jiang, Eric Hanchen, et al.
Pubblicazione: (2024)
di: Jiang, Eric Hanchen, et al.
Pubblicazione: (2024)
Flow Priors for Linear Inverse Problems via Iterative Corrupted Trajectory Matching
di: Zhang, Yasi, et al.
Pubblicazione: (2024)
di: Zhang, Yasi, et al.
Pubblicazione: (2024)
Personalized Safety Alignment for Text-to-Image Diffusion Models
di: Lei, Yu, et al.
Pubblicazione: (2025)
di: Lei, Yu, et al.
Pubblicazione: (2025)
MTADiffusion: Mask Text Alignment Diffusion Model for Object Inpainting
di: Huang, Jun, et al.
Pubblicazione: (2025)
di: Huang, Jun, et al.
Pubblicazione: (2025)
Text-Anchored Score Composition: Tackling Condition Misalignment in Text-to-Image Diffusion Models
di: Wang, Luozhou, et al.
Pubblicazione: (2023)
di: Wang, Luozhou, et al.
Pubblicazione: (2023)
Denoising Score Distillation: From Noisy Diffusion Pretraining to One-Step High-Quality Generation
di: Chen, Tianyu, et al.
Pubblicazione: (2025)
di: Chen, Tianyu, et al.
Pubblicazione: (2025)
Local Conditional Controlling for Text-to-Image Diffusion Models
di: Zhao, Yibo, et al.
Pubblicazione: (2023)
di: Zhao, Yibo, et al.
Pubblicazione: (2023)
BideDPO: Conditional Image Generation with Simultaneous Text and Condition Alignment
di: Zhou, Dewei, et al.
Pubblicazione: (2025)
di: Zhou, Dewei, et al.
Pubblicazione: (2025)
Predicated Diffusion: Predicate Logic-Based Attention Guidance for Text-to-Image Diffusion Models
di: Sueyoshi, Kota, et al.
Pubblicazione: (2023)
di: Sueyoshi, Kota, et al.
Pubblicazione: (2023)
MT-EditFlow: Reinforcement Learning for Multi-Turn Image Editing with Flow Matching
di: Huang, Jiahui, et al.
Pubblicazione: (2026)
di: Huang, Jiahui, et al.
Pubblicazione: (2026)
Text Embedding is Not All You Need: Attention Control for Text-to-Image Semantic Alignment with Text Self-Attention Maps
di: Kim, Jeeyung, et al.
Pubblicazione: (2024)
di: Kim, Jeeyung, et al.
Pubblicazione: (2024)
From Text to Mask: Localizing Entities Using the Attention of Text-to-Image Diffusion Models
di: Xiao, Changming, et al.
Pubblicazione: (2023)
di: Xiao, Changming, et al.
Pubblicazione: (2023)
Dynamic Attention Analysis for Backdoor Detection in Text-to-Image Diffusion Models
di: Wang, Zhongqi, et al.
Pubblicazione: (2025)
di: Wang, Zhongqi, et al.
Pubblicazione: (2025)
VMix: Improving Text-to-Image Diffusion Model with Cross-Attention Mixing Control
di: Wu, Shaojin, et al.
Pubblicazione: (2024)
di: Wu, Shaojin, et al.
Pubblicazione: (2024)
Leveraging Text-to-Image Diffusion Models for Unsupervised Visual Object Tracking
di: Zhang, Zhengbo, et al.
Pubblicazione: (2026)
di: Zhang, Zhengbo, et al.
Pubblicazione: (2026)
Skews in the Phenomenon Space Hinder Generalization in Text-to-Image Generation
di: Chang, Yingshan, et al.
Pubblicazione: (2024)
di: Chang, Yingshan, et al.
Pubblicazione: (2024)
Temporal-Conditional Referring Video Object Segmentation with Noise-Free Text-to-Video Diffusion Model
di: Zhang, Ruixin, et al.
Pubblicazione: (2025)
di: Zhang, Ruixin, et al.
Pubblicazione: (2025)
LAIP: Learning Local Alignment from Image-Phrase Modeling for Text-based Person Search
di: Wang, Haiguang, et al.
Pubblicazione: (2024)
di: Wang, Haiguang, et al.
Pubblicazione: (2024)
Designing Instance-Level Sampling Schedules via REINFORCE with James-Stein Shrinkage
di: Yu, Peiyu, et al.
Pubblicazione: (2025)
di: Yu, Peiyu, et al.
Pubblicazione: (2025)
Customizing Text-to-Image Diffusion with Object Viewpoint Control
di: Kumari, Nupur, et al.
Pubblicazione: (2024)
di: Kumari, Nupur, et al.
Pubblicazione: (2024)
Injecting Image Guidance into Text-Conditioned Diffusion Models at Inference
di: Żywot, Agata, et al.
Pubblicazione: (2026)
di: Żywot, Agata, et al.
Pubblicazione: (2026)
Enhancing Semantic Fidelity in Text-to-Image Synthesis: Attention Regulation in Diffusion Models
di: Zhang, Yang, et al.
Pubblicazione: (2024)
di: Zhang, Yang, et al.
Pubblicazione: (2024)
Selective Hourglass Mapping for Universal Image Restoration Based on Diffusion Model
di: Zheng, Dian, et al.
Pubblicazione: (2024)
di: Zheng, Dian, et al.
Pubblicazione: (2024)
CountCluster: Training-Free Object Quantity Guidance with Cross-Attention Map Clustering for Text-to-Image Generation
di: Lee, Joohyeon, et al.
Pubblicazione: (2025)
di: Lee, Joohyeon, et al.
Pubblicazione: (2025)
Debiasing Text-to-Image Diffusion Models
di: He, Ruifei, et al.
Pubblicazione: (2024)
di: He, Ruifei, et al.
Pubblicazione: (2024)
Enhancing Reward Models for High-quality Image Generation: Beyond Text-Image Alignment
di: Ba, Ying, et al.
Pubblicazione: (2025)
di: Ba, Ying, et al.
Pubblicazione: (2025)
Diffusion in Diffusion: Cyclic One-Way Diffusion for Text-Vision-Conditioned Generation
di: Wang, Ruoyu, et al.
Pubblicazione: (2023)
di: Wang, Ruoyu, et al.
Pubblicazione: (2023)
Linguistic Binding in Diffusion Models: Enhancing Attribute Correspondence through Attention Map Alignment
di: Rassin, Royi, et al.
Pubblicazione: (2023)
di: Rassin, Royi, et al.
Pubblicazione: (2023)
Test-time Conditional Text-to-Image Synthesis Using Diffusion Models
di: Shukla, Tripti, et al.
Pubblicazione: (2024)
di: Shukla, Tripti, et al.
Pubblicazione: (2024)
Hierarchical Vision-Language Alignment for Text-to-Image Generation via Diffusion Models
di: Johnson, Emily, et al.
Pubblicazione: (2025)
di: Johnson, Emily, et al.
Pubblicazione: (2025)
Enhancing Text-to-Image Diffusion Transformer via Split-Text Conditioning
di: Zhang, Yu, et al.
Pubblicazione: (2025)
di: Zhang, Yu, et al.
Pubblicazione: (2025)
Instant Preference Alignment for Text-to-Image Diffusion Models
di: Li, Yang, et al.
Pubblicazione: (2025)
di: Li, Yang, et al.
Pubblicazione: (2025)
Boosting Text-to-Image Diffusion Models via Core Token Attention-Based Seed Selection
di: Zhang, Yunzhe, et al.
Pubblicazione: (2026)
di: Zhang, Yunzhe, et al.
Pubblicazione: (2026)
Improving Long-Text Alignment for Text-to-Image Diffusion Models
di: Liu, Luping, et al.
Pubblicazione: (2024)
di: Liu, Luping, et al.
Pubblicazione: (2024)
Learning Concept-Based Causal Transition and Symbolic Reasoning for Visual Planning
di: Qian, Yilue, et al.
Pubblicazione: (2023)
di: Qian, Yilue, et al.
Pubblicazione: (2023)
Learning Geodesics of Geometric Shape Deformations From Images
di: Wu, Nian, et al.
Pubblicazione: (2024)
di: Wu, Nian, et al.
Pubblicazione: (2024)
Text-to-Image Alignment in Denoising-Based Models through Step Selection
di: Grimal, Paul, et al.
Pubblicazione: (2025)
di: Grimal, Paul, et al.
Pubblicazione: (2025)
Visual Concept-driven Image Generation with Text-to-Image Diffusion Model
di: Rahman, Tanzila, et al.
Pubblicazione: (2024)
di: Rahman, Tanzila, et al.
Pubblicazione: (2024)
Energy-Guided Optimization for Personalized Image Editing with Pretrained Text-to-Image Diffusion Models
di: Jiang, Rui, et al.
Pubblicazione: (2025)
di: Jiang, Rui, et al.
Pubblicazione: (2025)
ELBO-T2IAlign: A Generic ELBO-Based Method for Calibrating Pixel-level Text-Image Alignment in Diffusion Models
di: Zhou, Qin, et al.
Pubblicazione: (2025)
di: Zhou, Qin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Unlocking the Potential of Text-to-Image Diffusion with PAC-Bayesian Theory
di: Jiang, Eric Hanchen, et al.
Pubblicazione: (2024) -
Flow Priors for Linear Inverse Problems via Iterative Corrupted Trajectory Matching
di: Zhang, Yasi, et al.
Pubblicazione: (2024) -
Personalized Safety Alignment for Text-to-Image Diffusion Models
di: Lei, Yu, et al.
Pubblicazione: (2025) -
MTADiffusion: Mask Text Alignment Diffusion Model for Object Inpainting
di: Huang, Jun, et al.
Pubblicazione: (2025) -
Text-Anchored Score Composition: Tackling Condition Misalignment in Text-to-Image Diffusion Models
di: Wang, Luozhou, et al.
Pubblicazione: (2023)