Repairing Catastrophic-Neglect in Text-to-Image Diffusion Models via Attention-Guided Feature Enhancement
Fuente:
arXiv
Salvato in:
| Autori principali: | Chang, Zhiyuan, Li, Mingyang, Wang, Junjie, Liu, Yi, Wang, Qing, Liu, Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Adversarial Testing for Visual Grounding via Image-Aware Property Reduction
di: Chang, Zhiyuan, et al.
Pubblicazione: (2024)
di: Chang, Zhiyuan, et al.
Pubblicazione: (2024)
AID: Attention Interpolation of Text-to-Image Diffusion
di: He, Qiyuan, et al.
Pubblicazione: (2024)
di: He, Qiyuan, et al.
Pubblicazione: (2024)
MedEBench: Diagnosing Reliability in Text-Guided Medical Image Editing
di: Liu, Minghao, et al.
Pubblicazione: (2025)
di: Liu, Minghao, et al.
Pubblicazione: (2025)
TextDiff: Mask-Guided Residual Diffusion Models for Scene Text Image Super-Resolution
di: Liu, Baolin, et al.
Pubblicazione: (2023)
di: Liu, Baolin, et al.
Pubblicazione: (2023)
Development and Enhancement of Text-to-Image Diffusion Models
di: Sahu, Rajdeep Roshan
Pubblicazione: (2025)
di: Sahu, Rajdeep Roshan
Pubblicazione: (2025)
VEglue: Testing Visual Entailment Systems via Object-Aligned Joint Erasing
di: Chang, Zhiyuan, et al.
Pubblicazione: (2024)
di: Chang, Zhiyuan, et al.
Pubblicazione: (2024)
Mitigating Catastrophic Forgetting and Mode Collapse in Text-to-Image Diffusion via Latent Replay
di: Otani, Aoi
Pubblicazione: (2025)
di: Otani, Aoi
Pubblicazione: (2025)
Origin Identification for Text-Guided Image-to-Image Diffusion Models
di: Wang, Wenhao, et al.
Pubblicazione: (2025)
di: Wang, Wenhao, et al.
Pubblicazione: (2025)
Contextualized Diffusion Models for Text-Guided Image and Video Generation
di: Yang, Ling, et al.
Pubblicazione: (2024)
di: Yang, Ling, et al.
Pubblicazione: (2024)
Enhancing Hyperspectral Images via Diffusion Model and Group-Autoencoder Super-resolution Network
di: Wang, Zhaoyang, et al.
Pubblicazione: (2024)
di: Wang, Zhaoyang, et al.
Pubblicazione: (2024)
QUSR: Quality-Aware and Uncertainty-Guided Image Super-Resolution Diffusion Model
di: Yin, Junjie, et al.
Pubblicazione: (2026)
di: Yin, Junjie, et al.
Pubblicazione: (2026)
LDEdit: Towards Generalized Text Guided Image Manipulation via Latent Diffusion Models
di: Chandramouli, Paramanand, et al.
Pubblicazione: (2022)
di: Chandramouli, Paramanand, et al.
Pubblicazione: (2022)
Uncovering the Text Embedding in Text-to-Image Diffusion Models
di: Yu, Hu, et al.
Pubblicazione: (2024)
di: Yu, Hu, et al.
Pubblicazione: (2024)
Instant Preference Alignment for Text-to-Image Diffusion Models
di: Li, Yang, et al.
Pubblicazione: (2025)
di: Li, Yang, et al.
Pubblicazione: (2025)
One Stone with Two Birds: A Null-Text-Null Frequency-Aware Diffusion Models for Text-Guided Image Inpainting
di: Liu, Haipeng, et al.
Pubblicazione: (2025)
di: Liu, Haipeng, et al.
Pubblicazione: (2025)
DH-VTON: Deep Text-Driven Virtual Try-On via Hybrid Attention Learning
di: Wei, Jiabao, et al.
Pubblicazione: (2024)
di: Wei, Jiabao, et al.
Pubblicazione: (2024)
Towards Understanding Cross and Self-Attention in Stable Diffusion for Text-Guided Image Editing
di: Liu, Bingyan, et al.
Pubblicazione: (2024)
di: Liu, Bingyan, et al.
Pubblicazione: (2024)
Enhancing Text-to-Image Diffusion Transformer via Split-Text Conditioning
di: Zhang, Yu, et al.
Pubblicazione: (2025)
di: Zhang, Yu, et al.
Pubblicazione: (2025)
Instructing Text-to-Image Diffusion Models via Classifier-Guided Semantic Optimization
di: Chang, Yuanyuan, et al.
Pubblicazione: (2025)
di: Chang, Yuanyuan, et al.
Pubblicazione: (2025)
SVGDreamer: Text Guided SVG Generation with Diffusion Model
di: Xing, Ximing, et al.
Pubblicazione: (2023)
di: Xing, Ximing, et al.
Pubblicazione: (2023)
Paired Image Generation with Diffusion-Guided Diffusion Models
di: Zhang, Haoxuan, et al.
Pubblicazione: (2025)
di: Zhang, Haoxuan, et al.
Pubblicazione: (2025)
AI-T2I: Aggregating-and-Isolating Cross-Attention to Diffusion Models for Text-to-Image Synthesis
di: Cao, Shipeng, et al.
Pubblicazione: (2026)
di: Cao, Shipeng, et al.
Pubblicazione: (2026)
TRCE: Towards Reliable Malicious Concept Erasure in Text-to-Image Diffusion Models
di: Chen, Ruidong, et al.
Pubblicazione: (2025)
di: Chen, Ruidong, et al.
Pubblicazione: (2025)
Image Restoration via Diffusion Models with Dynamic Resolution
di: Zheng, Yang, et al.
Pubblicazione: (2026)
di: Zheng, Yang, et al.
Pubblicazione: (2026)
Evaluating Text-to-Image Generative Models: An Empirical Study on Human Image Synthesis
di: Chen, Muxi, et al.
Pubblicazione: (2024)
di: Chen, Muxi, et al.
Pubblicazione: (2024)
FBSDiff: Plug-and-Play Frequency Band Substitution of Diffusion Features for Highly Controllable Text-Driven Image Translation
di: Gao, Xiang, et al.
Pubblicazione: (2024)
di: Gao, Xiang, et al.
Pubblicazione: (2024)
Restoring Real-World Images with an Internal Detail Enhancement Diffusion Model
di: Xiao, Peng, et al.
Pubblicazione: (2025)
di: Xiao, Peng, et al.
Pubblicazione: (2025)
RealGen: Photorealistic Text-to-Image Generation via Detector-Guided Rewards
di: Ye, Junyan, et al.
Pubblicazione: (2025)
di: Ye, Junyan, et al.
Pubblicazione: (2025)
Training-Free Text-Guided Image Editing with Visual Autoregressive Model
di: Wang, Yufei, et al.
Pubblicazione: (2025)
di: Wang, Yufei, et al.
Pubblicazione: (2025)
SSMG: Spatial-Semantic Map Guided Diffusion Model for Free-form Layout-to-Image Generation
di: Jia, Chengyou, et al.
Pubblicazione: (2023)
di: Jia, Chengyou, et al.
Pubblicazione: (2023)
Text Modality Oriented Image Feature Extraction for Detecting Diffusion-based DeepFake
di: Yang, Di, et al.
Pubblicazione: (2024)
di: Yang, Di, et al.
Pubblicazione: (2024)
Contrastive Learning Guided Latent Diffusion Model for Image-to-Image Translation
di: Si, Qi, et al.
Pubblicazione: (2025)
di: Si, Qi, et al.
Pubblicazione: (2025)
Towards Understanding the Working Mechanism of Text-to-Image Diffusion Model
di: Yi, Mingyang, et al.
Pubblicazione: (2024)
di: Yi, Mingyang, et al.
Pubblicazione: (2024)
Detail++: Training-Free Detail Enhancer for Text-to-Image Diffusion Models
di: Chen, Lifeng, et al.
Pubblicazione: (2025)
di: Chen, Lifeng, et al.
Pubblicazione: (2025)
From Reusing to Forecasting: Accelerating Diffusion Models with TaylorSeers
di: Liu, Jiacheng, et al.
Pubblicazione: (2025)
di: Liu, Jiacheng, et al.
Pubblicazione: (2025)
FreeText: Training-Free Text Rendering in Diffusion Transformers via Attention Localization and Spectral Glyph Injection
di: Zhang, Ruiqiang, et al.
Pubblicazione: (2026)
di: Zhang, Ruiqiang, et al.
Pubblicazione: (2026)
Image-Conditional Diffusion Transformer for Underwater Image Enhancement
di: Nie, Xingyang, et al.
Pubblicazione: (2024)
di: Nie, Xingyang, et al.
Pubblicazione: (2024)
MADiff: Text-Guided Fashion Image Editing with Mask Prediction and Attention-Enhanced Diffusion
di: Zhan, Zechao, et al.
Pubblicazione: (2024)
di: Zhan, Zechao, et al.
Pubblicazione: (2024)
All Changes May Have Invariant Principles: Improving Ever-Shifting Harmful Meme Detection via Design Concept Reproduction
di: Jiang, Ziyou, et al.
Pubblicazione: (2026)
di: Jiang, Ziyou, et al.
Pubblicazione: (2026)
MotionMatcher: Motion Customization of Text-to-Video Diffusion Models via Motion Feature Matching
di: Wu, Yen-Siang, et al.
Pubblicazione: (2025)
di: Wu, Yen-Siang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Adversarial Testing for Visual Grounding via Image-Aware Property Reduction
di: Chang, Zhiyuan, et al.
Pubblicazione: (2024) -
AID: Attention Interpolation of Text-to-Image Diffusion
di: He, Qiyuan, et al.
Pubblicazione: (2024) -
MedEBench: Diagnosing Reliability in Text-Guided Medical Image Editing
di: Liu, Minghao, et al.
Pubblicazione: (2025) -
TextDiff: Mask-Guided Residual Diffusion Models for Scene Text Image Super-Resolution
di: Liu, Baolin, et al.
Pubblicazione: (2023) -
Development and Enhancement of Text-to-Image Diffusion Models
di: Sahu, Rajdeep Roshan
Pubblicazione: (2025)