Noise Projection: Closing the Prompt-Agnostic Gap Behind Text-to-Image Misalignment in Diffusion Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tong, Yunze, Zhu, Didi, Hu, Zijing, Yang, Jinluan, Zhao, Ziyu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Asynchronous Denoising Diffusion Models for Aligning Text-to-Image Generation
par: Hu, Zijing, et autres
Publié: (2025)
par: Hu, Zijing, et autres
Publié: (2025)
Text-Anchored Score Composition: Tackling Condition Misalignment in Text-to-Image Diffusion Models
par: Wang, Luozhou, et autres
Publié: (2023)
par: Wang, Luozhou, et autres
Publié: (2023)
Layout Agnostic Scene Text Image Synthesis with Diffusion Models
par: Zhangli, Qilong, et autres
Publié: (2024)
par: Zhangli, Qilong, et autres
Publié: (2024)
Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback
par: Niu, Xuexiang, et autres
Publié: (2024)
par: Niu, Xuexiang, et autres
Publié: (2024)
Investigating Domain Gaps for Indoor 3D Object Detection
par: Zhao, Zijing, et autres
Publié: (2025)
par: Zhao, Zijing, et autres
Publié: (2025)
Image Super-Resolution with Text Prompt Diffusion
par: Chen, Zheng, et autres
Publié: (2023)
par: Chen, Zheng, et autres
Publié: (2023)
PromptRR: Diffusion Models as Prompt Generators for Single Image Reflection Removal
par: Wang, Tao, et autres
Publié: (2024)
par: Wang, Tao, et autres
Publié: (2024)
Leveraging Hierarchical Image-Text Misalignment for Universal Fake Image Detection
par: Zhang, Daichi, et autres
Publié: (2025)
par: Zhang, Daichi, et autres
Publié: (2025)
Noise Diffusion for Enhancing Semantic Faithfulness in Text-to-Image Synthesis
par: Miao, Boming, et autres
Publié: (2024)
par: Miao, Boming, et autres
Publié: (2024)
InitNO: Boosting Text-to-Image Diffusion Models via Initial Noise Optimization
par: Guo, Xiefan, et autres
Publié: (2024)
par: Guo, Xiefan, et autres
Publié: (2024)
Instant Preference Alignment for Text-to-Image Diffusion Models
par: Li, Yang, et autres
Publié: (2025)
par: Li, Yang, et autres
Publié: (2025)
Contrastive Prompts Improve Disentanglement in Text-to-Image Diffusion Models
par: Wu, Chen, et autres
Publié: (2024)
par: Wu, Chen, et autres
Publié: (2024)
STP4D: Spatio-Temporal-Prompt Consistent Modeling for Text-to-4D Gaussian Splatting
par: Deng, Yunze, et autres
Publié: (2025)
par: Deng, Yunze, et autres
Publié: (2025)
Adjusting Initial Noise to Mitigate Memorization in Text-to-Image Diffusion Models
par: Han, Hyeonggeun, et autres
Publié: (2025)
par: Han, Hyeonggeun, et autres
Publié: (2025)
Origin Identification for Text-Guided Image-to-Image Diffusion Models
par: Wang, Wenhao, et autres
Publié: (2025)
par: Wang, Wenhao, et autres
Publié: (2025)
D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples
par: Hu, Zijing, et autres
Publié: (2025)
par: Hu, Zijing, et autres
Publié: (2025)
Detecting Dataset Abuse in Fine-Tuning Stable Diffusion Models for Text-to-Image Synthesis
par: Wang, Songrui, et autres
Publié: (2024)
par: Wang, Songrui, et autres
Publié: (2024)
Prompt-Agnostic Adversarial Perturbation for Customized Diffusion Models
par: Wan, Cong, et autres
Publié: (2024)
par: Wan, Cong, et autres
Publié: (2024)
Uncovering the Text Embedding in Text-to-Image Diffusion Models
par: Yu, Hu, et autres
Publié: (2024)
par: Yu, Hu, et autres
Publié: (2024)
Supercharged One-step Text-to-Image Diffusion Models with Negative Prompts
par: Nguyen, Viet, et autres
Publié: (2024)
par: Nguyen, Viet, et autres
Publié: (2024)
EDITOR: Effective and Interpretable Prompt Inversion for Text-to-Image Diffusion Models
par: Li, Mingzhe, et autres
Publié: (2025)
par: Li, Mingzhe, et autres
Publié: (2025)
EMMA: Your Text-to-Image Diffusion Model Can Secretly Accept Multi-Modal Prompts
par: Han, Yucheng, et autres
Publié: (2024)
par: Han, Yucheng, et autres
Publié: (2024)
NoiseCollage: A Layout-Aware Text-to-Image Diffusion Model Based on Noise Cropping and Merging
par: Shirakawa, Takahiro, et autres
Publié: (2024)
par: Shirakawa, Takahiro, et autres
Publié: (2024)
Topology-Agnostic Animal Motion Generation from Text Prompt
par: Chen, Keyi, et autres
Publié: (2025)
par: Chen, Keyi, et autres
Publié: (2025)
Diffusion-Based Image-to-Image Translation by Noise Correction via Prompt Interpolation
par: Lee, Junsung, et autres
Publié: (2024)
par: Lee, Junsung, et autres
Publié: (2024)
Good Noise Makes Good Edits: A Training-Free Diffusion-Based Video Editing with Image and Text Prompts
par: Choi, Saemee, et autres
Publié: (2025)
par: Choi, Saemee, et autres
Publié: (2025)
Local Conditional Controlling for Text-to-Image Diffusion Models
par: Zhao, Yibo, et autres
Publié: (2023)
par: Zhao, Yibo, et autres
Publié: (2023)
Text Image Inpainting via Global Structure-Guided Diffusion Models
par: Zhu, Shipeng, et autres
Publié: (2024)
par: Zhu, Shipeng, et autres
Publié: (2024)
Safeguarding Text-to-Image Generation via Inference-Time Prompt-Noise Optimization
par: Peng, Jiangweizhi, et autres
Publié: (2024)
par: Peng, Jiangweizhi, et autres
Publié: (2024)
LLM-grounded Diffusion: Enhancing Prompt Understanding of Text-to-Image Diffusion Models with Large Language Models
par: Lian, Long, et autres
Publié: (2023)
par: Lian, Long, et autres
Publié: (2023)
Dynamic Prompting of Frozen Text-to-Image Diffusion Models for Panoptic Narrative Grounding
par: Li, Hongyu, et autres
Publié: (2024)
par: Li, Hongyu, et autres
Publié: (2024)
Identifying Models Behind Text-to-Image Leaderboards
par: Naseh, Ali, et autres
Publié: (2026)
par: Naseh, Ali, et autres
Publié: (2026)
Visual Prompt-Agnostic Evolution
par: Wang, Junze, et autres
Publié: (2026)
par: Wang, Junze, et autres
Publié: (2026)
TriC-Motion: Tri-Domain Causal Modeling Grounded Text-to-Motion Generation
par: Cao, Yiyang, et autres
Publié: (2026)
par: Cao, Yiyang, et autres
Publié: (2026)
Bi-directional Self-Registration for Misaligned Infrared-Visible Image Fusion
par: Li, Timing, et autres
Publié: (2025)
par: Li, Timing, et autres
Publié: (2025)
PaintScene4D: Consistent 4D Scene Generation from Text Prompts
par: Gupta, Vinayak, et autres
Publié: (2024)
par: Gupta, Vinayak, et autres
Publié: (2024)
Seek for Incantations: Towards Accurate Text-to-Image Diffusion Synthesis through Prompt Engineering
par: Yu, Chang, et autres
Publié: (2024)
par: Yu, Chang, et autres
Publié: (2024)
Unified Prompt Attack Against Text-to-Image Generation Models
par: Peng, Duo, et autres
Publié: (2025)
par: Peng, Duo, et autres
Publié: (2025)
Beyond the Noise: Aligning Prompts with Latent Representations in Diffusion Models
par: Ramos, Vasco, et autres
Publié: (2025)
par: Ramos, Vasco, et autres
Publié: (2025)
Is Your Text-to-Image Model Robust to Caption Noise?
par: Yu, Weichen, et autres
Publié: (2024)
par: Yu, Weichen, et autres
Publié: (2024)
Documents similaires
-
Asynchronous Denoising Diffusion Models for Aligning Text-to-Image Generation
par: Hu, Zijing, et autres
Publié: (2025) -
Text-Anchored Score Composition: Tackling Condition Misalignment in Text-to-Image Diffusion Models
par: Wang, Luozhou, et autres
Publié: (2023) -
Layout Agnostic Scene Text Image Synthesis with Diffusion Models
par: Zhangli, Qilong, et autres
Publié: (2024) -
Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback
par: Niu, Xuexiang, et autres
Publié: (2024) -
Investigating Domain Gaps for Indoor 3D Object Detection
par: Zhao, Zijing, et autres
Publié: (2025)