InitNO: Boosting Text-to-Image Diffusion Models via Initial Noise Optimization
Fuente:
arXiv
Saved in:
| Main Authors: | Guo, Xiefan, Liu, Jinlin, Cui, Miaomiao, Li, Jiankai, Yang, Hongyu, Huang, Di |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
I4VGen: Image as Free Stepping Stone for Text-to-Video Generation
by: Guo, Xiefan, et al.
Published: (2024)
by: Guo, Xiefan, et al.
Published: (2024)
ShortFT: Diffusion Model Alignment via Shortcut-based Fine-Tuning
by: Guo, Xiefan, et al.
Published: (2025)
by: Guo, Xiefan, et al.
Published: (2025)
Image Inpainting via Conditional Texture and Structure Dual Generation
by: Guo, Xiefan, et al.
Published: (2021)
by: Guo, Xiefan, et al.
Published: (2021)
CTCal: Rethinking Text-to-Image Diffusion Models via Cross-Timestep Self-Calibration
by: Guo, Xiefan, et al.
Published: (2026)
by: Guo, Xiefan, et al.
Published: (2026)
FreeInit: Bridging Initialization Gap in Video Diffusion Models
by: Wu, Tianxing, et al.
Published: (2023)
by: Wu, Tianxing, et al.
Published: (2023)
Disentangling Foreground and Background Motion for Enhanced Realism in Human Video Generation
by: Liu, Jinlin, et al.
Published: (2024)
by: Liu, Jinlin, et al.
Published: (2024)
EruDiff: Refactoring Knowledge in Diffusion Models for Advanced Text-to-Image Synthesis
by: Guo, Xiefan, et al.
Published: (2026)
by: Guo, Xiefan, et al.
Published: (2026)
Diffusion-4K: Ultra-High-Resolution Image Synthesis with Latent Diffusion Models
by: Zhang, Jinjin, et al.
Published: (2025)
by: Zhang, Jinjin, et al.
Published: (2025)
Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis
by: Zhang, Jinjin, et al.
Published: (2026)
by: Zhang, Jinjin, et al.
Published: (2026)
FastInit: Fast Noise Initialization for Temporally Consistent Video Generation
by: Bai, Chengyu, et al.
Published: (2025)
by: Bai, Chengyu, et al.
Published: (2025)
Leveraging Predicate and Triplet Learning for Scene Graph Generation
by: Li, Jiankai, et al.
Published: (2024)
by: Li, Jiankai, et al.
Published: (2024)
Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation
by: Zhang, Jinjin, et al.
Published: (2025)
by: Zhang, Jinjin, et al.
Published: (2025)
Adjusting Initial Noise to Mitigate Memorization in Text-to-Image Diffusion Models
by: Han, Hyeonggeun, et al.
Published: (2025)
by: Han, Hyeonggeun, et al.
Published: (2025)
What Makes Synthetic Data Effective in Image Segmentation
by: Zhang, Jinjin, et al.
Published: (2026)
by: Zhang, Jinjin, et al.
Published: (2026)
LGTM: Training-Free Light-Guided Text-to-Image Diffusion Model via Initial Noise Manipulation
by: Morita, Ryugo, et al.
Published: (2026)
by: Morita, Ryugo, et al.
Published: (2026)
Restoring Initial Noise Sensitivity in Text-to-Image Distillation via Geometric Alignment
by: Huang, Huayang, et al.
Published: (2026)
by: Huang, Huayang, et al.
Published: (2026)
FIND: Fine-tuning Initial Noise Distribution with Policy Optimization for Diffusion Models
by: Chen, Changgu, et al.
Published: (2024)
by: Chen, Changgu, et al.
Published: (2024)
GaussianIP: Identity-Preserving Realistic 3D Human Generation via Human-Centric Diffusion Prior
by: Tang, Zichen, et al.
Published: (2025)
by: Tang, Zichen, et al.
Published: (2025)
DiffusionGAN3D: Boosting Text-guided 3D Generation and Domain Adaptation by Combining 3D GANs and Diffusion Priors
by: Lei, Biwen, et al.
Published: (2023)
by: Lei, Biwen, et al.
Published: (2023)
CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis
by: Sundaram, Aravindan, et al.
Published: (2024)
by: Sundaram, Aravindan, et al.
Published: (2024)
ActiveInitSplat: How Active Image Selection Helps Gaussian Splatting
by: Polyzos, Konstantinos D., et al.
Published: (2025)
by: Polyzos, Konstantinos D., et al.
Published: (2025)
PoInit-of-View: Poisoning Initialization of Views Transfers Across Multiple 3D Reconstruction Systems
by: Wang, Weijie, et al.
Published: (2026)
by: Wang, Weijie, et al.
Published: (2026)
DiffBoost: Enhancing Medical Image Segmentation via Text-Guided Diffusion Model
by: Zhang, Zheyuan, et al.
Published: (2023)
by: Zhang, Zheyuan, et al.
Published: (2023)
Safeguarding Text-to-Image Generation via Inference-Time Prompt-Noise Optimization
by: Peng, Jiangweizhi, et al.
Published: (2024)
by: Peng, Jiangweizhi, et al.
Published: (2024)
DDAE++: Enhancing Diffusion Models Towards Unified Generative and Discriminative Learning
by: Xiang, Weilai, et al.
Published: (2025)
by: Xiang, Weilai, et al.
Published: (2025)
Guided Image Synthesis via Initial Image Editing in Diffusion Model
by: Mao, Jiafeng, et al.
Published: (2023)
by: Mao, Jiafeng, et al.
Published: (2023)
Boosting Text-to-Image Diffusion Models via Core Token Attention-Based Seed Selection
by: Zhang, Yunzhe, et al.
Published: (2026)
by: Zhang, Yunzhe, et al.
Published: (2026)
Text Modality Oriented Image Feature Extraction for Detecting Diffusion-based DeepFake
by: Yang, Di, et al.
Published: (2024)
by: Yang, Di, et al.
Published: (2024)
Simultaneous Image-to-Zero and Zero-to-Noise: Diffusion Models with Analytical Image Attenuation
by: Huang, Yuhang, et al.
Published: (2023)
by: Huang, Yuhang, et al.
Published: (2023)
NoiseCollage: A Layout-Aware Text-to-Image Diffusion Model Based on Noise Cropping and Merging
by: Shirakawa, Takahiro, et al.
Published: (2024)
by: Shirakawa, Takahiro, et al.
Published: (2024)
Instructing Text-to-Image Diffusion Models via Classifier-Guided Semantic Optimization
by: Chang, Yuanyuan, et al.
Published: (2025)
by: Chang, Yuanyuan, et al.
Published: (2025)
EmoGen: Emotional Image Content Generation with Text-to-Image Diffusion Models
by: Yang, Jingyuan, et al.
Published: (2024)
by: Yang, Jingyuan, et al.
Published: (2024)
Dynamic Prompting of Frozen Text-to-Image Diffusion Models for Panoptic Narrative Grounding
by: Li, Hongyu, et al.
Published: (2024)
by: Li, Hongyu, et al.
Published: (2024)
Noise Diffusion for Enhancing Semantic Faithfulness in Text-to-Image Synthesis
by: Miao, Boming, et al.
Published: (2024)
by: Miao, Boming, et al.
Published: (2024)
Learning High-Quality Initial Noise for Single-View Synthesis with Diffusion Models
by: Zhang, Zhihao, et al.
Published: (2025)
by: Zhang, Zhihao, et al.
Published: (2025)
DNI: Dilutional Noise Initialization for Diffusion Video Editing
by: Yoon, Sunjae, et al.
Published: (2024)
by: Yoon, Sunjae, et al.
Published: (2024)
DisentTalk: Cross-lingual Talking Face Generation via Semantic Disentangled Diffusion Model
by: Liu, Kangwei, et al.
Published: (2025)
by: Liu, Kangwei, et al.
Published: (2025)
FreeFix: Boosting 3D Gaussian Splatting via Fine-Tuning-Free Diffusion Models
by: Zhou, Hongyu, et al.
Published: (2026)
by: Zhou, Hongyu, et al.
Published: (2026)
Verify Claimed Text-to-Image Models via Boundary-Aware Prompt Optimization
by: Zhao, Zidong, et al.
Published: (2026)
by: Zhao, Zidong, et al.
Published: (2026)
TextBoost: Boosting Text Encoder for Personalized Text-to-Image Generation
by: Park, NaHyeon, et al.
Published: (2024)
by: Park, NaHyeon, et al.
Published: (2024)
Similar Items
-
I4VGen: Image as Free Stepping Stone for Text-to-Video Generation
by: Guo, Xiefan, et al.
Published: (2024) -
ShortFT: Diffusion Model Alignment via Shortcut-based Fine-Tuning
by: Guo, Xiefan, et al.
Published: (2025) -
Image Inpainting via Conditional Texture and Structure Dual Generation
by: Guo, Xiefan, et al.
Published: (2021) -
CTCal: Rethinking Text-to-Image Diffusion Models via Cross-Timestep Self-Calibration
by: Guo, Xiefan, et al.
Published: (2026) -
FreeInit: Bridging Initialization Gap in Video Diffusion Models
by: Wu, Tianxing, et al.
Published: (2023)