Improving Diffusion-Based Image Synthesis with Context Prediction
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Ling, Liu, Jingwei, Hong, Shenda, Zhang, Zhilong, Huang, Zhilin, Cai, Zheming, Zhang, Wentao, Cui, Bin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Diffusion Models: A Comprehensive Survey of Methods and Applications
di: Yang, Ling, et al.
Pubblicazione: (2022)
di: Yang, Ling, et al.
Pubblicazione: (2022)
Structure-Guided Adversarial Training of Diffusion Models
di: Yang, Ling, et al.
Pubblicazione: (2024)
di: Yang, Ling, et al.
Pubblicazione: (2024)
Contextualized Diffusion Models for Text-Guided Image and Video Generation
di: Yang, Ling, et al.
Pubblicazione: (2024)
di: Yang, Ling, et al.
Pubblicazione: (2024)
Consistency Flow Matching: Defining Straight Flows with Velocity Consistency
di: Yang, Ling, et al.
Pubblicazione: (2024)
di: Yang, Ling, et al.
Pubblicazione: (2024)
VQGraph: Rethinking Graph Representation Space for Bridging GNNs and MLPs
di: Yang, Ling, et al.
Pubblicazione: (2023)
di: Yang, Ling, et al.
Pubblicazione: (2023)
Universal Medical Image Representation Learning with Compositional Decoders
di: Wang, Kaini, et al.
Pubblicazione: (2024)
di: Wang, Kaini, et al.
Pubblicazione: (2024)
FLARE: Fully Integration of Vision-Language Representations for Deep Cross-Modal Understanding
di: Liu, Zheng, et al.
Pubblicazione: (2025)
di: Liu, Zheng, et al.
Pubblicazione: (2025)
Evaluating and Predicting Distorted Human Body Parts for Generated Images
di: Ma, Lu, et al.
Pubblicazione: (2025)
di: Ma, Lu, et al.
Pubblicazione: (2025)
Token Pruning for In-Context Generation in Diffusion Transformers
di: Lin, Junqing, et al.
Pubblicazione: (2026)
di: Lin, Junqing, et al.
Pubblicazione: (2026)
SynthVLM: Towards High-Quality and Efficient Synthesis of Image-Caption Datasets for Vision-Language Models
di: Liu, Zheng, et al.
Pubblicazione: (2024)
di: Liu, Zheng, et al.
Pubblicazione: (2024)
DeContext as Defense: Safe Image Editing in Diffusion Transformers
di: Shen, Linghui, et al.
Pubblicazione: (2025)
di: Shen, Linghui, et al.
Pubblicazione: (2025)
Diffusion-Sharpening: Fine-tuning Diffusion Models with Denoising Trajectory Sharpening
di: Tian, Ye, et al.
Pubblicazione: (2025)
di: Tian, Ye, et al.
Pubblicazione: (2025)
RealCompo: Balancing Realism and Compositionality Improves Text-to-Image Diffusion Models
di: Zhang, Xinchen, et al.
Pubblicazione: (2024)
di: Zhang, Xinchen, et al.
Pubblicazione: (2024)
Diffusion-4K: Ultra-High-Resolution Image Synthesis with Latent Diffusion Models
di: Zhang, Jinjin, et al.
Pubblicazione: (2025)
di: Zhang, Jinjin, et al.
Pubblicazione: (2025)
HermesFlow: Seamlessly Closing the Gap in Multimodal Understanding and Generation
di: Yang, Ling, et al.
Pubblicazione: (2025)
di: Yang, Ling, et al.
Pubblicazione: (2025)
Diffusion Probe: Generated Image Result Prediction Using CNN Probes
di: Cui, Benlei, et al.
Pubblicazione: (2026)
di: Cui, Benlei, et al.
Pubblicazione: (2026)
In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer
di: Zhang, Zechuan, et al.
Pubblicazione: (2025)
di: Zhang, Zechuan, et al.
Pubblicazione: (2025)
Distribution-Aware Data Expansion with Diffusion Models
di: Zhu, Haowei, et al.
Pubblicazione: (2024)
di: Zhu, Haowei, et al.
Pubblicazione: (2024)
Frame Context Packing and Drift Prevention in Next-Frame-Prediction Video Diffusion Models
di: Zhang, Lvmin, et al.
Pubblicazione: (2025)
di: Zhang, Lvmin, et al.
Pubblicazione: (2025)
The Diffusion Duet: Harmonizing Dual Channels with Wavelet Suppression for Image Separation
di: Li, Jingwei, et al.
Pubblicazione: (2026)
di: Li, Jingwei, et al.
Pubblicazione: (2026)
LoVR: A Benchmark for Long Video Retrieval in Multimodal Contexts
di: Cai, Qifeng, et al.
Pubblicazione: (2025)
di: Cai, Qifeng, et al.
Pubblicazione: (2025)
IterComp: Iterative Composition-Aware Feedback Learning from Model Gallery for Text-to-Image Generation
di: Zhang, Xinchen, et al.
Pubblicazione: (2024)
di: Zhang, Xinchen, et al.
Pubblicazione: (2024)
DRDM: A Disentangled Representations Diffusion Model for Synthesizing Realistic Person Images
di: Huang, Enbo, et al.
Pubblicazione: (2024)
di: Huang, Enbo, et al.
Pubblicazione: (2024)
RotationDrag: Point-based Image Editing with Rotated Diffusion Features
di: Luo, Minxing, et al.
Pubblicazione: (2024)
di: Luo, Minxing, et al.
Pubblicazione: (2024)
A Survey on Personalized Content Synthesis with Diffusion Models
di: Zhang, Xulu, et al.
Pubblicazione: (2024)
di: Zhang, Xulu, et al.
Pubblicazione: (2024)
Consistency Diffusion Models for Single-Image 3D Reconstruction with Priors
di: Jiang, Chenru, et al.
Pubblicazione: (2025)
di: Jiang, Chenru, et al.
Pubblicazione: (2025)
CN-RMA: Combined Network with Ray Marching Aggregation for 3D Indoors Object Detection from Multi-view Images
di: Shen, Guanlin, et al.
Pubblicazione: (2024)
di: Shen, Guanlin, et al.
Pubblicazione: (2024)
Motion-aware Latent Diffusion Models for Video Frame Interpolation
di: Huang, Zhilin, et al.
Pubblicazione: (2024)
di: Huang, Zhilin, et al.
Pubblicazione: (2024)
Advancing Video Self-Supervised Learning via Image Foundation Models
di: Wu, Jingwei, et al.
Pubblicazione: (2025)
di: Wu, Jingwei, et al.
Pubblicazione: (2025)
Multi-focal Conditioned Latent Diffusion for Person Image Synthesis
di: Liu, Jiaqi, et al.
Pubblicazione: (2025)
di: Liu, Jiaqi, et al.
Pubblicazione: (2025)
Improving Anomaly Detection with Foundation-Model Synthesis and Wavelet-Domain Attention
di: Wu, Wensheng, et al.
Pubblicazione: (2026)
di: Wu, Wensheng, et al.
Pubblicazione: (2026)
Foresight Diffusion: Improving Sampling Consistency in Predictive Diffusion Models
di: Zhang, Yu, et al.
Pubblicazione: (2025)
di: Zhang, Yu, et al.
Pubblicazione: (2025)
Diffusion Model-Based Image Editing: A Survey
di: Huang, Yi, et al.
Pubblicazione: (2024)
di: Huang, Yi, et al.
Pubblicazione: (2024)
LaCon: Late-Constraint Diffusion for Steerable Guided Image Synthesis
di: Liu, Chang, et al.
Pubblicazione: (2023)
di: Liu, Chang, et al.
Pubblicazione: (2023)
MinerU-Diffusion: Rethinking Document OCR as Inverse Rendering via Diffusion Decoding
di: Dong, Hejun, et al.
Pubblicazione: (2026)
di: Dong, Hejun, et al.
Pubblicazione: (2026)
Extending Depth of Field for Varifocal Multiview Images
di: Li, Zhilong, et al.
Pubblicazione: (2024)
di: Li, Zhilong, et al.
Pubblicazione: (2024)
DMAligner: Enhancing Image Alignment via Diffusion Model Based View Synthesis
di: Luo, Xinglong, et al.
Pubblicazione: (2026)
di: Luo, Xinglong, et al.
Pubblicazione: (2026)
MADiff: Text-Guided Fashion Image Editing with Mask Prediction and Attention-Enhanced Diffusion
di: Zhan, Zechao, et al.
Pubblicazione: (2024)
di: Zhan, Zechao, et al.
Pubblicazione: (2024)
Improving Consistency in Diffusion Models for Image Super-Resolution
di: Gu, Junhao, et al.
Pubblicazione: (2024)
di: Gu, Junhao, et al.
Pubblicazione: (2024)
LSSInst: Improving Geometric Modeling in LSS-Based BEV Perception with Instance Representation
di: Ma, Weijie, et al.
Pubblicazione: (2024)
di: Ma, Weijie, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Diffusion Models: A Comprehensive Survey of Methods and Applications
di: Yang, Ling, et al.
Pubblicazione: (2022) -
Structure-Guided Adversarial Training of Diffusion Models
di: Yang, Ling, et al.
Pubblicazione: (2024) -
Contextualized Diffusion Models for Text-Guided Image and Video Generation
di: Yang, Ling, et al.
Pubblicazione: (2024) -
Consistency Flow Matching: Defining Straight Flows with Velocity Consistency
di: Yang, Ling, et al.
Pubblicazione: (2024) -
VQGraph: Rethinking Graph Representation Space for Bridging GNNs and MLPs
di: Yang, Ling, et al.
Pubblicazione: (2023)