Rethinking the Spatial Inconsistency in Classifier-Free Diffusion Guidance
Fuente:
arXiv
Guardado en:
| Autores principales: | Shen, Dazhong, Song, Guanglu, Xue, Zeyue, Wang, Fu-Yun, Liu, Yu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ADT: Tuning Diffusion Models with Adversarial Supervision
por: Shen, Dazhong, et al.
Publicado: (2025)
por: Shen, Dazhong, et al.
Publicado: (2025)
CoMat: Aligning Text-to-Image Diffusion Model with Image-to-Text Concept Matching
por: Jiang, Dongzhi, et al.
Publicado: (2024)
por: Jiang, Dongzhi, et al.
Publicado: (2024)
Gradient-Free Classifier Guidance for Diffusion Model Sampling
por: Shenoy, Rahul, et al.
Publicado: (2024)
por: Shenoy, Rahul, et al.
Publicado: (2024)
Factored Classifier-Free Guidance
por: Xia, Tian, et al.
Publicado: (2025)
por: Xia, Tian, et al.
Publicado: (2025)
Improving Classifier-Free Guidance of Flow Matching via Manifold Projection
por: Cai, Jian-Feng, et al.
Publicado: (2026)
por: Cai, Jian-Feng, et al.
Publicado: (2026)
CFG++: Manifold-constrained Classifier Free Guidance for Diffusion Models
por: Chung, Hyungjin, et al.
Publicado: (2024)
por: Chung, Hyungjin, et al.
Publicado: (2024)
How Much To Guide: Revisiting Adaptive Guidance in Classifier-Free Guidance Text-to-Vision Diffusion Models
por: Zhang, Huixuan, et al.
Publicado: (2025)
por: Zhang, Huixuan, et al.
Publicado: (2025)
CoTZero: Annotation-Free Human-Like Vision Reasoning via Hierarchical Synthetic CoT
por: Du, Chengyi, et al.
Publicado: (2026)
por: Du, Chengyi, et al.
Publicado: (2026)
Rethinking Preference Alignment for Diffusion Models with Classifier-Free Guidance
por: Jiang, Zhou, et al.
Publicado: (2026)
por: Jiang, Zhou, et al.
Publicado: (2026)
Classifier-Free Guidance is a Predictor-Corrector
por: Bradley, Arwen, et al.
Publicado: (2024)
por: Bradley, Arwen, et al.
Publicado: (2024)
Studying Classifier(-Free) Guidance From a Classifier-Centric Perspective
por: Zhao, Xiaoming, et al.
Publicado: (2025)
por: Zhao, Xiaoming, et al.
Publicado: (2025)
Diffusion Models without Classifier-free Guidance
por: Tang, Zhicong, et al.
Publicado: (2025)
por: Tang, Zhicong, et al.
Publicado: (2025)
EP-CFG: Energy-Preserving Classifier-Free Guidance
por: Zhang, Kai, et al.
Publicado: (2024)
por: Zhang, Kai, et al.
Publicado: (2024)
RAPHAEL: Text-to-Image Generation via Large Mixture of Diffusion Paths
por: Xue, Zeyue, et al.
Publicado: (2023)
por: Xue, Zeyue, et al.
Publicado: (2023)
Deep Reward Supervisions for Tuning Text-to-Image Diffusion Models
por: Wu, Xiaoshi, et al.
Publicado: (2024)
por: Wu, Xiaoshi, et al.
Publicado: (2024)
OmniNFT: Modality-wise Omni Diffusion Reinforcement for Joint Audio-Video Generation
por: Zhang, Guohui, et al.
Publicado: (2026)
por: Zhang, Guohui, et al.
Publicado: (2026)
Frame Guidance: Training-Free Guidance for Frame-Level Control in Video Diffusion Models
por: Jang, Sangwon, et al.
Publicado: (2025)
por: Jang, Sangwon, et al.
Publicado: (2025)
Rethinking SAR ATR: A Target-Aware Frequency-Spatial Enhancement Framework with Noise-Resilient Knowledge Guidance
por: Lin, Yansong, et al.
Publicado: (2026)
por: Lin, Yansong, et al.
Publicado: (2026)
Rethinking Oversaturation in Classifier-Free Guidance via Low Frequency
por: Song, Kaiyu, et al.
Publicado: (2025)
por: Song, Kaiyu, et al.
Publicado: (2025)
Classifier-Free Guidance inside the Attraction Basin May Cause Memorization
por: Jain, Anubhav, et al.
Publicado: (2024)
por: Jain, Anubhav, et al.
Publicado: (2024)
Rethinking Video Tokenization: A Conditioned Diffusion-based Approach
por: Yang, Nianzu, et al.
Publicado: (2025)
por: Yang, Nianzu, et al.
Publicado: (2025)
Leveraging Static Relationships for Intra-Type and Inter-Type Message Passing in Video Question Answering
por: Liang, Lili, et al.
Publicado: (2025)
por: Liang, Lili, et al.
Publicado: (2025)
Training-Free Representation Guidance for Diffusion Models with a Representation Alignment Projector
por: Zu, Wenqiang, et al.
Publicado: (2026)
por: Zu, Wenqiang, et al.
Publicado: (2026)
Be-Your-Outpainter: Mastering Video Outpainting through Input-Specific Adaptation
por: Wang, Fu-Yun, et al.
Publicado: (2024)
por: Wang, Fu-Yun, et al.
Publicado: (2024)
FAIRT2V: Training-Free Debiasing for Text-to-Video Diffusion Models
por: Zhong, Haonan, et al.
Publicado: (2026)
por: Zhong, Haonan, et al.
Publicado: (2026)
Pretrained Reversible Generation as Unsupervised Visual Representation Learning
por: Xue, Rongkun, et al.
Publicado: (2024)
por: Xue, Rongkun, et al.
Publicado: (2024)
Dual-Channel Attention Guidance for Training-Free Image Editing Control in Diffusion Transformers
por: Li, Guandong
Publicado: (2026)
por: Li, Guandong
Publicado: (2026)
Composite Classifier-Free Guidance for Multi-Modal Conditioning in Wind Dynamics Super-Resolution
por: Schnell, Jacob, et al.
Publicado: (2025)
por: Schnell, Jacob, et al.
Publicado: (2025)
Guidance Matters: Rethinking the Evaluation Pitfall for Text-to-Image Generation
por: Xie, Dian, et al.
Publicado: (2026)
por: Xie, Dian, et al.
Publicado: (2026)
DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance
por: Shen, Xuan, et al.
Publicado: (2025)
por: Shen, Xuan, et al.
Publicado: (2025)
No Training, No Problem: Rethinking Classifier-Free Guidance for Diffusion Models
por: Sadat, Seyedmorteza, et al.
Publicado: (2024)
por: Sadat, Seyedmorteza, et al.
Publicado: (2024)
Point2RBox-v2: Rethinking Point-supervised Oriented Object Detection with Spatial Layout Among Instances
por: Yu, Yi, et al.
Publicado: (2025)
por: Yu, Yi, et al.
Publicado: (2025)
Rethinking Cross-Layer Information Routing in Diffusion Transformers
por: Xu, Chao, et al.
Publicado: (2026)
por: Xu, Chao, et al.
Publicado: (2026)
VividFace: A Diffusion-Based Hybrid Framework for High-Fidelity Video Face Swapping
por: Shao, Hao, et al.
Publicado: (2024)
por: Shao, Hao, et al.
Publicado: (2024)
ENAT: Rethinking Spatial-temporal Interactions in Token-based Image Synthesis
por: Ni, Zanlin, et al.
Publicado: (2024)
por: Ni, Zanlin, et al.
Publicado: (2024)
EasyRef: Omni-Generalized Group Image Reference for Diffusion Models via Multimodal LLM
por: Zong, Zhuofan, et al.
Publicado: (2024)
por: Zong, Zhuofan, et al.
Publicado: (2024)
SSMG: Spatial-Semantic Map Guided Diffusion Model for Free-form Layout-to-Image Generation
por: Jia, Chengyou, et al.
Publicado: (2023)
por: Jia, Chengyou, et al.
Publicado: (2023)
Prompt Guidance and Human Proximal Perception for HOT Prediction with Regional Joint Loss
por: Wang, Yuxiao, et al.
Publicado: (2025)
por: Wang, Yuxiao, et al.
Publicado: (2025)
CFG-Ctrl: Control-Based Classifier-Free Diffusion Guidance
por: Wang, Hanyang, et al.
Publicado: (2026)
por: Wang, Hanyang, et al.
Publicado: (2026)
AEGPO: Adaptive Entropy-Guided Policy Optimization for Diffusion Models
por: Li, Yuming, et al.
Publicado: (2026)
por: Li, Yuming, et al.
Publicado: (2026)
Ejemplares similares
-
ADT: Tuning Diffusion Models with Adversarial Supervision
por: Shen, Dazhong, et al.
Publicado: (2025) -
CoMat: Aligning Text-to-Image Diffusion Model with Image-to-Text Concept Matching
por: Jiang, Dongzhi, et al.
Publicado: (2024) -
Gradient-Free Classifier Guidance for Diffusion Model Sampling
por: Shenoy, Rahul, et al.
Publicado: (2024) -
Factored Classifier-Free Guidance
por: Xia, Tian, et al.
Publicado: (2025) -
Improving Classifier-Free Guidance of Flow Matching via Manifold Projection
por: Cai, Jian-Feng, et al.
Publicado: (2026)