Guiding a Diffusion Transformer with the Internal Dynamics of Itself
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhou, Xingyu, Li, Qifan, Hu, Xiaobin, Chen, Hai, Gu, Shuhang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Taming Sampling Perturbations with Variance Expansion Loss for Latent Diffusion Models
par: Li, Qifan, et autres
Publié: (2026)
par: Li, Qifan, et autres
Publié: (2026)
Inductive Gradient Adjustment For Spectral Bias In Implicit Neural Representations
par: Shi, Kexuan, et autres
Publié: (2024)
par: Shi, Kexuan, et autres
Publié: (2024)
Guiding a Diffusion Model with a Bad Version of Itself
par: Karras, Tero, et autres
Publié: (2024)
par: Karras, Tero, et autres
Publié: (2024)
Texture Vector-Quantization and Reconstruction Aware Prediction for Generative Super-Resolution
par: Li, Qifan, et autres
Publié: (2025)
par: Li, Qifan, et autres
Publié: (2025)
Progressive Focused Transformer for Single Image Super-Resolution
par: Long, Wei, et autres
Publié: (2025)
par: Long, Wei, et autres
Publié: (2025)
Improved Implicit Neural Representation with Fourier Reparameterized Training
par: Shi, Kexuan, et autres
Publié: (2024)
par: Shi, Kexuan, et autres
Publié: (2024)
Transcending the Limit of Local Window: Advanced Super-Resolution Transformer with Adaptive Token Dictionary
par: Zhang, Leheng, et autres
Publié: (2024)
par: Zhang, Leheng, et autres
Publié: (2024)
Mixture of Distributions Matters: Dynamic Sparse Attention for Efficient Video Diffusion Transformers
par: Liu, Yuxi, et autres
Publié: (2026)
par: Liu, Yuxi, et autres
Publié: (2026)
Token Caching for Diffusion Transformer Acceleration
par: Lou, Jinming, et autres
Publié: (2024)
par: Lou, Jinming, et autres
Publié: (2024)
DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models
par: Lu, Cheng, et autres
Publié: (2022)
par: Lu, Cheng, et autres
Publié: (2022)
Identity-Preserving Pose-Guided Character Animation via Facial Landmarks Transformation
par: Mu, Lianrui, et autres
Publié: (2024)
par: Mu, Lianrui, et autres
Publié: (2024)
ATD: Improved Transformer with Adaptive Token Dictionary for Image Restoration
par: Zhang, Leheng, et autres
Publié: (2026)
par: Zhang, Leheng, et autres
Publié: (2026)
History-Guided Video Diffusion
par: Song, Kiwhan, et autres
Publié: (2025)
par: Song, Kiwhan, et autres
Publié: (2025)
Stereo Risk: A Continuous Modeling Approach to Stereo Matching
par: Liu, Ce, et autres
Publié: (2024)
par: Liu, Ce, et autres
Publié: (2024)
Video Super-Resolution Transformer with Masked Inter&Intra-Frame Attention
par: Zhou, Xingyu, et autres
Publié: (2024)
par: Zhou, Xingyu, et autres
Publié: (2024)
FEB-Cache: Frequency-Guided Exposure Bias Reduction for Enhancing Diffusion Transformer Caching
par: Zou, Zhen, et autres
Publié: (2025)
par: Zou, Zhen, et autres
Publié: (2025)
Dynamical Diffusion: Learning Temporal Dynamics with Diffusion Models
par: Guo, Xingzhuo, et autres
Publié: (2025)
par: Guo, Xingzhuo, et autres
Publié: (2025)
Let the Target Select for Itself: Data Selection via Target-Aligned Paths
par: Yang, Huitao, et autres
Publié: (2026)
par: Yang, Huitao, et autres
Publié: (2026)
Few-Step Diffusion via Score identity Distillation
par: Zhou, Mingyuan, et autres
Publié: (2025)
par: Zhou, Mingyuan, et autres
Publié: (2025)
TerDiT: Ternary Diffusion Models with Transformers
par: Lu, Xudong, et autres
Publié: (2024)
par: Lu, Xudong, et autres
Publié: (2024)
DRAG: Data Reconstruction Attack using Guided Diffusion
par: Lei, Wa-Kin, et autres
Publié: (2025)
par: Lei, Wa-Kin, et autres
Publié: (2025)
Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer
par: Cui, Jiahao, et autres
Publié: (2024)
par: Cui, Jiahao, et autres
Publié: (2024)
FRIDU: Functional Map Refinement with Guided Image Diffusion
par: Rimon, Avigail Cohen, et autres
Publié: (2025)
par: Rimon, Avigail Cohen, et autres
Publié: (2025)
JLT: Clean-Latent Prediction in Latent Diffusion Transformers
par: Fu, Funing, et autres
Publié: (2026)
par: Fu, Funing, et autres
Publié: (2026)
Unveil Inversion and Invariance in Flow Transformer for Versatile Image Editing
par: Xu, Pengcheng, et autres
Publié: (2024)
par: Xu, Pengcheng, et autres
Publié: (2024)
Continual Distillation Learning: Knowledge Distillation in Prompt-based Continual Learning
par: Zhang, Qifan, et autres
Publié: (2024)
par: Zhang, Qifan, et autres
Publié: (2024)
ST-GRIT: Spatio-Temporal Graph Transformer For Internal Ice Layer Thickness Prediction
par: Liu, Zesheng, et autres
Publié: (2025)
par: Liu, Zesheng, et autres
Publié: (2025)
Evolution of Optimization Methods: Algorithms, Scenarios, and Evaluations
par: Zhang, Tong, et autres
Publié: (2026)
par: Zhang, Tong, et autres
Publié: (2026)
Progressive Semantic-Guided Vision Transformer for Zero-Shot Learning
par: Chen, Shiming, et autres
Publié: (2024)
par: Chen, Shiming, et autres
Publié: (2024)
You Only Look One Step: Accelerating Backpropagation in Diffusion Sampling with Gradient Shortcuts
par: Dou, Hongkun, et autres
Publié: (2025)
par: Dou, Hongkun, et autres
Publié: (2025)
Entropy Guided Dynamic Patch Segmentation for Time Series Transformers
par: Abeywickrama, Sachith, et autres
Publié: (2025)
par: Abeywickrama, Sachith, et autres
Publié: (2025)
Verifying Robust Unlearning: Probing Residual Knowledge in Unlearned Models
par: Xuan, Hao, et autres
Publié: (2025)
par: Xuan, Hao, et autres
Publié: (2025)
MADFormer: Mixed Autoregressive and Diffusion Transformers for Continuous Image Generation
par: Chen, Junhao, et autres
Publié: (2025)
par: Chen, Junhao, et autres
Publié: (2025)
Reinforcement Learning with Generative Models for Compact Support Sets
par: Schiavone, Nico, et autres
Publié: (2024)
par: Schiavone, Nico, et autres
Publié: (2024)
D$^{3}$ToM: Decider-Guided Dynamic Token Merging for Accelerating Diffusion MLLMs
par: Chang, Shuochen, et autres
Publié: (2025)
par: Chang, Shuochen, et autres
Publié: (2025)
Adversarial Score identity Distillation: Rapidly Surpassing the Teacher in One Step
par: Zhou, Mingyuan, et autres
Publié: (2024)
par: Zhou, Mingyuan, et autres
Publié: (2024)
EDA-DM: Enhanced Distribution Alignment for Post-Training Quantization of Diffusion Models
par: Liu, Xuewen, et autres
Publié: (2024)
par: Liu, Xuewen, et autres
Publié: (2024)
Diffusion Transformers with Representation Autoencoders
par: Zheng, Boyang, et autres
Publié: (2025)
par: Zheng, Boyang, et autres
Publié: (2025)
Spectrally-Guided Diffusion Noise Schedules
par: Esteves, Carlos, et autres
Publié: (2026)
par: Esteves, Carlos, et autres
Publié: (2026)
Simplified Diffusion Schrödinger Bridge
par: Tang, Zhicong, et autres
Publié: (2024)
par: Tang, Zhicong, et autres
Publié: (2024)
Documents similaires
-
Taming Sampling Perturbations with Variance Expansion Loss for Latent Diffusion Models
par: Li, Qifan, et autres
Publié: (2026) -
Inductive Gradient Adjustment For Spectral Bias In Implicit Neural Representations
par: Shi, Kexuan, et autres
Publié: (2024) -
Guiding a Diffusion Model with a Bad Version of Itself
par: Karras, Tero, et autres
Publié: (2024) -
Texture Vector-Quantization and Reconstruction Aware Prediction for Generative Super-Resolution
par: Li, Qifan, et autres
Publié: (2025) -
Progressive Focused Transformer for Single Image Super-Resolution
par: Long, Wei, et autres
Publié: (2025)