Taming Sampling Perturbations with Variance Expansion Loss for Latent Diffusion Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Qifan, Zhou, Xingyu, Zhang, Jinhua, You, Weiyi, Gu, Shuhang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Uncertainty-guided Perturbation for Image Super-Resolution Diffusion Model
di: Zhang, Leheng, et al.
Pubblicazione: (2025)
di: Zhang, Leheng, et al.
Pubblicazione: (2025)
MVAR: Visual Autoregressive Modeling with Scale and Spatial Markovian Conditioning
di: Zhang, Jinhua, et al.
Pubblicazione: (2025)
di: Zhang, Jinhua, et al.
Pubblicazione: (2025)
Texture Vector-Quantization and Reconstruction Aware Prediction for Generative Super-Resolution
di: Li, Qifan, et al.
Pubblicazione: (2025)
di: Li, Qifan, et al.
Pubblicazione: (2025)
Guiding a Diffusion Transformer with the Internal Dynamics of Itself
di: Zhou, Xingyu, et al.
Pubblicazione: (2025)
di: Zhou, Xingyu, et al.
Pubblicazione: (2025)
Consistency Trajectory Matching for One-Step Generative Super-Resolution
di: You, Weiyi, et al.
Pubblicazione: (2025)
di: You, Weiyi, et al.
Pubblicazione: (2025)
Generative Image Compression by Estimating Gradients of the Rate-variable Feature Distribution
di: Han, Minghao, et al.
Pubblicazione: (2025)
di: Han, Minghao, et al.
Pubblicazione: (2025)
Small Clips, Big Gains: Learning Long-Range Refocused Temporal Information for Video Super-Resolution
di: Zhou, Xingyu, et al.
Pubblicazione: (2025)
di: Zhou, Xingyu, et al.
Pubblicazione: (2025)
Improved Implicit Neural Representation with Fourier Reparameterized Training
di: Shi, Kexuan, et al.
Pubblicazione: (2024)
di: Shi, Kexuan, et al.
Pubblicazione: (2024)
Progressive Focused Transformer for Single Image Super-Resolution
di: Long, Wei, et al.
Pubblicazione: (2025)
di: Long, Wei, et al.
Pubblicazione: (2025)
Learned Image Compression with Dictionary-based Entropy Model
di: Lu, Jingbo, et al.
Pubblicazione: (2025)
di: Lu, Jingbo, et al.
Pubblicazione: (2025)
Transcending the Limit of Local Window: Advanced Super-Resolution Transformer with Adaptive Token Dictionary
di: Zhang, Leheng, et al.
Pubblicazione: (2024)
di: Zhang, Leheng, et al.
Pubblicazione: (2024)
PerLDiff: Controllable Street View Synthesis Using Perspective-Layout Diffusion Models
di: Zhang, Jinhua, et al.
Pubblicazione: (2024)
di: Zhang, Jinhua, et al.
Pubblicazione: (2024)
LatentSync: Taming Audio-Conditioned Latent Diffusion Models for Lip Sync with SyncNet Supervision
di: Li, Chunyu, et al.
Pubblicazione: (2024)
di: Li, Chunyu, et al.
Pubblicazione: (2024)
ATD: Improved Transformer with Adaptive Token Dictionary for Image Restoration
di: Zhang, Leheng, et al.
Pubblicazione: (2026)
di: Zhang, Leheng, et al.
Pubblicazione: (2026)
Video Super-Resolution Transformer with Masked Inter&Intra-Frame Attention
di: Zhou, Xingyu, et al.
Pubblicazione: (2024)
di: Zhou, Xingyu, et al.
Pubblicazione: (2024)
DOME: Taming Diffusion Model into High-Fidelity Controllable Occupancy World Model
di: Gu, Songen, et al.
Pubblicazione: (2024)
di: Gu, Songen, et al.
Pubblicazione: (2024)
ChronosObserver: Taming 4D World with Hyperspace Diffusion Sampling
di: Wang, Qisen, et al.
Pubblicazione: (2025)
di: Wang, Qisen, et al.
Pubblicazione: (2025)
Reconstruction vs. Generation: Taming Optimization Dilemma in Latent Diffusion Models
di: Yao, Jingfeng, et al.
Pubblicazione: (2025)
di: Yao, Jingfeng, et al.
Pubblicazione: (2025)
DepthMaster: Taming Diffusion Models for Monocular Depth Estimation
di: Song, Ziyang, et al.
Pubblicazione: (2025)
di: Song, Ziyang, et al.
Pubblicazione: (2025)
Taming Latent Diffusion Model for Neural Radiance Field Inpainting
di: Lin, Chieh Hubert, et al.
Pubblicazione: (2024)
di: Lin, Chieh Hubert, et al.
Pubblicazione: (2024)
Unified Directly Denoising for Both Variance Preserving and Variance Exploding Diffusion Models
di: Wang, Jingjing, et al.
Pubblicazione: (2024)
di: Wang, Jingjing, et al.
Pubblicazione: (2024)
Kaleido Diffusion: Improving Conditional Diffusion Models with Autoregressive Latent Modeling
di: Gu, Jiatao, et al.
Pubblicazione: (2024)
di: Gu, Jiatao, et al.
Pubblicazione: (2024)
IDESplat: Iterative Depth Probability Estimation for Generalizable 3D Gaussian Splatting
di: Long, Wei, et al.
Pubblicazione: (2026)
di: Long, Wei, et al.
Pubblicazione: (2026)
Taming Feed-forward Reconstruction Models as Latent Encoders for 3D Generative Models
di: Wizadwongsa, Suttisak, et al.
Pubblicazione: (2024)
di: Wizadwongsa, Suttisak, et al.
Pubblicazione: (2024)
DiP: Taming Diffusion Models in Pixel Space
di: Chen, Zhennan, et al.
Pubblicazione: (2025)
di: Chen, Zhennan, et al.
Pubblicazione: (2025)
Ultrasound Image Enhancement with the Variance of Diffusion Models
di: Zhang, Yuxin, et al.
Pubblicazione: (2024)
di: Zhang, Yuxin, et al.
Pubblicazione: (2024)
UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation
di: Wang, Xiang, et al.
Pubblicazione: (2024)
di: Wang, Xiang, et al.
Pubblicazione: (2024)
CAT: Contrastive Adversarial Training for Evaluating the Robustness of Protective Perturbations in Latent Diffusion Models
di: Peng, Sen, et al.
Pubblicazione: (2025)
di: Peng, Sen, et al.
Pubblicazione: (2025)
HoloTime: Taming Video Diffusion Models for Panoramic 4D Scene Generation
di: Zhou, Haiyang, et al.
Pubblicazione: (2025)
di: Zhou, Haiyang, et al.
Pubblicazione: (2025)
An Efficient Watermarking Method for Latent Diffusion Models via Low-Rank Adaptation and Dynamic Loss Weighting
di: Lin, Dongdong, et al.
Pubblicazione: (2024)
di: Lin, Dongdong, et al.
Pubblicazione: (2024)
Taming Diffusion Models for Image Restoration: A Review
di: Luo, Ziwei, et al.
Pubblicazione: (2024)
di: Luo, Ziwei, et al.
Pubblicazione: (2024)
LatentINDIGO: An INN-Guided Latent Diffusion Algorithm for Image Restoration
di: You, Di, et al.
Pubblicazione: (2025)
di: You, Di, et al.
Pubblicazione: (2025)
Zero-1-to-G: Taming Pretrained 2D Diffusion Model for Direct 3D Generation
di: Meng, Xuyi, et al.
Pubblicazione: (2025)
di: Meng, Xuyi, et al.
Pubblicazione: (2025)
From Local Windows to Adaptive Candidates via Individualized Exploratory: Rethinking Attention for Image Super-Resolution
di: Meng, Chunyu, et al.
Pubblicazione: (2026)
di: Meng, Chunyu, et al.
Pubblicazione: (2026)
Taming the Long Tail: Rebalancing Adversarial Training via Adaptive Perturbation
di: Zhang, Lilin, et al.
Pubblicazione: (2026)
di: Zhang, Lilin, et al.
Pubblicazione: (2026)
VSDiffusion: Taming Ill-Posed Shadow Generation via Visibility-Constrained Diffusion
di: Li, Jing, et al.
Pubblicazione: (2026)
di: Li, Jing, et al.
Pubblicazione: (2026)
FairDiffusion: Enhancing Equity in Latent Diffusion Models via Fair Bayesian Perturbation
di: Luo, Yan, et al.
Pubblicazione: (2024)
di: Luo, Yan, et al.
Pubblicazione: (2024)
ControlSR: Taming Diffusion Models for Consistent Real-World Image Super Resolution
di: Wan, Yuhao, et al.
Pubblicazione: (2024)
di: Wan, Yuhao, et al.
Pubblicazione: (2024)
Alias-Free Latent Diffusion Models: Improving Fractional Shift Equivariance of Diffusion Latent Space
di: Zhou, Yifan, et al.
Pubblicazione: (2025)
di: Zhou, Yifan, et al.
Pubblicazione: (2025)
DiffSim: Taming Diffusion Models for Evaluating Visual Similarity
di: Song, Yiren, et al.
Pubblicazione: (2024)
di: Song, Yiren, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Uncertainty-guided Perturbation for Image Super-Resolution Diffusion Model
di: Zhang, Leheng, et al.
Pubblicazione: (2025) -
MVAR: Visual Autoregressive Modeling with Scale and Spatial Markovian Conditioning
di: Zhang, Jinhua, et al.
Pubblicazione: (2025) -
Texture Vector-Quantization and Reconstruction Aware Prediction for Generative Super-Resolution
di: Li, Qifan, et al.
Pubblicazione: (2025) -
Guiding a Diffusion Transformer with the Internal Dynamics of Itself
di: Zhou, Xingyu, et al.
Pubblicazione: (2025) -
Consistency Trajectory Matching for One-Step Generative Super-Resolution
di: You, Weiyi, et al.
Pubblicazione: (2025)