Efficient Diffusion Training via Min-SNR Weighting Strategy
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hang, Tiankai, Gu, Shuyang, Li, Chen, Bao, Jianmin, Chen, Dong, Hu, Han, Geng, Xin, Guo, Baining |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improved Noise Schedule for Diffusion Training
par: Hang, Tiankai, et autres
Publié: (2024)
par: Hang, Tiankai, et autres
Publié: (2024)
CCA: Collaborative Competitive Agents for Image Editing
par: Hang, Tiankai, et autres
Publié: (2024)
par: Hang, Tiankai, et autres
Publié: (2024)
Simplified Diffusion Schrödinger Bridge
par: Tang, Zhicong, et autres
Publié: (2024)
par: Tang, Zhicong, et autres
Publié: (2024)
Incorporating Pre-trained Diffusion Models in Solving the Schrödinger Bridge Problem
par: Tang, Zhicong, et autres
Publié: (2025)
par: Tang, Zhicong, et autres
Publié: (2025)
VolumeDiffusion: Flexible Text-to-3D Generation with Efficient Volumetric Encoder
par: Tang, Zhicong, et autres
Publié: (2023)
par: Tang, Zhicong, et autres
Publié: (2023)
Diffusion Models without Classifier-free Guidance
par: Tang, Zhicong, et autres
Publié: (2025)
par: Tang, Zhicong, et autres
Publié: (2025)
Fast Autoregressive Models for Continuous Latent Generation
par: Hang, Tiankai, et autres
Publié: (2025)
par: Hang, Tiankai, et autres
Publié: (2025)
Language-Guided Face Animation by Recurrent StyleGAN-based Generator
par: Hang, Tiankai, et autres
Publié: (2022)
par: Hang, Tiankai, et autres
Publié: (2022)
DesignDiffusion: High-Quality Text-to-Design Image Generation with Diffusion Models
par: Wang, Zhendong, et autres
Publié: (2025)
par: Wang, Zhendong, et autres
Publié: (2025)
Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization
par: Liang, Zhanhao, et autres
Publié: (2024)
par: Liang, Zhanhao, et autres
Publié: (2024)
CCEdit: Creative and Controllable Video Editing via Diffusion Models
par: Feng, Ruoyu, et autres
Publié: (2023)
par: Feng, Ruoyu, et autres
Publié: (2023)
FontStudio: Shape-Adaptive Diffusion Model for Coherent and Consistent Font Effect Generation
par: Mu, Xinzhi, et autres
Publié: (2024)
par: Mu, Xinzhi, et autres
Publié: (2024)
Optimal Stepsize for Diffusion Sampling
par: Pei, Jianning, et autres
Publié: (2025)
par: Pei, Jianning, et autres
Publié: (2025)
Tokenize Image as a Set
par: Geng, Zigang, et autres
Publié: (2025)
par: Geng, Zigang, et autres
Publié: (2025)
Semantic Image Synthesis via Diffusion Models
par: Zhou, Wengang, et autres
Publié: (2022)
par: Zhou, Wengang, et autres
Publié: (2022)
Equivariant Image Modeling
par: Dong, Ruixiao, et autres
Publié: (2025)
par: Dong, Ruixiao, et autres
Publié: (2025)
MageBench: Bridging Large Multimodal Models to Agents
par: Zhang, Miaosen, et autres
Publié: (2024)
par: Zhang, Miaosen, et autres
Publié: (2024)
HiAR: Efficient Autoregressive Long Video Generation via Hierarchical Denoising
par: Zou, Kai, et autres
Publié: (2026)
par: Zou, Kai, et autres
Publié: (2026)
Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis
par: Zhang, Bowen, et autres
Publié: (2025)
par: Zhang, Bowen, et autres
Publié: (2025)
DilateQuant: Accurate and Efficient Diffusion Quantization via Weight Dilation
par: Liu, Xuewen, et autres
Publié: (2024)
par: Liu, Xuewen, et autres
Publié: (2024)
Lens: Rethinking Training Efficiency for Foundational Text-to-Image Models
par: Chen, Dong, et autres
Publié: (2026)
par: Chen, Dong, et autres
Publié: (2026)
PromptEnhancer: A Simple Approach to Enhance Text-to-Image Models via Chain-of-Thought Prompt Rewriting
par: Wang, Linqing, et autres
Publié: (2025)
par: Wang, Linqing, et autres
Publié: (2025)
EfficientCD: A New Strategy For Change Detection Based With Bi-temporal Layers Exchanged
par: Dong, Sijun, et autres
Publié: (2024)
par: Dong, Sijun, et autres
Publié: (2024)
Elucidating the SNR-t Bias of Diffusion Probabilistic Models
par: Yu, Meng, et autres
Publié: (2026)
par: Yu, Meng, et autres
Publié: (2026)
RodinHD: High-Fidelity 3D Avatar Generation with Diffusion Models
par: Zhang, Bowen, et autres
Publié: (2024)
par: Zhang, Bowen, et autres
Publié: (2024)
HairShifter: Consistent and High-Fidelity Video Hair Transfer via Anchor-Guided Animation
par: Shi, Wangzheng, et autres
Publié: (2025)
par: Shi, Wangzheng, et autres
Publié: (2025)
Exploiting Vision Language Model for Training-Free 3D Point Cloud OOD Detection via Graph Score Propagation
par: Chen, Tiankai, et autres
Publié: (2025)
par: Chen, Tiankai, et autres
Publié: (2025)
HyperAlign: Hypernetwork for Efficient Test-Time Alignment of Diffusion Models
par: Xie, Xin, et autres
Publié: (2026)
par: Xie, Xin, et autres
Publié: (2026)
Unbiased Gradient Estimation for Event Binning via Functional Backpropagation
par: Chen, Jinze, et autres
Publié: (2026)
par: Chen, Jinze, et autres
Publié: (2026)
Weight Group-wise Post-Training Quantization for Medical Foundation Model
par: Chen, Yineng, et autres
Publié: (2026)
par: Chen, Yineng, et autres
Publié: (2026)
Revealing the Power of Post-Training for Small Language Models via Knowledge Distillation
par: Rang, Miao, et autres
Publié: (2025)
par: Rang, Miao, et autres
Publié: (2025)
Several questions of visual generation in 2024
par: Gu, Shuyang
Publié: (2024)
par: Gu, Shuyang
Publié: (2024)
SFormer: SNR-guided Transformer for Underwater Image Enhancement from the Frequency Domain
par: Tian, Xin, et autres
Publié: (2025)
par: Tian, Xin, et autres
Publié: (2025)
Efficient Dataset Distillation via Minimax Diffusion
par: Gu, Jianyang, et autres
Publié: (2023)
par: Gu, Jianyang, et autres
Publié: (2023)
Efficient Transferable Optimal Transport via Min-Sliced Transport Plans
par: Liu, Xinran, et autres
Publié: (2025)
par: Liu, Xinran, et autres
Publié: (2025)
DreamSR: Towards Ultra-High-Resolution Image Super-Resolution via a Receptive-Field Enhanced Diffusion Transformer
par: Dong, Qingji, et autres
Publié: (2026)
par: Dong, Qingji, et autres
Publié: (2026)
Coherent Video Inpainting Using Optical Flow-Guided Efficient Diffusion
par: Gu, Bohai, et autres
Publié: (2024)
par: Gu, Bohai, et autres
Publié: (2024)
Frequency-Guided Diffusion Model with Perturbation Training for Skeleton-Based Video Anomaly Detection
par: Tan, Xiaofeng, et autres
Publié: (2024)
par: Tan, Xiaofeng, et autres
Publié: (2024)
PatchScaler: An Efficient Patch-Independent Diffusion Model for Image Super-Resolution
par: Liu, Yong, et autres
Publié: (2024)
par: Liu, Yong, et autres
Publié: (2024)
EasyControl: Transfer ControlNet to Video Diffusion for Controllable Generation and Interpolation
par: Wang, Cong, et autres
Publié: (2024)
par: Wang, Cong, et autres
Publié: (2024)
Documents similaires
-
Improved Noise Schedule for Diffusion Training
par: Hang, Tiankai, et autres
Publié: (2024) -
CCA: Collaborative Competitive Agents for Image Editing
par: Hang, Tiankai, et autres
Publié: (2024) -
Simplified Diffusion Schrödinger Bridge
par: Tang, Zhicong, et autres
Publié: (2024) -
Incorporating Pre-trained Diffusion Models in Solving the Schrödinger Bridge Problem
par: Tang, Zhicong, et autres
Publié: (2025) -
VolumeDiffusion: Flexible Text-to-3D Generation with Efficient Volumetric Encoder
par: Tang, Zhicong, et autres
Publié: (2023)