On the Feature Learning in Diffusion Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Han, Andi, Huang, Wei, Cao, Yuan, Zou, Difan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Understanding the Generalization of Stochastic Gradient Adam in Learning Neural Networks
di: Tang, Xuan, et al.
Pubblicazione: (2025)
di: Tang, Xuan, et al.
Pubblicazione: (2025)
On the Memorization of Consistency Distillation for Diffusion Models
di: Jiang, Bingqing, et al.
Pubblicazione: (2026)
di: Jiang, Bingqing, et al.
Pubblicazione: (2026)
Can Diffusion Models Learn Hidden Inter-Feature Rules Behind Images?
di: Han, Yujin, et al.
Pubblicazione: (2025)
di: Han, Yujin, et al.
Pubblicazione: (2025)
Capturing Conditional Dependence via Auto-regressive Diffusion Models
di: Huang, Xunpeng, et al.
Pubblicazione: (2025)
di: Huang, Xunpeng, et al.
Pubblicazione: (2025)
How Does Label Noise Gradient Descent Improve Generalization in the Low SNR Regime?
di: Huang, Wei, et al.
Pubblicazione: (2025)
di: Huang, Wei, et al.
Pubblicazione: (2025)
The Implicit Bias of Adam on Separable Data
di: Zhang, Chenyang, et al.
Pubblicazione: (2024)
di: Zhang, Chenyang, et al.
Pubblicazione: (2024)
Gradient Descent Robustly Learns the Intrinsic Dimension of Data in Training Convolutional Neural Networks
di: Zhang, Chenyang, et al.
Pubblicazione: (2025)
di: Zhang, Chenyang, et al.
Pubblicazione: (2025)
Improving Group Robustness on Spurious Correlation Requires Preciser Group Inference
di: Han, Yujin, et al.
Pubblicazione: (2024)
di: Han, Yujin, et al.
Pubblicazione: (2024)
Hierarchical Koopman Diffusion: Fast Generation with Interpretable Diffusion Trajectory
di: Bai, Hanru, et al.
Pubblicazione: (2025)
di: Bai, Hanru, et al.
Pubblicazione: (2025)
What Can Transformer Learn with Varying Depth? Case Studies on Sequence Learning Tasks
di: Chen, Xingwu, et al.
Pubblicazione: (2024)
di: Chen, Xingwu, et al.
Pubblicazione: (2024)
Initialization Matters: On the Benign Overfitting of Two-Layer ReLU CNN with Fully Trainable Layers
di: Shang, Shuning, et al.
Pubblicazione: (2024)
di: Shang, Shuning, et al.
Pubblicazione: (2024)
Physics-Informed Distillation of Diffusion Models for PDE-Constrained Generation
di: Zhang, Yi, et al.
Pubblicazione: (2025)
di: Zhang, Yi, et al.
Pubblicazione: (2025)
On the Comparison between Multi-modal and Single-modal Contrastive Learning
di: Huang, Wei, et al.
Pubblicazione: (2024)
di: Huang, Wei, et al.
Pubblicazione: (2024)
On the Collapse Errors Induced by the Deterministic Sampler for Diffusion Models
di: Zhang, Yi, et al.
Pubblicazione: (2025)
di: Zhang, Yi, et al.
Pubblicazione: (2025)
On the Limitation and Experience Replay for GNNs in Continual Learning
di: Su, Junwei, et al.
Pubblicazione: (2023)
di: Su, Junwei, et al.
Pubblicazione: (2023)
On the Role of Label Noise in the Feature Learning Process
di: Han, Andi, et al.
Pubblicazione: (2025)
di: Han, Andi, et al.
Pubblicazione: (2025)
Provably Learning Diffusion Models under the Manifold Hypothesis: Collapse and Refine
di: Huang, Wei, et al.
Pubblicazione: (2026)
di: Huang, Wei, et al.
Pubblicazione: (2026)
An In-depth Investigation of Sparse Rate Reduction in Transformer-like Models
di: Hu, Yunzhe, et al.
Pubblicazione: (2024)
di: Hu, Yunzhe, et al.
Pubblicazione: (2024)
How Transformers Utilize Multi-Head Attention in In-Context Learning? A Case Study on Sparse Linear Regression
di: Chen, Xingwu, et al.
Pubblicazione: (2024)
di: Chen, Xingwu, et al.
Pubblicazione: (2024)
An Improved Analysis of Langevin Algorithms with Prior Diffusion for Non-Log-Concave Sampling
di: Huang, Xunpeng, et al.
Pubblicazione: (2024)
di: Huang, Xunpeng, et al.
Pubblicazione: (2024)
A Human-Like Reasoning Framework for Multi-Phases Planning Task with Large Language Models
di: Xie, Chengxing, et al.
Pubblicazione: (2024)
di: Xie, Chengxing, et al.
Pubblicazione: (2024)
Reverse Transition Kernel: A Flexible Framework to Accelerate Diffusion Inference
di: Huang, Xunpeng, et al.
Pubblicazione: (2024)
di: Huang, Xunpeng, et al.
Pubblicazione: (2024)
Learning under Quantization for High-Dimensional Linear Regression
di: Zhang, Dechen, et al.
Pubblicazione: (2025)
di: Zhang, Dechen, et al.
Pubblicazione: (2025)
Structured Role-Aware Policy Optimization for Multimodal Reasoning
di: Jiang, Bingqing, et al.
Pubblicazione: (2026)
di: Jiang, Bingqing, et al.
Pubblicazione: (2026)
SIDE: Surrogate Conditional Data Extraction from Diffusion Models
di: Chen, Yunhao, et al.
Pubblicazione: (2024)
di: Chen, Yunhao, et al.
Pubblicazione: (2024)
Faster Sampling without Isoperimetry via Diffusion-based Monte Carlo
di: Huang, Xunpeng, et al.
Pubblicazione: (2024)
di: Huang, Xunpeng, et al.
Pubblicazione: (2024)
Towards Robust Graph Incremental Learning on Evolving Graphs
di: Su, Junwei, et al.
Pubblicazione: (2024)
di: Su, Junwei, et al.
Pubblicazione: (2024)
On the $ε$-Free Inference Complexity of Absorbing Discrete Diffusion
di: Huang, Xunpeng, et al.
Pubblicazione: (2025)
di: Huang, Xunpeng, et al.
Pubblicazione: (2025)
Extracting Training Data from Unconditional Diffusion Models
di: Chen, Yunhao, et al.
Pubblicazione: (2024)
di: Chen, Yunhao, et al.
Pubblicazione: (2024)
F-Adapter: Frequency-Adaptive Parameter-Efficient Fine-Tuning in Scientific Machine Learning
di: Zhang, Hangwei, et al.
Pubblicazione: (2025)
di: Zhang, Hangwei, et al.
Pubblicazione: (2025)
Improving Implicit Regularization of SGD with Preconditioning for Least Square Problems
di: Su, Junwei, et al.
Pubblicazione: (2024)
di: Su, Junwei, et al.
Pubblicazione: (2024)
PRES: Toward Scalable Memory-Based Dynamic Graph Neural Networks
di: Su, Junwei, et al.
Pubblicazione: (2024)
di: Su, Junwei, et al.
Pubblicazione: (2024)
Physics-Informed Neural PDE Solvers via Spatio-Temporal MeanFlow
di: Bai, Hanru, et al.
Pubblicazione: (2026)
di: Bai, Hanru, et al.
Pubblicazione: (2026)
The Implicit Bias of Steepest Descent with Mini-batch Stochastic Gradient
di: Li, Jichu, et al.
Pubblicazione: (2026)
di: Li, Jichu, et al.
Pubblicazione: (2026)
Hyper-SET: Designing Transformers via Hyperspherical Energy Minimization
di: Hu, Yunzhe, et al.
Pubblicazione: (2025)
di: Hu, Yunzhe, et al.
Pubblicazione: (2025)
On the Robustness of Transformers against Context Hijacking for Linear Classification
di: Li, Tianle, et al.
Pubblicazione: (2025)
di: Li, Tianle, et al.
Pubblicazione: (2025)
Almost Linear Convergence under Minimal Score Assumptions: Quantized Transition Diffusion
di: Huang, Xunpeng, et al.
Pubblicazione: (2025)
di: Huang, Xunpeng, et al.
Pubblicazione: (2025)
From Channel Bias to Feature Redundancy: Uncovering the "Less is More" Principle in Few-Shot Learning
di: Zhang, Ji, et al.
Pubblicazione: (2023)
di: Zhang, Ji, et al.
Pubblicazione: (2023)
DPRM: A Plug-in Doob h transform-induced Token-Ordering Module for Diffusion Language Models
di: Bu, Dake, et al.
Pubblicazione: (2026)
di: Bu, Dake, et al.
Pubblicazione: (2026)
Faster Sampling via Stochastic Gradient Proximal Sampler
di: Huang, Xunpeng, et al.
Pubblicazione: (2024)
di: Huang, Xunpeng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Understanding the Generalization of Stochastic Gradient Adam in Learning Neural Networks
di: Tang, Xuan, et al.
Pubblicazione: (2025) -
On the Memorization of Consistency Distillation for Diffusion Models
di: Jiang, Bingqing, et al.
Pubblicazione: (2026) -
Can Diffusion Models Learn Hidden Inter-Feature Rules Behind Images?
di: Han, Yujin, et al.
Pubblicazione: (2025) -
Capturing Conditional Dependence via Auto-regressive Diffusion Models
di: Huang, Xunpeng, et al.
Pubblicazione: (2025) -
How Does Label Noise Gradient Descent Improve Generalization in the Low SNR Regime?
di: Huang, Wei, et al.
Pubblicazione: (2025)