Alignment of Diffusion Models: Fundamentals, Challenges, and Future
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Buhua, Shao, Shitong, Li, Bao, Bai, Lichen, Xu, Zhiqiang, Xiong, Haoyi, Kwok, James, Helal, Sumi, Xie, Zeke |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Efficient Video Diffusion Models: Advancements and Challenges
por: Shao, Shitong, et al.
Publicado: (2026)
por: Shao, Shitong, et al.
Publicado: (2026)
IV-Mixed Sampler: Leveraging Image Diffusion Models for Enhanced Video Synthesis
por: Shao, Shitong, et al.
Publicado: (2024)
por: Shao, Shitong, et al.
Publicado: (2024)
Zigzag Diffusion Sampling: Diffusion Models Can Self-Improve via Self-Reflection
por: Bai, Lichen, et al.
Publicado: (2024)
por: Bai, Lichen, et al.
Publicado: (2024)
Not All Noises Are Created Equally:Diffusion Noise Selection and Optimization
por: Qi, Zipeng, et al.
Publicado: (2024)
por: Qi, Zipeng, et al.
Publicado: (2024)
Golden Noise for Diffusion Models: A Learning Framework
por: Zhou, Zikai, et al.
Publicado: (2024)
por: Zhou, Zikai, et al.
Publicado: (2024)
A Simple and Efficient Baseline for Zero-Shot Generative Classification
por: Qi, Zipeng, et al.
Publicado: (2024)
por: Qi, Zipeng, et al.
Publicado: (2024)
Reflective Flow Sampling Enhancement
por: Zhou, Zikai, et al.
Publicado: (2026)
por: Zhou, Zikai, et al.
Publicado: (2026)
CRAFT: Aligning Diffusion Models with Fine-Tuning Is Easier Than You Think
por: Sun, Zening, et al.
Publicado: (2026)
por: Sun, Zening, et al.
Publicado: (2026)
Bag of Design Choices for Inference of High-Resolution Masked Generative Transformer
por: Shao, Shitong, et al.
Publicado: (2024)
por: Shao, Shitong, et al.
Publicado: (2024)
PISA: Piecewise Sparse Attention Is Wiser for Efficient Diffusion Transformers
por: Li, Haopeng, et al.
Publicado: (2026)
por: Li, Haopeng, et al.
Publicado: (2026)
Weak-to-Strong Diffusion with Reflection
por: Bai, Lichen, et al.
Publicado: (2025)
por: Bai, Lichen, et al.
Publicado: (2025)
CoRe^2: Collect, Reflect and Refine to Generate Better and Faster
por: Shao, Shitong, et al.
Publicado: (2025)
por: Shao, Shitong, et al.
Publicado: (2025)
Exploring Data-Free LoRA Transferability for Video Diffusion Models
por: Wang, Yuchen, et al.
Publicado: (2026)
por: Wang, Yuchen, et al.
Publicado: (2026)
LIVEditor-14B: Lightning Unified Video Editing via In-Context Sparse Attention
por: Shao, Shitong, et al.
Publicado: (2026)
por: Shao, Shitong, et al.
Publicado: (2026)
FastLightGen: Fast and Light Video Generation with Fewer Steps and Parameters
por: Shao, Shitong, et al.
Publicado: (2026)
por: Shao, Shitong, et al.
Publicado: (2026)
Guidance Matters: Rethinking the Evaluation Pitfall for Text-to-Image Generation
por: Xie, Dian, et al.
Publicado: (2026)
por: Xie, Dian, et al.
Publicado: (2026)
Optimizing Few-Step Generation with Adaptive Matching Distillation
por: Bai, Lichen, et al.
Publicado: (2026)
por: Bai, Lichen, et al.
Publicado: (2026)
MagicDistillation: Weak-to-Strong Video Distillation for Large-Scale Few-Step Synthesis
por: Shao, Shitong, et al.
Publicado: (2025)
por: Shao, Shitong, et al.
Publicado: (2025)
Neural Field Classifiers via Target Encoding and Classification Loss
por: Yang, Xindi, et al.
Publicado: (2024)
por: Yang, Xindi, et al.
Publicado: (2024)
Precise Knowledge Transfer via Flow Matching
por: Shao, Shitong, et al.
Publicado: (2024)
por: Shao, Shitong, et al.
Publicado: (2024)
Rethinking Centered Kernel Alignment in Knowledge Distillation
por: Zhou, Zikai, et al.
Publicado: (2024)
por: Zhou, Zikai, et al.
Publicado: (2024)
Self-supervised Dataset Distillation: A Good Compression Is All You Need
por: Zhou, Muxin, et al.
Publicado: (2024)
por: Zhou, Muxin, et al.
Publicado: (2024)
OD3: Optimization-free Dataset Distillation for Object Detection
por: Khatib, Salwa K. Al, et al.
Publicado: (2025)
por: Khatib, Salwa K. Al, et al.
Publicado: (2025)
LAST: LeArning to Think in Space and Time for Generalist Vision-Language Models
por: Wang, Shuai, et al.
Publicado: (2025)
por: Wang, Shuai, et al.
Publicado: (2025)
DELT: A Simple Diversity-driven EarlyLate Training for Dataset Distillation
por: Shen, Zhiqiang, et al.
Publicado: (2024)
por: Shen, Zhiqiang, et al.
Publicado: (2024)
Elucidating the Design Space of Dataset Condensation
por: Shao, Shitong, et al.
Publicado: (2024)
por: Shao, Shitong, et al.
Publicado: (2024)
Generalized Large-Scale Data Condensation via Various Backbone and Statistical Matching
por: Shao, Shitong, et al.
Publicado: (2023)
por: Shao, Shitong, et al.
Publicado: (2023)
Removing Averaging: Personalized Lip-Sync Driven Characters Based on Identity Adapter
por: Zhu, Yanyu, et al.
Publicado: (2025)
por: Zhu, Yanyu, et al.
Publicado: (2025)
Your Diffusion Model is Secretly a Certifiably Robust Classifier
por: Chen, Huanran, et al.
Publicado: (2024)
por: Chen, Huanran, et al.
Publicado: (2024)
MagicInfinite: Generating Infinite Talking Videos with Your Words and Voice
por: Yi, Hongwei, et al.
Publicado: (2025)
por: Yi, Hongwei, et al.
Publicado: (2025)
HyperAlign: Hypernetwork for Efficient Test-Time Alignment of Diffusion Models
por: Xie, Xin, et al.
Publicado: (2026)
por: Xie, Xin, et al.
Publicado: (2026)
Implicit Concept Removal of Diffusion Models
por: Liu, Zhili, et al.
Publicado: (2023)
por: Liu, Zhili, et al.
Publicado: (2023)
Feature Alignment Determines Fusion Strategy: A Comparative Study of Cross-Attention and Concatenation in Multimodal Learning
por: Zhou, Zhiqiang, et al.
Publicado: (2026)
por: Zhou, Zhiqiang, et al.
Publicado: (2026)
DyMO: Training-Free Diffusion Model Alignment with Dynamic Multi-Objective Scheduling
por: Xie, Xin, et al.
Publicado: (2024)
por: Xie, Xin, et al.
Publicado: (2024)
From Preferences to Prejudice: The Role of Alignment Tuning in Shaping Social Bias in Video Diffusion Models
por: Cai, Zefan, et al.
Publicado: (2025)
por: Cai, Zefan, et al.
Publicado: (2025)
Learning to Generate Vectorized Maps at Intersections with Multiple Roadside Cameras
por: Zheng, Quanxin, et al.
Publicado: (2025)
por: Zheng, Quanxin, et al.
Publicado: (2025)
Coordinative Learning with Ordinal and Relational Priors for Volumetric Medical Image Segmentation
por: Wang, Haoyi
Publicado: (2025)
por: Wang, Haoyi
Publicado: (2025)
MVPainter: Accurate and Detailed 3D Texture Generation via Multi-View Diffusion with Geometric Control
por: Shao, Mingqi, et al.
Publicado: (2025)
por: Shao, Mingqi, et al.
Publicado: (2025)
SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer
por: Zhu, Haoyi, et al.
Publicado: (2026)
por: Zhu, Haoyi, et al.
Publicado: (2026)
SGD: Street View Synthesis with Gaussian Splatting and Diffusion Prior
por: Yu, Zhongrui, et al.
Publicado: (2024)
por: Yu, Zhongrui, et al.
Publicado: (2024)
Ejemplares similares
-
Efficient Video Diffusion Models: Advancements and Challenges
por: Shao, Shitong, et al.
Publicado: (2026) -
IV-Mixed Sampler: Leveraging Image Diffusion Models for Enhanced Video Synthesis
por: Shao, Shitong, et al.
Publicado: (2024) -
Zigzag Diffusion Sampling: Diffusion Models Can Self-Improve via Self-Reflection
por: Bai, Lichen, et al.
Publicado: (2024) -
Not All Noises Are Created Equally:Diffusion Noise Selection and Optimization
por: Qi, Zipeng, et al.
Publicado: (2024) -
Golden Noise for Diffusion Models: A Learning Framework
por: Zhou, Zikai, et al.
Publicado: (2024)