Directly Fine-Tuning Diffusion Models on Differentiable Rewards
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Clark, Kevin, Vicol, Paul, Swersky, Kevin, Fleet, David J |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Video models are zero-shot learners and reasoners
par: Wiedemer, Thaddäus, et autres
Publié: (2025)
par: Wiedemer, Thaddäus, et autres
Publié: (2025)
AugLoss: A Robust Augmentation-based Fine Tuning Methodology
par: Otstot, Kyle, et autres
Publié: (2022)
par: Otstot, Kyle, et autres
Publié: (2022)
Greedy Growing Enables High-Resolution Pixel-Based Diffusion Models
par: Vasconcelos, Cristina N., et autres
Publié: (2024)
par: Vasconcelos, Cristina N., et autres
Publié: (2024)
Spectrum-Aware Parameter Efficient Fine-Tuning for Diffusion Models
par: Zhang, Xinxi, et autres
Publié: (2024)
par: Zhang, Xinxi, et autres
Publié: (2024)
Efficient Fine-Tuning and Concept Suppression for Pruned Diffusion Models
par: Shirkavand, Reza, et autres
Publié: (2024)
par: Shirkavand, Reza, et autres
Publié: (2024)
Do generative video models understand physical principles?
par: Motamed, Saman, et autres
Publié: (2025)
par: Motamed, Saman, et autres
Publié: (2025)
A Personalized Video-Based Hand Taxonomy: Application for Individuals with Spinal Cord Injury
par: Dousty, Mehdy, et autres
Publié: (2024)
par: Dousty, Mehdy, et autres
Publié: (2024)
CRAFT: Aligning Diffusion Models with Fine-Tuning Is Easier Than You Think
par: Sun, Zening, et autres
Publié: (2026)
par: Sun, Zening, et autres
Publié: (2026)
VARD: Efficient and Dense Fine-Tuning for Diffusion Models with Value-based RL
par: Dai, Fengyuan, et autres
Publié: (2025)
par: Dai, Fengyuan, et autres
Publié: (2025)
Reward Score Matching: Unifying Reward-based Fine-tuning for Flow and Diffusion Models
par: Lee, Jeongjae, et autres
Publié: (2026)
par: Lee, Jeongjae, et autres
Publié: (2026)
Towards Understanding Multimodal Fine-Tuning: Spatial Features
par: Naghashyar, Lachin, et autres
Publié: (2026)
par: Naghashyar, Lachin, et autres
Publié: (2026)
Data-Efficient Ensemble Weather Forecasting with Diffusion Models
par: Valencia, Kevin, et autres
Publié: (2025)
par: Valencia, Kevin, et autres
Publié: (2025)
One Step Diffusion via Shortcut Models
par: Frans, Kevin, et autres
Publié: (2024)
par: Frans, Kevin, et autres
Publié: (2024)
When Are Concepts Erased From Diffusion Models?
par: Lu, Kevin, et autres
Publié: (2025)
par: Lu, Kevin, et autres
Publié: (2025)
Online Reward-Weighted Fine-Tuning of Flow Matching with Wasserstein Regularization
par: Fan, Jiajun, et autres
Publié: (2025)
par: Fan, Jiajun, et autres
Publié: (2025)
Using Human Feedback to Fine-tune Diffusion Models without Any Reward Model
par: Yang, Kai, et autres
Publié: (2023)
par: Yang, Kai, et autres
Publié: (2023)
Contrastive Learning to Fine-Tune Feature Extraction Models for the Visual Cortex
par: Mulrooney, Alex, et autres
Publié: (2024)
par: Mulrooney, Alex, et autres
Publié: (2024)
CryoSPIN: Improving Ab-Initio Cryo-EM Reconstruction with Semi-Amortized Pose Inference
par: Shekarforoush, Shayan, et autres
Publié: (2024)
par: Shekarforoush, Shayan, et autres
Publié: (2024)
Diffusion-DRF: Free, Rich, and Differentiable Reward for Video Diffusion Fine-Tuning
par: Wang, Yifan, et autres
Publié: (2026)
par: Wang, Yifan, et autres
Publié: (2026)
Directional Gradient Projection for Robust Fine-Tuning of Foundation Models
par: Huang, Chengyue, et autres
Publié: (2025)
par: Huang, Chengyue, et autres
Publié: (2025)
Policy-based Tuning of Autoregressive Image Models with Instance- and Distribution-Level Rewards
par: Baran, Orhun Buğra, et autres
Publié: (2026)
par: Baran, Orhun Buğra, et autres
Publié: (2026)
On the Robustness Tradeoff in Fine-Tuning
par: Li, Kunyang, et autres
Publié: (2025)
par: Li, Kunyang, et autres
Publié: (2025)
Diffusing Differentiable Representations
par: Savani, Yash, et autres
Publié: (2024)
par: Savani, Yash, et autres
Publié: (2024)
Task-Specific Directions: Definition, Exploration, and Utilization in Parameter Efficient Fine-Tuning
par: Si, Chongjie, et autres
Publié: (2024)
par: Si, Chongjie, et autres
Publié: (2024)
Diffusion Reward: Learning Rewards via Conditional Video Diffusion
par: Huang, Tao, et autres
Publié: (2023)
par: Huang, Tao, et autres
Publié: (2023)
Diffusion Tuning: Transferring Diffusion Models via Chain of Forgetting
par: Zhong, Jincheng, et autres
Publié: (2024)
par: Zhong, Jincheng, et autres
Publié: (2024)
Efficient and Versatile Robust Fine-Tuning of Zero-shot Models
par: Kim, Sungyeon, et autres
Publié: (2024)
par: Kim, Sungyeon, et autres
Publié: (2024)
DP-RDM: Adapting Diffusion Models to Private Domains Without Fine-Tuning
par: Lebensold, Jonathan, et autres
Publié: (2024)
par: Lebensold, Jonathan, et autres
Publié: (2024)
Risks When Sharing LoRA Fine-Tuned Diffusion Model Weights
par: Yao, Dixi
Publié: (2024)
par: Yao, Dixi
Publié: (2024)
Personalized Preference Fine-tuning of Diffusion Models
par: Dang, Meihua, et autres
Publié: (2025)
par: Dang, Meihua, et autres
Publié: (2025)
Beyond Pairwise Preferences: Listwise Reward-Aware Alignment for Diffusion Models
par: Wang, Austin, et autres
Publié: (2026)
par: Wang, Austin, et autres
Publié: (2026)
Aligning Few-Step Diffusion Models with Dense Reward Difference Learning
par: Zhang, Ziyi, et autres
Publié: (2024)
par: Zhang, Ziyi, et autres
Publié: (2024)
GDRO: Group-level Reward Post-training Suitable for Diffusion Models
par: Wang, Yiyang, et autres
Publié: (2026)
par: Wang, Yiyang, et autres
Publié: (2026)
ParetoSlider: Diffusion Models Post-Training for Continuous Reward Control
par: Golan, Shelly, et autres
Publié: (2026)
par: Golan, Shelly, et autres
Publié: (2026)
Long-Tail Learning with Foundation Model: Heavy Fine-Tuning Hurts
par: Shi, Jiang-Xin, et autres
Publié: (2023)
par: Shi, Jiang-Xin, et autres
Publié: (2023)
FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models
par: Zheng, Weiying, et autres
Publié: (2025)
par: Zheng, Weiying, et autres
Publié: (2025)
Rethinking Fine-Tuning: Unlocking Hidden Capabilities in Vision-Language Models
par: Zhang, Mingyuan, et autres
Publié: (2025)
par: Zhang, Mingyuan, et autres
Publié: (2025)
Half-order Fine-Tuning for Diffusion Model: A Recursive Likelihood Ratio Optimizer
par: Ren, Tao, et autres
Publié: (2025)
par: Ren, Tao, et autres
Publié: (2025)
RobustNeRF: Ignoring Distractors with Robust Losses
par: Sabour, Sara, et autres
Publié: (2023)
par: Sabour, Sara, et autres
Publié: (2023)
Self-Play Fine-Tuning of Diffusion Models for Text-to-Image Generation
par: Yuan, Huizhuo, et autres
Publié: (2024)
par: Yuan, Huizhuo, et autres
Publié: (2024)
Documents similaires
-
Video models are zero-shot learners and reasoners
par: Wiedemer, Thaddäus, et autres
Publié: (2025) -
AugLoss: A Robust Augmentation-based Fine Tuning Methodology
par: Otstot, Kyle, et autres
Publié: (2022) -
Greedy Growing Enables High-Resolution Pixel-Based Diffusion Models
par: Vasconcelos, Cristina N., et autres
Publié: (2024) -
Spectrum-Aware Parameter Efficient Fine-Tuning for Diffusion Models
par: Zhang, Xinxi, et autres
Publié: (2024) -
Efficient Fine-Tuning and Concept Suppression for Pruned Diffusion Models
par: Shirkavand, Reza, et autres
Publié: (2024)