Reward Sharpness-Aware Fine-Tuning for Diffusion Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Kim, Kwanyoung, Sim, Byeongsu |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
PLADIS: Pushing the Limits of Attention in Diffusion Models at Inference Time by Leveraging Sparsity
von: Kim, Kwanyoung, et al.
Veröffentlicht: (2025)
von: Kim, Kwanyoung, et al.
Veröffentlicht: (2025)
Geometry-Aware Attention Guidance for Diffusion Models via Modern Hopfield Dynamics
von: Kim, Kwanyoung
Veröffentlicht: (2026)
von: Kim, Kwanyoung
Veröffentlicht: (2026)
Improving Diffusion Models for Inverse Problems using Manifold Constraints
von: Chung, Hyungjin, et al.
Veröffentlicht: (2022)
von: Chung, Hyungjin, et al.
Veröffentlicht: (2022)
Bi-LoRA: Efficient Sharpness-Aware Minimization for Fine-Tuning Large-Scale Models
von: Liu, Yuhang, et al.
Veröffentlicht: (2025)
von: Liu, Yuhang, et al.
Veröffentlicht: (2025)
Iterative Distillation for Reward-Guided Fine-Tuning of Diffusion Models in Biomolecular Design
von: Su, Xingyu, et al.
Veröffentlicht: (2025)
von: Su, Xingyu, et al.
Veröffentlicht: (2025)
Model-based Offline Reinforcement Learning with Lower Expectile Q-Learning
von: Park, Kwanyoung, et al.
Veröffentlicht: (2024)
von: Park, Kwanyoung, et al.
Veröffentlicht: (2024)
TLDR: Unsupervised Goal-Conditioned RL via Temporal Distance-Aware Representations
von: Bae, Junik, et al.
Veröffentlicht: (2024)
von: Bae, Junik, et al.
Veröffentlicht: (2024)
Fine-Tuning Discrete Diffusion Models via Reward Optimization with Applications to DNA and Protein Design
von: Wang, Chenyu, et al.
Veröffentlicht: (2024)
von: Wang, Chenyu, et al.
Veröffentlicht: (2024)
ScaleDiff: Higher-Resolution Image Synthesis via Efficient and Model-Agnostic Diffusion
von: Koh, Sungho, et al.
Veröffentlicht: (2025)
von: Koh, Sungho, et al.
Veröffentlicht: (2025)
Portable Reward Tuning: Towards Reusable Fine-Tuning across Different Pretrained Models
von: Chijiwa, Daiki, et al.
Veröffentlicht: (2025)
von: Chijiwa, Daiki, et al.
Veröffentlicht: (2025)
Fine-Tuning Language Models with Reward Learning on Policy
von: Lang, Hao, et al.
Veröffentlicht: (2024)
von: Lang, Hao, et al.
Veröffentlicht: (2024)
PIRF: Physics-Informed Reward Fine-Tuning for Diffusion Models
von: Yuan, Mingze, et al.
Veröffentlicht: (2025)
von: Yuan, Mingze, et al.
Veröffentlicht: (2025)
Stability Analysis of Sharpness-Aware Minimization
von: Kim, Hoki, et al.
Veröffentlicht: (2023)
von: Kim, Hoki, et al.
Veröffentlicht: (2023)
Pioneering 4-Bit FP Quantization for Diffusion Models: Mixup-Sign Quantization and Timestep-Aware Fine-Tuning
von: Zhao, Maosen, et al.
Veröffentlicht: (2025)
von: Zhao, Maosen, et al.
Veröffentlicht: (2025)
Representation Without Reward: A JEPA Audit for LLM Fine-Tuning
von: Sengupta, Biswa
Veröffentlicht: (2026)
von: Sengupta, Biswa
Veröffentlicht: (2026)
RIFT: Repurposing Negative Samples via Reward-Informed Fine-Tuning
von: Liu, Zehua, et al.
Veröffentlicht: (2026)
von: Liu, Zehua, et al.
Veröffentlicht: (2026)
Fine-Tuning Diffusion Models via Intermediate Distribution Shaping
von: Anil, Gautham Govind, et al.
Veröffentlicht: (2025)
von: Anil, Gautham Govind, et al.
Veröffentlicht: (2025)
Scalable Offline Model-Based RL with Action Chunks
von: Park, Kwanyoung, et al.
Veröffentlicht: (2025)
von: Park, Kwanyoung, et al.
Veröffentlicht: (2025)
Reward Score Matching: Unifying Reward-based Fine-tuning for Flow and Diffusion Models
von: Lee, Jeongjae, et al.
Veröffentlicht: (2026)
von: Lee, Jeongjae, et al.
Veröffentlicht: (2026)
Chunk-Guided Q-Learning
von: Song, Gwanwoo, et al.
Veröffentlicht: (2026)
von: Song, Gwanwoo, et al.
Veröffentlicht: (2026)
PREFINE: Preference-Based Implicit Reward and Cost Fine-Tuning for Safety Alignment
von: Verma, Richa, et al.
Veröffentlicht: (2026)
von: Verma, Richa, et al.
Veröffentlicht: (2026)
Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control
von: Uehara, Masatoshi, et al.
Veröffentlicht: (2024)
von: Uehara, Masatoshi, et al.
Veröffentlicht: (2024)
Verifying Meta-Awareness via Predictive Rewards in Reasoning Models
von: Kim, Yoonjeon, et al.
Veröffentlicht: (2025)
von: Kim, Yoonjeon, et al.
Veröffentlicht: (2025)
Membership Privacy Risks of Sharpness Aware Minimization
von: Kim, Young In, et al.
Veröffentlicht: (2023)
von: Kim, Young In, et al.
Veröffentlicht: (2023)
DLPO: Diffusion Model Loss-Guided Reinforcement Learning for Fine-Tuning Text-to-Speech Diffusion Models
von: Chen, Jingyi, et al.
Veröffentlicht: (2024)
von: Chen, Jingyi, et al.
Veröffentlicht: (2024)
Confidence-aware Reward Optimization for Fine-tuning Text-to-Image Models
von: Kim, Kyuyoung, et al.
Veröffentlicht: (2024)
von: Kim, Kyuyoung, et al.
Veröffentlicht: (2024)
SAMOSA: Sharpness Aware Minimization for Open Set Active learning
von: Kim, Young In, et al.
Veröffentlicht: (2025)
von: Kim, Young In, et al.
Veröffentlicht: (2025)
Bridging Model-Based Optimization and Generative Modeling via Conservative Fine-Tuning of Diffusion Models
von: Uehara, Masatoshi, et al.
Veröffentlicht: (2024)
von: Uehara, Masatoshi, et al.
Veröffentlicht: (2024)
Lookahead Sample Reward Guidance for Test-Time Scaling of Diffusion Models
von: Kim, Yeongmin, et al.
Veröffentlicht: (2026)
von: Kim, Yeongmin, et al.
Veröffentlicht: (2026)
Feedback Efficient Online Fine-Tuning of Diffusion Models
von: Uehara, Masatoshi, et al.
Veröffentlicht: (2024)
von: Uehara, Masatoshi, et al.
Veröffentlicht: (2024)
Sparsity-Aware Low-Rank Representation for Efficient Fine-Tuning of Large Language Models
von: Zhang, Longteng, et al.
Veröffentlicht: (2026)
von: Zhang, Longteng, et al.
Veröffentlicht: (2026)
Live Music Diffusion Models: Efficient Fine-Tuning and Post-Training of Interactive Diffusion Music Generators
von: Novack, Zachary, et al.
Veröffentlicht: (2026)
von: Novack, Zachary, et al.
Veröffentlicht: (2026)
Task-Aware Parameter-Efficient Fine-Tuning of Large Pre-Trained Models at the Edge
von: Hu, Senkang, et al.
Veröffentlicht: (2025)
von: Hu, Senkang, et al.
Veröffentlicht: (2025)
GFT: From Imitation to Reward Fine-Tuning with Unbiased Group Advantages and Dynamic Coefficient Rectification
von: Gan, Wangjie, et al.
Veröffentlicht: (2026)
von: Gan, Wangjie, et al.
Veröffentlicht: (2026)
Fight Fire with Fire: Defending Against Malicious RL Fine-Tuning via Reward Neutralization
von: Cao, Wenjun
Veröffentlicht: (2025)
von: Cao, Wenjun
Veröffentlicht: (2025)
Fine-Tuning Diffusion Models for Molecular Generation via Reinforcement Learning and Fast Sampling
von: Lin, Guang, et al.
Veröffentlicht: (2026)
von: Lin, Guang, et al.
Veröffentlicht: (2026)
Entropy Aware Reward Guidance for Diffusion Language Model Alignment
von: Tejaswi, Atula, et al.
Veröffentlicht: (2026)
von: Tejaswi, Atula, et al.
Veröffentlicht: (2026)
Improving Large Language Models with Concept-Aware Fine-Tuning
von: Chen, Michael K., et al.
Veröffentlicht: (2025)
von: Chen, Michael K., et al.
Veröffentlicht: (2025)
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
von: Wei, Quan, et al.
Veröffentlicht: (2025)
von: Wei, Quan, et al.
Veröffentlicht: (2025)
Restoring Calibration for Aligned Large Language Models: A Calibration-Aware Fine-Tuning Approach
von: Xiao, Jiancong, et al.
Veröffentlicht: (2025)
von: Xiao, Jiancong, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
PLADIS: Pushing the Limits of Attention in Diffusion Models at Inference Time by Leveraging Sparsity
von: Kim, Kwanyoung, et al.
Veröffentlicht: (2025) -
Geometry-Aware Attention Guidance for Diffusion Models via Modern Hopfield Dynamics
von: Kim, Kwanyoung
Veröffentlicht: (2026) -
Improving Diffusion Models for Inverse Problems using Manifold Constraints
von: Chung, Hyungjin, et al.
Veröffentlicht: (2022) -
Bi-LoRA: Efficient Sharpness-Aware Minimization for Fine-Tuning Large-Scale Models
von: Liu, Yuhang, et al.
Veröffentlicht: (2025) -
Iterative Distillation for Reward-Guided Fine-Tuning of Diffusion Models in Biomolecular Design
von: Su, Xingyu, et al.
Veröffentlicht: (2025)