Reward Sharpness-Aware Fine-Tuning for Diffusion Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Kwanyoung, Sim, Byeongsu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PLADIS: Pushing the Limits of Attention in Diffusion Models at Inference Time by Leveraging Sparsity
par: Kim, Kwanyoung, et autres
Publié: (2025)
par: Kim, Kwanyoung, et autres
Publié: (2025)
Geometry-Aware Attention Guidance for Diffusion Models via Modern Hopfield Dynamics
par: Kim, Kwanyoung
Publié: (2026)
par: Kim, Kwanyoung
Publié: (2026)
Improving Diffusion Models for Inverse Problems using Manifold Constraints
par: Chung, Hyungjin, et autres
Publié: (2022)
par: Chung, Hyungjin, et autres
Publié: (2022)
Bi-LoRA: Efficient Sharpness-Aware Minimization for Fine-Tuning Large-Scale Models
par: Liu, Yuhang, et autres
Publié: (2025)
par: Liu, Yuhang, et autres
Publié: (2025)
Iterative Distillation for Reward-Guided Fine-Tuning of Diffusion Models in Biomolecular Design
par: Su, Xingyu, et autres
Publié: (2025)
par: Su, Xingyu, et autres
Publié: (2025)
Model-based Offline Reinforcement Learning with Lower Expectile Q-Learning
par: Park, Kwanyoung, et autres
Publié: (2024)
par: Park, Kwanyoung, et autres
Publié: (2024)
TLDR: Unsupervised Goal-Conditioned RL via Temporal Distance-Aware Representations
par: Bae, Junik, et autres
Publié: (2024)
par: Bae, Junik, et autres
Publié: (2024)
Fine-Tuning Discrete Diffusion Models via Reward Optimization with Applications to DNA and Protein Design
par: Wang, Chenyu, et autres
Publié: (2024)
par: Wang, Chenyu, et autres
Publié: (2024)
ScaleDiff: Higher-Resolution Image Synthesis via Efficient and Model-Agnostic Diffusion
par: Koh, Sungho, et autres
Publié: (2025)
par: Koh, Sungho, et autres
Publié: (2025)
Portable Reward Tuning: Towards Reusable Fine-Tuning across Different Pretrained Models
par: Chijiwa, Daiki, et autres
Publié: (2025)
par: Chijiwa, Daiki, et autres
Publié: (2025)
Fine-Tuning Language Models with Reward Learning on Policy
par: Lang, Hao, et autres
Publié: (2024)
par: Lang, Hao, et autres
Publié: (2024)
PIRF: Physics-Informed Reward Fine-Tuning for Diffusion Models
par: Yuan, Mingze, et autres
Publié: (2025)
par: Yuan, Mingze, et autres
Publié: (2025)
Stability Analysis of Sharpness-Aware Minimization
par: Kim, Hoki, et autres
Publié: (2023)
par: Kim, Hoki, et autres
Publié: (2023)
Pioneering 4-Bit FP Quantization for Diffusion Models: Mixup-Sign Quantization and Timestep-Aware Fine-Tuning
par: Zhao, Maosen, et autres
Publié: (2025)
par: Zhao, Maosen, et autres
Publié: (2025)
Representation Without Reward: A JEPA Audit for LLM Fine-Tuning
par: Sengupta, Biswa
Publié: (2026)
par: Sengupta, Biswa
Publié: (2026)
RIFT: Repurposing Negative Samples via Reward-Informed Fine-Tuning
par: Liu, Zehua, et autres
Publié: (2026)
par: Liu, Zehua, et autres
Publié: (2026)
Fine-Tuning Diffusion Models via Intermediate Distribution Shaping
par: Anil, Gautham Govind, et autres
Publié: (2025)
par: Anil, Gautham Govind, et autres
Publié: (2025)
Scalable Offline Model-Based RL with Action Chunks
par: Park, Kwanyoung, et autres
Publié: (2025)
par: Park, Kwanyoung, et autres
Publié: (2025)
Reward Score Matching: Unifying Reward-based Fine-tuning for Flow and Diffusion Models
par: Lee, Jeongjae, et autres
Publié: (2026)
par: Lee, Jeongjae, et autres
Publié: (2026)
Chunk-Guided Q-Learning
par: Song, Gwanwoo, et autres
Publié: (2026)
par: Song, Gwanwoo, et autres
Publié: (2026)
PREFINE: Preference-Based Implicit Reward and Cost Fine-Tuning for Safety Alignment
par: Verma, Richa, et autres
Publié: (2026)
par: Verma, Richa, et autres
Publié: (2026)
Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control
par: Uehara, Masatoshi, et autres
Publié: (2024)
par: Uehara, Masatoshi, et autres
Publié: (2024)
Verifying Meta-Awareness via Predictive Rewards in Reasoning Models
par: Kim, Yoonjeon, et autres
Publié: (2025)
par: Kim, Yoonjeon, et autres
Publié: (2025)
Membership Privacy Risks of Sharpness Aware Minimization
par: Kim, Young In, et autres
Publié: (2023)
par: Kim, Young In, et autres
Publié: (2023)
DLPO: Diffusion Model Loss-Guided Reinforcement Learning for Fine-Tuning Text-to-Speech Diffusion Models
par: Chen, Jingyi, et autres
Publié: (2024)
par: Chen, Jingyi, et autres
Publié: (2024)
Confidence-aware Reward Optimization for Fine-tuning Text-to-Image Models
par: Kim, Kyuyoung, et autres
Publié: (2024)
par: Kim, Kyuyoung, et autres
Publié: (2024)
SAMOSA: Sharpness Aware Minimization for Open Set Active learning
par: Kim, Young In, et autres
Publié: (2025)
par: Kim, Young In, et autres
Publié: (2025)
Bridging Model-Based Optimization and Generative Modeling via Conservative Fine-Tuning of Diffusion Models
par: Uehara, Masatoshi, et autres
Publié: (2024)
par: Uehara, Masatoshi, et autres
Publié: (2024)
Lookahead Sample Reward Guidance for Test-Time Scaling of Diffusion Models
par: Kim, Yeongmin, et autres
Publié: (2026)
par: Kim, Yeongmin, et autres
Publié: (2026)
Feedback Efficient Online Fine-Tuning of Diffusion Models
par: Uehara, Masatoshi, et autres
Publié: (2024)
par: Uehara, Masatoshi, et autres
Publié: (2024)
Sparsity-Aware Low-Rank Representation for Efficient Fine-Tuning of Large Language Models
par: Zhang, Longteng, et autres
Publié: (2026)
par: Zhang, Longteng, et autres
Publié: (2026)
Live Music Diffusion Models: Efficient Fine-Tuning and Post-Training of Interactive Diffusion Music Generators
par: Novack, Zachary, et autres
Publié: (2026)
par: Novack, Zachary, et autres
Publié: (2026)
Task-Aware Parameter-Efficient Fine-Tuning of Large Pre-Trained Models at the Edge
par: Hu, Senkang, et autres
Publié: (2025)
par: Hu, Senkang, et autres
Publié: (2025)
GFT: From Imitation to Reward Fine-Tuning with Unbiased Group Advantages and Dynamic Coefficient Rectification
par: Gan, Wangjie, et autres
Publié: (2026)
par: Gan, Wangjie, et autres
Publié: (2026)
Fight Fire with Fire: Defending Against Malicious RL Fine-Tuning via Reward Neutralization
par: Cao, Wenjun
Publié: (2025)
par: Cao, Wenjun
Publié: (2025)
Fine-Tuning Diffusion Models for Molecular Generation via Reinforcement Learning and Fast Sampling
par: Lin, Guang, et autres
Publié: (2026)
par: Lin, Guang, et autres
Publié: (2026)
Entropy Aware Reward Guidance for Diffusion Language Model Alignment
par: Tejaswi, Atula, et autres
Publié: (2026)
par: Tejaswi, Atula, et autres
Publié: (2026)
Improving Large Language Models with Concept-Aware Fine-Tuning
par: Chen, Michael K., et autres
Publié: (2025)
par: Chen, Michael K., et autres
Publié: (2025)
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
par: Wei, Quan, et autres
Publié: (2025)
par: Wei, Quan, et autres
Publié: (2025)
Restoring Calibration for Aligned Large Language Models: A Calibration-Aware Fine-Tuning Approach
par: Xiao, Jiancong, et autres
Publié: (2025)
par: Xiao, Jiancong, et autres
Publié: (2025)
Documents similaires
-
PLADIS: Pushing the Limits of Attention in Diffusion Models at Inference Time by Leveraging Sparsity
par: Kim, Kwanyoung, et autres
Publié: (2025) -
Geometry-Aware Attention Guidance for Diffusion Models via Modern Hopfield Dynamics
par: Kim, Kwanyoung
Publié: (2026) -
Improving Diffusion Models for Inverse Problems using Manifold Constraints
par: Chung, Hyungjin, et autres
Publié: (2022) -
Bi-LoRA: Efficient Sharpness-Aware Minimization for Fine-Tuning Large-Scale Models
par: Liu, Yuhang, et autres
Publié: (2025) -
Iterative Distillation for Reward-Guided Fine-Tuning of Diffusion Models in Biomolecular Design
par: Su, Xingyu, et autres
Publié: (2025)