Alignment and Safety of Diffusion Models via Reinforcement Learning and Reward Modeling: A Survey
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Lamba, Preeti, Ravish, Kiran, Kushwaha, Ankita, Kumar, Pawan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
A Survey of Safe Reinforcement Learning and Constrained MDPs: A Technical Survey on Single-Agent and Multi-Agent Safety
von: Kushwaha, Ankita, et al.
Veröffentlicht: (2025)
von: Kushwaha, Ankita, et al.
Veröffentlicht: (2025)
STResNet & STYOLO : A New Family of Compact Classification and Object Detection Models for MCUs
von: Sah, Sudhakar, et al.
Veröffentlicht: (2026)
von: Sah, Sudhakar, et al.
Veröffentlicht: (2026)
Towards Better Alignment: Training Diffusion Models with Reinforcement Learning Against Sparse Rewards
von: Hu, Zijing, et al.
Veröffentlicht: (2025)
von: Hu, Zijing, et al.
Veröffentlicht: (2025)
Enhancing Diffusion-based Restoration Models via Difficulty-Adaptive Reinforcement Learning with IQA Reward
von: Xu, Xiaogang, et al.
Veröffentlicht: (2025)
von: Xu, Xiaogang, et al.
Veröffentlicht: (2025)
Deep Brain Net: An Optimized Deep Learning Model for Brain tumor Detection in MRI Images Using EfficientNetB0 and ResNet50 with Transfer Learning
von: Onah, Daniel, et al.
Veröffentlicht: (2025)
von: Onah, Daniel, et al.
Veröffentlicht: (2025)
Review of Extreme Multilabel Classification
von: Dasgupta, Arpan, et al.
Veröffentlicht: (2023)
von: Dasgupta, Arpan, et al.
Veröffentlicht: (2023)
RedDiffuser: Auditing Multimodal Safety Failures in Vision-Language Models via Reinforced Diffusion
von: Wang, Ruofan, et al.
Veröffentlicht: (2025)
von: Wang, Ruofan, et al.
Veröffentlicht: (2025)
RFSR: Improving ISR Diffusion Models via Reward Feedback Learning
von: Sun, Xiaopeng, et al.
Veröffentlicht: (2024)
von: Sun, Xiaopeng, et al.
Veröffentlicht: (2024)
A Fast and Efficient Modern BERT based Text-Conditioned Diffusion Model for Medical Image Segmentation
von: Dhara, Venkata Siddharth, et al.
Veröffentlicht: (2025)
von: Dhara, Venkata Siddharth, et al.
Veröffentlicht: (2025)
A Comparison of Lightweight Deep Learning Models for Particulate-Matter Nowcasting in the Indian Subcontinent & Surrounding Regions
von: Kushwaha, Ansh, et al.
Veröffentlicht: (2025)
von: Kushwaha, Ansh, et al.
Veröffentlicht: (2025)
Learning to Refocus with Video Diffusion Models
von: Tedla, SaiKiran, et al.
Veröffentlicht: (2025)
von: Tedla, SaiKiran, et al.
Veröffentlicht: (2025)
MSRL: Scaling Generative Multimodal Reward Modeling via Multi-Stage Reinforcement Learning
von: Wang, Chenglong, et al.
Veröffentlicht: (2026)
von: Wang, Chenglong, et al.
Veröffentlicht: (2026)
Reinforcement Learning for Large Model: A Survey
von: Wu, Weijia, et al.
Veröffentlicht: (2025)
von: Wu, Weijia, et al.
Veröffentlicht: (2025)
Reinforcement Learning with Inverse Rewards for World Model Post-training
von: Ye, Yang, et al.
Veröffentlicht: (2025)
von: Ye, Yang, et al.
Veröffentlicht: (2025)
Personalized Safety Alignment for Text-to-Image Diffusion Models
von: Lei, Yu, et al.
Veröffentlicht: (2025)
von: Lei, Yu, et al.
Veröffentlicht: (2025)
Beyond Pairwise Preferences: Listwise Reward-Aware Alignment for Diffusion Models
von: Wang, Austin, et al.
Veröffentlicht: (2026)
von: Wang, Austin, et al.
Veröffentlicht: (2026)
Taming Preference Mode Collapse via Directional Decoupling Alignment in Diffusion Reinforcement Learning
von: Chen, Chubin, et al.
Veröffentlicht: (2025)
von: Chen, Chubin, et al.
Veröffentlicht: (2025)
Optimizing 3D Diffusion Models for Medical Imaging via Multi-Scale Reward Learning
von: Tian, Yueying, et al.
Veröffentlicht: (2026)
von: Tian, Yueying, et al.
Veröffentlicht: (2026)
R1-Reward: Training Multimodal Reward Model Through Stable Reinforcement Learning
von: Zhang, Yi-Fan, et al.
Veröffentlicht: (2025)
von: Zhang, Yi-Fan, et al.
Veröffentlicht: (2025)
Diffusion Reinforcement Learning via Centered Reward Distillation
von: Zhu, Yuanzhi, et al.
Veröffentlicht: (2026)
von: Zhu, Yuanzhi, et al.
Veröffentlicht: (2026)
Responsible Diffusion: A Comprehensive Survey on Safety, Ethics, and Trust in Diffusion Models
von: Wei, Kang, et al.
Veröffentlicht: (2025)
von: Wei, Kang, et al.
Veröffentlicht: (2025)
Roommate Compatibility Detection Through Machine Learning Techniques
von: Lamba, Mansha, et al.
Veröffentlicht: (2020)
von: Lamba, Mansha, et al.
Veröffentlicht: (2020)
Boosting Latent Diffusion Models via Disentangled Representation Alignment
von: Page, John, et al.
Veröffentlicht: (2026)
von: Page, John, et al.
Veröffentlicht: (2026)
AssetDropper: Asset Extraction via Diffusion Models with Reward-Driven Optimization
von: Li, Lanjiong, et al.
Veröffentlicht: (2025)
von: Li, Lanjiong, et al.
Veröffentlicht: (2025)
Activation Reward Models for Few-Shot Model Alignment
von: Chai, Tianning, et al.
Veröffentlicht: (2025)
von: Chai, Tianning, et al.
Veröffentlicht: (2025)
Diffusion Reward: Learning Rewards via Conditional Video Diffusion
von: Huang, Tao, et al.
Veröffentlicht: (2023)
von: Huang, Tao, et al.
Veröffentlicht: (2023)
GARDO: Reinforcing Diffusion Models without Reward Hacking
von: He, Haoran, et al.
Veröffentlicht: (2025)
von: He, Haoran, et al.
Veröffentlicht: (2025)
Enhancing Diffusion Models with Text-Encoder Reinforcement Learning
von: Chen, Chaofeng, et al.
Veröffentlicht: (2023)
von: Chen, Chaofeng, et al.
Veröffentlicht: (2023)
Preference Alignment on Diffusion Model: A Comprehensive Survey for Image Generation and Editing
von: Wu, Sihao, et al.
Veröffentlicht: (2025)
von: Wu, Sihao, et al.
Veröffentlicht: (2025)
Video Diffusion Alignment via Reward Gradients
von: Prabhudesai, Mihir, et al.
Veröffentlicht: (2024)
von: Prabhudesai, Mihir, et al.
Veröffentlicht: (2024)
SafeGRPO: Self-Rewarded Multimodal Safety Alignment via Rule-Governed Policy Optimization
von: Rong, Xuankun, et al.
Veröffentlicht: (2025)
von: Rong, Xuankun, et al.
Veröffentlicht: (2025)
DenseGRPO: From Sparse to Dense Reward for Flow Matching Model Alignment
von: Deng, Haoyou, et al.
Veröffentlicht: (2026)
von: Deng, Haoyou, et al.
Veröffentlicht: (2026)
PaCo-RL: Advancing Reinforcement Learning for Consistent Image Generation with Pairwise Reward Modeling
von: Ping, Bowen, et al.
Veröffentlicht: (2025)
von: Ping, Bowen, et al.
Veröffentlicht: (2025)
Bridging Visual Representation and Reinforcement Learning from Verifiable Rewards in Large Vision-Language Models
von: Han, Yuhang, et al.
Veröffentlicht: (2026)
von: Han, Yuhang, et al.
Veröffentlicht: (2026)
Trust Your Critic: Robust Reward Modeling and Reinforcement Learning for Faithful Image Editing and Generation
von: Zhao, Xiangyu, et al.
Veröffentlicht: (2026)
von: Zhao, Xiangyu, et al.
Veröffentlicht: (2026)
Token Pruning using a Lightweight Background Aware Vision Transformer
von: Sah, Sudhakar, et al.
Veröffentlicht: (2024)
von: Sah, Sudhakar, et al.
Veröffentlicht: (2024)
Beyond Reward Margin: Rethinking and Resolving Likelihood Displacement in Diffusion Models via Video Generation
von: Xu, Ruojun, et al.
Veröffentlicht: (2025)
von: Xu, Ruojun, et al.
Veröffentlicht: (2025)
Hierarchical Vision-Language Alignment for Text-to-Image Generation via Diffusion Models
von: Johnson, Emily, et al.
Veröffentlicht: (2025)
von: Johnson, Emily, et al.
Veröffentlicht: (2025)
ShortFT: Diffusion Model Alignment via Shortcut-based Fine-Tuning
von: Guo, Xiefan, et al.
Veröffentlicht: (2025)
von: Guo, Xiefan, et al.
Veröffentlicht: (2025)
HEART: Hyperspherical Embedding Alignment via Kent-Representation Traversal in Diffusion Models
von: Roy, Arani, et al.
Veröffentlicht: (2026)
von: Roy, Arani, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
A Survey of Safe Reinforcement Learning and Constrained MDPs: A Technical Survey on Single-Agent and Multi-Agent Safety
von: Kushwaha, Ankita, et al.
Veröffentlicht: (2025) -
STResNet & STYOLO : A New Family of Compact Classification and Object Detection Models for MCUs
von: Sah, Sudhakar, et al.
Veröffentlicht: (2026) -
Towards Better Alignment: Training Diffusion Models with Reinforcement Learning Against Sparse Rewards
von: Hu, Zijing, et al.
Veröffentlicht: (2025) -
Enhancing Diffusion-based Restoration Models via Difficulty-Adaptive Reinforcement Learning with IQA Reward
von: Xu, Xiaogang, et al.
Veröffentlicht: (2025) -
Deep Brain Net: An Optimized Deep Learning Model for Brain tumor Detection in MRI Images Using EfficientNetB0 and ResNet50 with Transfer Learning
von: Onah, Daniel, et al.
Veröffentlicht: (2025)