GDRO: Group-level Reward Post-training Suitable for Diffusion Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Yiyang, Chen, Xi, Xu, Xiaogang, Liu, Yu, Zhao, Hengshuang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DiffCamera: Arbitrary Refocusing on Images
di: Wang, Yiyang, et al.
Pubblicazione: (2025)
di: Wang, Yiyang, et al.
Pubblicazione: (2025)
DiffDoctor: Diagnosing Image Diffusion Models Before Treating
di: Wang, Yiyang, et al.
Pubblicazione: (2025)
di: Wang, Yiyang, et al.
Pubblicazione: (2025)
PQD: Post-training Quantization for Efficient Diffusion Models
di: Ye, Jiaojiao, et al.
Pubblicazione: (2024)
di: Ye, Jiaojiao, et al.
Pubblicazione: (2024)
FashionComposer: Compositional Fashion Image Generation
di: Ji, Sihui, et al.
Pubblicazione: (2024)
di: Ji, Sihui, et al.
Pubblicazione: (2024)
ParetoSlider: Diffusion Models Post-Training for Continuous Reward Control
di: Golan, Shelly, et al.
Pubblicazione: (2026)
di: Golan, Shelly, et al.
Pubblicazione: (2026)
Post-training Quantization for Text-to-Image Diffusion Models with Progressive Calibration and Activation Relaxing
di: Tang, Siao, et al.
Pubblicazione: (2023)
di: Tang, Siao, et al.
Pubblicazione: (2023)
AlphaGRPO: Unlocking Self-Reflective Multimodal Generation in UMMs via Decompositional Verifiable Reward
di: Huang, Runhui, et al.
Pubblicazione: (2026)
di: Huang, Runhui, et al.
Pubblicazione: (2026)
MARBLE: Multi-Aspect Reward Balance for Diffusion RL
di: Zhao, Canyu, et al.
Pubblicazione: (2026)
di: Zhao, Canyu, et al.
Pubblicazione: (2026)
Diffusion Reward: Learning Rewards via Conditional Video Diffusion
di: Huang, Tao, et al.
Pubblicazione: (2023)
di: Huang, Tao, et al.
Pubblicazione: (2023)
Calibrated Self-Rewarding Vision Language Models
di: Zhou, Yiyang, et al.
Pubblicazione: (2024)
di: Zhou, Yiyang, et al.
Pubblicazione: (2024)
Diffusion Reinforcement Learning via Centered Reward Distillation
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2026)
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2026)
Shortcutting Pre-trained Flow Matching Diffusion Models is Almost Free Lunch
di: Cai, Xu, et al.
Pubblicazione: (2025)
di: Cai, Xu, et al.
Pubblicazione: (2025)
Beyond Pairwise Preferences: Listwise Reward-Aware Alignment for Diffusion Models
di: Wang, Austin, et al.
Pubblicazione: (2026)
di: Wang, Austin, et al.
Pubblicazione: (2026)
Directly Fine-Tuning Diffusion Models on Differentiable Rewards
di: Clark, Kevin, et al.
Pubblicazione: (2023)
di: Clark, Kevin, et al.
Pubblicazione: (2023)
MedGround-R1: Advancing Medical Image Grounding via Spatial-Semantic Rewarded Group Relative Policy Optimization
di: Xu, Huihui, et al.
Pubblicazione: (2025)
di: Xu, Huihui, et al.
Pubblicazione: (2025)
Towards Better Alignment: Training Diffusion Models with Reinforcement Learning Against Sparse Rewards
di: Hu, Zijing, et al.
Pubblicazione: (2025)
di: Hu, Zijing, et al.
Pubblicazione: (2025)
CFG-Ctrl: Control-Based Classifier-Free Diffusion Guidance
di: Wang, Hanyang, et al.
Pubblicazione: (2026)
di: Wang, Hanyang, et al.
Pubblicazione: (2026)
Auto MC-Reward: Automated Dense Reward Design with Large Language Models for Minecraft
di: Li, Hao, et al.
Pubblicazione: (2023)
di: Li, Hao, et al.
Pubblicazione: (2023)
EDA-DM: Enhanced Distribution Alignment for Post-Training Quantization of Diffusion Models
di: Liu, Xuewen, et al.
Pubblicazione: (2024)
di: Liu, Xuewen, et al.
Pubblicazione: (2024)
BOOD: Boundary-based Out-Of-Distribution Data Generation
di: Liao, Qilin, et al.
Pubblicazione: (2025)
di: Liao, Qilin, et al.
Pubblicazione: (2025)
Dynamical Diffusion: Learning Temporal Dynamics with Diffusion Models
di: Guo, Xingzhuo, et al.
Pubblicazione: (2025)
di: Guo, Xingzhuo, et al.
Pubblicazione: (2025)
Bayesian Diffusion Models for 3D Shape Reconstruction
di: Xu, Haiyang, et al.
Pubblicazione: (2024)
di: Xu, Haiyang, et al.
Pubblicazione: (2024)
LiNeS: Post-training Layer Scaling Prevents Forgetting and Enhances Model Merging
di: Wang, Ke, et al.
Pubblicazione: (2024)
di: Wang, Ke, et al.
Pubblicazione: (2024)
Incorporating Pre-trained Diffusion Models in Solving the Schrödinger Bridge Problem
di: Tang, Zhicong, et al.
Pubblicazione: (2025)
di: Tang, Zhicong, et al.
Pubblicazione: (2025)
GARDO: Reinforcing Diffusion Models without Reward Hacking
di: He, Haoran, et al.
Pubblicazione: (2025)
di: He, Haoran, et al.
Pubblicazione: (2025)
LayerFlow: A Unified Model for Layer-aware Video Generation
di: Ji, Sihui, et al.
Pubblicazione: (2025)
di: Ji, Sihui, et al.
Pubblicazione: (2025)
Aligning Few-Step Diffusion Models with Dense Reward Difference Learning
di: Zhang, Ziyi, et al.
Pubblicazione: (2024)
di: Zhang, Ziyi, et al.
Pubblicazione: (2024)
Pixel-Space Post-Training of Latent Diffusion Models
di: Zhang, Christina, et al.
Pubblicazione: (2024)
di: Zhang, Christina, et al.
Pubblicazione: (2024)
UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models
di: Wang, Jiaqi, et al.
Pubblicazione: (2026)
di: Wang, Jiaqi, et al.
Pubblicazione: (2026)
FocalClick-XL: Towards Unified and High-quality Interactive Segmentation
di: Chen, Xi, et al.
Pubblicazione: (2025)
di: Chen, Xi, et al.
Pubblicazione: (2025)
LogoSticker: Inserting Logos into Diffusion Models for Customized Generation
di: Zhu, Mingkang, et al.
Pubblicazione: (2024)
di: Zhu, Mingkang, et al.
Pubblicazione: (2024)
Confronting Reward Overoptimization for Diffusion Models: A Perspective of Inductive and Primacy Biases
di: Zhang, Ziyi, et al.
Pubblicazione: (2024)
di: Zhang, Ziyi, et al.
Pubblicazione: (2024)
BADiff: Bandwidth Adaptive Diffusion Model
di: Zhang, Xi, et al.
Pubblicazione: (2025)
di: Zhang, Xi, et al.
Pubblicazione: (2025)
FOD-Diff: 3D Multi-Channel Patch Diffusion Model for Fiber Orientation Distribution
di: Tang, Hao, et al.
Pubblicazione: (2025)
di: Tang, Hao, et al.
Pubblicazione: (2025)
Reinforcing Diffusion Models by Direct Group Preference Optimization
di: Luo, Yihong, et al.
Pubblicazione: (2025)
di: Luo, Yihong, et al.
Pubblicazione: (2025)
Gradient-Aligned Calibration for Post-Training Quantization of Diffusion Models
di: Hoang, Dung Anh, et al.
Pubblicazione: (2026)
di: Hoang, Dung Anh, et al.
Pubblicazione: (2026)
Modular Customization of Diffusion Models via Blockwise-Parameterized Low-Rank Adaptation
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
MiCo: Multi-image Contrast for Reinforcement Visual Reasoning
di: Chen, Xi, et al.
Pubblicazione: (2025)
di: Chen, Xi, et al.
Pubblicazione: (2025)
SoliReward: Mitigating Susceptibility to Reward Hacking and Annotation Noise in Video Generation Reward Models
di: Lian, Jiesong, et al.
Pubblicazione: (2025)
di: Lian, Jiesong, et al.
Pubblicazione: (2025)
FlowDepth: Decoupling Optical Flow for Self-Supervised Monocular Depth Estimation
di: Sun, Yiyang, et al.
Pubblicazione: (2024)
di: Sun, Yiyang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
DiffCamera: Arbitrary Refocusing on Images
di: Wang, Yiyang, et al.
Pubblicazione: (2025) -
DiffDoctor: Diagnosing Image Diffusion Models Before Treating
di: Wang, Yiyang, et al.
Pubblicazione: (2025) -
PQD: Post-training Quantization for Efficient Diffusion Models
di: Ye, Jiaojiao, et al.
Pubblicazione: (2024) -
FashionComposer: Compositional Fashion Image Generation
di: Ji, Sihui, et al.
Pubblicazione: (2024) -
ParetoSlider: Diffusion Models Post-Training for Continuous Reward Control
di: Golan, Shelly, et al.
Pubblicazione: (2026)