Diffusion-RPO: Aligning Diffusion Models through Relative Preference Optimization
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Gu, Yi, Wang, Zhendong, Yin, Yueqin, Xie, Yujia, Zhou, Mingyuan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Self-Augmented Preference Optimization: Off-Policy Paradigms for Language Model Alignment
von: Yin, Yueqin, et al.
Veröffentlicht: (2024)
von: Yin, Yueqin, et al.
Veröffentlicht: (2024)
Few-Step Diffusion via Score identity Distillation
von: Zhou, Mingyuan, et al.
Veröffentlicht: (2025)
von: Zhou, Mingyuan, et al.
Veröffentlicht: (2025)
Relative Preference Optimization: Enhancing LLM Alignment through Contrasting Responses across Identical and Diverse Prompts
von: Yin, Yueqin, et al.
Veröffentlicht: (2024)
von: Yin, Yueqin, et al.
Veröffentlicht: (2024)
Uncertainty-Aware Exploratory Direct Preference Optimization for Multimodal Large Language Models
von: Zhang, Huatian, et al.
Veröffentlicht: (2026)
von: Zhang, Huatian, et al.
Veröffentlicht: (2026)
Score identity Distillation: Exponentially Fast Distillation of Pretrained Diffusion Models for One-Step Generation
von: Zhou, Mingyuan, et al.
Veröffentlicht: (2024)
von: Zhou, Mingyuan, et al.
Veröffentlicht: (2024)
Patch-Prompt Aligned Bayesian Prompt Tuning for Vision-Language Models
von: Liu, Xinyang, et al.
Veröffentlicht: (2023)
von: Liu, Xinyang, et al.
Veröffentlicht: (2023)
Guided Score identity Distillation for Data-Free One-Step Text-to-Image Generation
von: Zhou, Mingyuan, et al.
Veröffentlicht: (2024)
von: Zhou, Mingyuan, et al.
Veröffentlicht: (2024)
Aligning Modalities in Vision Large Language Models via Preference Fine-tuning
von: Zhou, Yiyang, et al.
Veröffentlicht: (2024)
von: Zhou, Yiyang, et al.
Veröffentlicht: (2024)
Adversarial Score identity Distillation: Rapidly Surpassing the Teacher in One Step
von: Zhou, Mingyuan, et al.
Veröffentlicht: (2024)
von: Zhou, Mingyuan, et al.
Veröffentlicht: (2024)
VPO: Aligning Text-to-Video Generation Models with Prompt Optimization
von: Cheng, Jiale, et al.
Veröffentlicht: (2025)
von: Cheng, Jiale, et al.
Veröffentlicht: (2025)
Learning Stackable and Skippable LEGO Bricks for Efficient, Reconfigurable, and Variable-Resolution Diffusion Modeling
von: Zheng, Huangjie, et al.
Veröffentlicht: (2023)
von: Zheng, Huangjie, et al.
Veröffentlicht: (2023)
Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation
von: Shi, Dingyuan, et al.
Veröffentlicht: (2024)
von: Shi, Dingyuan, et al.
Veröffentlicht: (2024)
MMedPO: Aligning Medical Vision-Language Models with Clinical-Aware Multimodal Preference Optimization
von: Zhu, Kangyu, et al.
Veröffentlicht: (2024)
von: Zhu, Kangyu, et al.
Veröffentlicht: (2024)
Enhancing and Accelerating Diffusion-Based Inverse Problem Solving through Measurements Optimization
von: Chen, Tianyu, et al.
Veröffentlicht: (2024)
von: Chen, Tianyu, et al.
Veröffentlicht: (2024)
Multimodal Latent Language Modeling with Next-Token Diffusion
von: Sun, Yutao, et al.
Veröffentlicht: (2024)
von: Sun, Yutao, et al.
Veröffentlicht: (2024)
Divergence Minimization Preference Optimization for Diffusion Model Alignment
von: Li, Binxu, et al.
Veröffentlicht: (2025)
von: Li, Binxu, et al.
Veröffentlicht: (2025)
Reinforcing Diffusion Models by Direct Group Preference Optimization
von: Luo, Yihong, et al.
Veröffentlicht: (2025)
von: Luo, Yihong, et al.
Veröffentlicht: (2025)
Score Forgetting Distillation: A Swift, Data-Free Method for Machine Unlearning in Diffusion Models
von: Chen, Tianqi, et al.
Veröffentlicht: (2024)
von: Chen, Tianqi, et al.
Veröffentlicht: (2024)
ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time
von: Ding, Yi, et al.
Veröffentlicht: (2024)
von: Ding, Yi, et al.
Veröffentlicht: (2024)
Multimodal Integrated Knowledge Transfer to Large Language Models through Preference Optimization with Biomedical Applications
von: Wang, Zhanliang, et al.
Veröffentlicht: (2025)
von: Wang, Zhanliang, et al.
Veröffentlicht: (2025)
Align Your Steps: Optimizing Sampling Schedules in Diffusion Models
von: Sabour, Amirmojtaba, et al.
Veröffentlicht: (2024)
von: Sabour, Amirmojtaba, et al.
Veröffentlicht: (2024)
A General Framework for Inference-time Scaling and Steering of Diffusion Models
von: Singhal, Raghav, et al.
Veröffentlicht: (2025)
von: Singhal, Raghav, et al.
Veröffentlicht: (2025)
Controlled Training Data Generation with Diffusion Models
von: Yeo, Teresa, et al.
Veröffentlicht: (2024)
von: Yeo, Teresa, et al.
Veröffentlicht: (2024)
Personalized Preference Fine-tuning of Diffusion Models
von: Dang, Meihua, et al.
Veröffentlicht: (2025)
von: Dang, Meihua, et al.
Veröffentlicht: (2025)
A Dense Reward View on Aligning Text-to-Image Diffusion with Preference
von: Yang, Shentao, et al.
Veröffentlicht: (2024)
von: Yang, Shentao, et al.
Veröffentlicht: (2024)
Efficient Scaling of Diffusion Transformers for Text-to-Image Generation
von: Li, Hao, et al.
Veröffentlicht: (2024)
von: Li, Hao, et al.
Veröffentlicht: (2024)
LLaDA-V: Large Language Diffusion Models with Visual Instruction Tuning
von: You, Zebin, et al.
Veröffentlicht: (2025)
von: You, Zebin, et al.
Veröffentlicht: (2025)
Direct Preference Optimization for Suppressing Hallucinated Prior Exams in Radiology Report Generation
von: Banerjee, Oishi, et al.
Veröffentlicht: (2024)
von: Banerjee, Oishi, et al.
Veröffentlicht: (2024)
The Best of Both Worlds: Integrating Language Models and Diffusion Models for Video Generation
von: Yin, Aoxiong, et al.
Veröffentlicht: (2025)
von: Yin, Aoxiong, et al.
Veröffentlicht: (2025)
Importance Sampling for Multi-Negative Multimodal Direct Preference Optimization
von: Li, Xintong, et al.
Veröffentlicht: (2025)
von: Li, Xintong, et al.
Veröffentlicht: (2025)
NeuralRemaster: Phase-Preserving Diffusion for Structure-Aligned Generation
von: Zeng, Yu, et al.
Veröffentlicht: (2025)
von: Zeng, Yu, et al.
Veröffentlicht: (2025)
CRAFT: Aligning Diffusion Models with Fine-Tuning Is Easier Than You Think
von: Sun, Zening, et al.
Veröffentlicht: (2026)
von: Sun, Zening, et al.
Veröffentlicht: (2026)
MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks
von: Wu, Yiming, et al.
Veröffentlicht: (2024)
von: Wu, Yiming, et al.
Veröffentlicht: (2024)
Denoising Score Distillation: From Noisy Diffusion Pretraining to One-Step High-Quality Generation
von: Chen, Tianyu, et al.
Veröffentlicht: (2025)
von: Chen, Tianyu, et al.
Veröffentlicht: (2025)
Re-Align: Aligning Vision Language Models via Retrieval-Augmented Direct Preference Optimization
von: Xing, Shuo, et al.
Veröffentlicht: (2025)
von: Xing, Shuo, et al.
Veröffentlicht: (2025)
mDPO: Conditional Preference Optimization for Multimodal Large Language Models
von: Wang, Fei, et al.
Veröffentlicht: (2024)
von: Wang, Fei, et al.
Veröffentlicht: (2024)
InPO: Inversion Preference Optimization with Reparametrized DDIM for Efficient Diffusion Model Alignment
von: Lu, Yunhong, et al.
Veröffentlicht: (2025)
von: Lu, Yunhong, et al.
Veröffentlicht: (2025)
On Discrete Prompt Optimization for Diffusion Models
von: Wang, Ruochen, et al.
Veröffentlicht: (2024)
von: Wang, Ruochen, et al.
Veröffentlicht: (2024)
Self-Play Fine-Tuning of Diffusion Models for Text-to-Image Generation
von: Yuan, Huizhuo, et al.
Veröffentlicht: (2024)
von: Yuan, Huizhuo, et al.
Veröffentlicht: (2024)
One Category One Prompt: Dataset Distillation using Diffusion Models
von: Abbasi, Ali, et al.
Veröffentlicht: (2024)
von: Abbasi, Ali, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Self-Augmented Preference Optimization: Off-Policy Paradigms for Language Model Alignment
von: Yin, Yueqin, et al.
Veröffentlicht: (2024) -
Few-Step Diffusion via Score identity Distillation
von: Zhou, Mingyuan, et al.
Veröffentlicht: (2025) -
Relative Preference Optimization: Enhancing LLM Alignment through Contrasting Responses across Identical and Diverse Prompts
von: Yin, Yueqin, et al.
Veröffentlicht: (2024) -
Uncertainty-Aware Exploratory Direct Preference Optimization for Multimodal Large Language Models
von: Zhang, Huatian, et al.
Veröffentlicht: (2026) -
Score identity Distillation: Exponentially Fast Distillation of Pretrained Diffusion Models for One-Step Generation
von: Zhou, Mingyuan, et al.
Veröffentlicht: (2024)