AlignDiff: Aligning Diverse Human Preferences via Behavior-Customisable Diffusion Model
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Dong, Zibin, Yuan, Yifu, Hao, Jianye, Ni, Fei, Mu, Yao, Zheng, Yan, Hu, Yujing, Lv, Tangjie, Fan, Changjie, Hu, Zhipeng |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2023
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
AlignDiff: Learning Physically-Grounded Camera Alignment via Diffusion
von: Xie, Liuyue, et al.
Veröffentlicht: (2025)
von: Xie, Liuyue, et al.
Veröffentlicht: (2025)
Prioritized Trajectory Replay: A Replay Memory for Data-driven Reinforcement Learning
von: Liu, Jinyi, et al.
Veröffentlicht: (2023)
von: Liu, Jinyi, et al.
Veröffentlicht: (2023)
MODULI: Unlocking Preference Generalization via Diffusion Models for Offline Multi-Objective Reinforcement Learning
von: Yuan, Yifu, et al.
Veröffentlicht: (2024)
von: Yuan, Yifu, et al.
Veröffentlicht: (2024)
EmbodiedMAE: A Unified 3D Multi-Modal Representation for Robot Manipulation
von: Dong, Zibin, et al.
Veröffentlicht: (2025)
von: Dong, Zibin, et al.
Veröffentlicht: (2025)
vMFER: Von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement
von: Zhu, Yiwen, et al.
Veröffentlicht: (2024)
von: Zhu, Yiwen, et al.
Veröffentlicht: (2024)
DiffuserLite: Towards Real-time Diffusion Planning
von: Dong, Zibin, et al.
Veröffentlicht: (2024)
von: Dong, Zibin, et al.
Veröffentlicht: (2024)
CleanDiffuser: An Easy-to-use Modularized Library for Diffusion Models in Decision Making
von: Dong, Zibin, et al.
Veröffentlicht: (2024)
von: Dong, Zibin, et al.
Veröffentlicht: (2024)
Bayesian Design Principles for Offline-to-Online Reinforcement Learning
von: Hu, Hao, et al.
Veröffentlicht: (2024)
von: Hu, Hao, et al.
Veröffentlicht: (2024)
Learning to Align Human Code Preferences
von: Yin, Xin, et al.
Veröffentlicht: (2025)
von: Yin, Xin, et al.
Veröffentlicht: (2025)
Towards a Simultaneous and Granular Identity-Expression Control in Personalized Face Generation
von: Liu, Renshuai, et al.
Veröffentlicht: (2024)
von: Liu, Renshuai, et al.
Veröffentlicht: (2024)
StyleTalk++: A Unified Framework for Controlling the Speaking Styles of Talking Heads
von: Wang, Suzhen, et al.
Veröffentlicht: (2024)
von: Wang, Suzhen, et al.
Veröffentlicht: (2024)
SpeechAlign: Aligning Speech Generation to Human Preferences
von: Zhang, Dong, et al.
Veröffentlicht: (2024)
von: Zhang, Dong, et al.
Veröffentlicht: (2024)
Reinforcement Learning From Imperfect Corrective Actions And Proxy Rewards
von: Jiang, Zhaohui, et al.
Veröffentlicht: (2024)
von: Jiang, Zhaohui, et al.
Veröffentlicht: (2024)
Uni-RLHF: Universal Platform and Benchmark Suite for Reinforcement Learning with Diverse Human Feedback
von: Yuan, Yifu, et al.
Veröffentlicht: (2024)
von: Yuan, Yifu, et al.
Veröffentlicht: (2024)
STAIR: Addressing Stage Misalignment through Temporal-Aligned Preference Reinforcement Learning
von: Luan, Yao, et al.
Veröffentlicht: (2025)
von: Luan, Yao, et al.
Veröffentlicht: (2025)
Aligning Robot Navigation Behaviors with Human Intentions and Preferences
von: Karnan, Haresh
Veröffentlicht: (2024)
von: Karnan, Haresh
Veröffentlicht: (2024)
TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles
von: Ma, Yifeng, et al.
Veröffentlicht: (2023)
von: Ma, Yifeng, et al.
Veröffentlicht: (2023)
Aligning Diffusion Language Models via Unpaired Preference Optimization
von: Jindal, Vaibhav, et al.
Veröffentlicht: (2025)
von: Jindal, Vaibhav, et al.
Veröffentlicht: (2025)
PC-Diffusion: Aligning Diffusion Models with Human Preferences via Preference Classifier
von: Wang, Shaomeng, et al.
Veröffentlicht: (2025)
von: Wang, Shaomeng, et al.
Veröffentlicht: (2025)
MetaAlign: Align Large Language Models with Diverse Preferences during Inference Time
von: Zhang, Mozhi, et al.
Veröffentlicht: (2024)
von: Zhang, Mozhi, et al.
Veröffentlicht: (2024)
DiffATS: Diffusion in Aligned Tensor Space
von: Lyu, Jinhua, et al.
Veröffentlicht: (2026)
von: Lyu, Jinhua, et al.
Veröffentlicht: (2026)
Aligning Large Language Model Behavior with Human Citation Preferences
von: Ando, Kenichiro, et al.
Veröffentlicht: (2026)
von: Ando, Kenichiro, et al.
Veröffentlicht: (2026)
XRL-Bench: A Benchmark for Evaluating and Comparing Explainable Reinforcement Learning Techniques
von: Xiong, Yu, et al.
Veröffentlicht: (2024)
von: Xiong, Yu, et al.
Veröffentlicht: (2024)
Personalized Constitutionally-Aligned Agentic Superego: Secure AI Behavior Aligned to Diverse Human Values
von: Watson, Nell, et al.
Veröffentlicht: (2025)
von: Watson, Nell, et al.
Veröffentlicht: (2025)
AlignCap: Aligning Speech Emotion Captioning to Human Preferences
von: Liang, Ziqi, et al.
Veröffentlicht: (2024)
von: Liang, Ziqi, et al.
Veröffentlicht: (2024)
When Preferences Diverge: Aligning Diffusion Models with Minority-Aware Adaptive DPO
von: Zhang, Lingfan, et al.
Veröffentlicht: (2025)
von: Zhang, Lingfan, et al.
Veröffentlicht: (2025)
Diff-Instruct++: Training One-step Text-to-image Generator Model to Align with Human Preferences
von: Luo, Weijian
Veröffentlicht: (2024)
von: Luo, Weijian
Veröffentlicht: (2024)
D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples
von: Hu, Zijing, et al.
Veröffentlicht: (2025)
von: Hu, Zijing, et al.
Veröffentlicht: (2025)
Aligning Audio Captions with Human Preferences
von: Hegde, Kartik, et al.
Veröffentlicht: (2025)
von: Hegde, Kartik, et al.
Veröffentlicht: (2025)
Aligning Large Language Models with Searcher Preferences
von: Wu, Wei, et al.
Veröffentlicht: (2026)
von: Wu, Wei, et al.
Veröffentlicht: (2026)
Re-Align: Aligning Vision Language Models via Retrieval-Augmented Direct Preference Optimization
von: Xing, Shuo, et al.
Veröffentlicht: (2025)
von: Xing, Shuo, et al.
Veröffentlicht: (2025)
Directly Aligning the Full Diffusion Trajectory with Fine-Grained Human Preference
von: Shen, Xiangwei, et al.
Veröffentlicht: (2025)
von: Shen, Xiangwei, et al.
Veröffentlicht: (2025)
PrefPaint: Aligning Image Inpainting Diffusion Model with Human Preference
von: Liu, Kendong, et al.
Veröffentlicht: (2024)
von: Liu, Kendong, et al.
Veröffentlicht: (2024)
Align-DA: Align Score-based Atmospheric Data Assimilation with Multiple Preferences
von: Sun, Jing-An, et al.
Veröffentlicht: (2025)
von: Sun, Jing-An, et al.
Veröffentlicht: (2025)
Forward KL Regularized Preference Optimization for Aligning Diffusion Policies
von: Shan, Zhao, et al.
Veröffentlicht: (2024)
von: Shan, Zhao, et al.
Veröffentlicht: (2024)
ADHMR: Aligning Diffusion-based Human Mesh Recovery via Direct Preference Optimization
von: Shen, Wenhao, et al.
Veröffentlicht: (2025)
von: Shen, Wenhao, et al.
Veröffentlicht: (2025)
Conditioning Matters: Training Diffusion Policies is Faster Than You Think
von: Dong, Zibin, et al.
Veröffentlicht: (2025)
von: Dong, Zibin, et al.
Veröffentlicht: (2025)
SIPO: Stabilized and Improved Preference Optimization for Aligning Diffusion Models
von: Yang, Xiaomeng, et al.
Veröffentlicht: (2025)
von: Yang, Xiaomeng, et al.
Veröffentlicht: (2025)
Embodied-R1: Reinforced Embodied Reasoning for General Robotic Manipulation
von: Yuan, Yifu, et al.
Veröffentlicht: (2025)
von: Yuan, Yifu, et al.
Veröffentlicht: (2025)
From Seeing to Doing: Bridging Reasoning and Decision for Robotic Manipulation
von: Yuan, Yifu, et al.
Veröffentlicht: (2025)
von: Yuan, Yifu, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
AlignDiff: Learning Physically-Grounded Camera Alignment via Diffusion
von: Xie, Liuyue, et al.
Veröffentlicht: (2025) -
Prioritized Trajectory Replay: A Replay Memory for Data-driven Reinforcement Learning
von: Liu, Jinyi, et al.
Veröffentlicht: (2023) -
MODULI: Unlocking Preference Generalization via Diffusion Models for Offline Multi-Objective Reinforcement Learning
von: Yuan, Yifu, et al.
Veröffentlicht: (2024) -
EmbodiedMAE: A Unified 3D Multi-Modal Representation for Robot Manipulation
von: Dong, Zibin, et al.
Veröffentlicht: (2025) -
vMFER: Von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement
von: Zhu, Yiwen, et al.
Veröffentlicht: (2024)