HuViDPO:Enhancing Video Generation through Direct Preference Optimization for Human-Centric Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jiang, Lifan, Wu, Boxi, Zhang, Jiahui, Guan, Xiaotong, Chen, Shuang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VidSketch: Hand-drawn Sketch-Driven Video Generation with Diffusion Control
par: Jiang, Lifan, et autres
Publié: (2025)
par: Jiang, Lifan, et autres
Publié: (2025)
MagicID: Hybrid Preference Optimization for ID-Consistent and Dynamic-Preserved Video Customization
par: Li, Hengjia, et autres
Publié: (2025)
par: Li, Hengjia, et autres
Publié: (2025)
VideoDPO: Omni-Preference Alignment for Video Diffusion Generation
par: Liu, Runtao, et autres
Publié: (2024)
par: Liu, Runtao, et autres
Publié: (2024)
HuM-Eval: A Coarse-to-Fine Framework for Human-Centric Video Evaluation
par: Zhang, Bingzi, et autres
Publié: (2026)
par: Zhang, Bingzi, et autres
Publié: (2026)
AVC-DPO: Aligned Video Captioning via Direct Preference Optimization
par: Tang, Jiyang, et autres
Publié: (2025)
par: Tang, Jiyang, et autres
Publié: (2025)
Reg-DPO: SFT-Regularized Direct Preference Optimization with GT-Pair for Improving Video Generation
par: Du, Jie, et autres
Publié: (2025)
par: Du, Jie, et autres
Publié: (2025)
SEE-DPO: Self Entropy Enhanced Direct Preference Optimization
par: Shekhar, Shivanshu, et autres
Publié: (2024)
par: Shekhar, Shivanshu, et autres
Publié: (2024)
SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization
par: Peng, Liang, et autres
Publié: (2025)
par: Peng, Liang, et autres
Publié: (2025)
Discriminator-Free Direct Preference Optimization for Video Diffusion
par: Cheng, Haoran, et autres
Publié: (2025)
par: Cheng, Haoran, et autres
Publié: (2025)
SyncDPO: Enhancing Temporal Synchronization in Video-Audio Joint Generation via Preference Learning
par: Cheng, Xin, et autres
Publié: (2026)
par: Cheng, Xin, et autres
Publié: (2026)
VistaDPO: Video Hierarchical Spatial-Temporal Direct Preference Optimization for Large Video Models
par: Huang, Haojian, et autres
Publié: (2025)
par: Huang, Haojian, et autres
Publié: (2025)
HuMo: Human-Centric Video Generation via Collaborative Multi-Modal Conditioning
par: Chen, Liyang, et autres
Publié: (2025)
par: Chen, Liyang, et autres
Publié: (2025)
DreamBoothDPO: Improving Personalized Generation using Direct Preference Optimization
par: Ayupov, Shamil, et autres
Publié: (2025)
par: Ayupov, Shamil, et autres
Publié: (2025)
DeDPO: Debiased Direct Preference Optimization for Diffusion Models
par: Pham, Khiem, et autres
Publié: (2026)
par: Pham, Khiem, et autres
Publié: (2026)
DenseDPO: Fine-Grained Temporal Preference Optimization for Video Diffusion Models
par: Wu, Ziyi, et autres
Publié: (2025)
par: Wu, Ziyi, et autres
Publié: (2025)
UniEditBench: A Unified and Cost-Effective Benchmark for Image and Video Editing via Distilled MLLMs
par: Jiang, Lifan, et autres
Publié: (2026)
par: Jiang, Lifan, et autres
Publié: (2026)
ConsistencyTrack: A Robust Multi-Object Tracker with a Generation Strategy of Consistency Model
par: Jiang, Lifan, et autres
Publié: (2024)
par: Jiang, Lifan, et autres
Publié: (2024)
SymDPO: Boosting In-Context Learning of Large Multimodal Models with Symbol Demonstration Direct Preference Optimization
par: Jia, Hongrui, et autres
Publié: (2024)
par: Jia, Hongrui, et autres
Publié: (2024)
Llama Learns to Direct: DirectorLLM for Human-Centric Video Generation
par: Song, Kunpeng, et autres
Publié: (2024)
par: Song, Kunpeng, et autres
Publié: (2024)
OnlineVPO: Align Video Diffusion Model with Online Video-Centric Preference Optimization
par: Zhang, Jiacheng, et autres
Publié: (2024)
par: Zhang, Jiacheng, et autres
Publié: (2024)
Curriculum-DPO++: Direct Preference Optimization via Data and Model Curricula for Text-to-Image Generation
par: Croitoru, Florinel-Alin, et autres
Publié: (2026)
par: Croitoru, Florinel-Alin, et autres
Publié: (2026)
Diffusion-APO: Trajectory-Aware Direct Preference Alignment for Video Diffusion Transformers
par: Zhu, Jingyuan, et autres
Publié: (2026)
par: Zhu, Jingyuan, et autres
Publié: (2026)
$ϕ$-DPO: Fairness Direct Preference Optimization Approach to Continual Learning in Large Multimodal Models
par: Truong, Thanh-Dat, et autres
Publié: (2026)
par: Truong, Thanh-Dat, et autres
Publié: (2026)
MIA-DPO: Multi-Image Augmented Direct Preference Optimization For Large Vision-Language Models
par: Liu, Ziyu, et autres
Publié: (2024)
par: Liu, Ziyu, et autres
Publié: (2024)
PhysCorr: Dual-Reward DPO for Physics-Constrained Text-to-Video Generation with Automated Preference Selection
par: Wang, Peiyao, et autres
Publié: (2025)
par: Wang, Peiyao, et autres
Publié: (2025)
RS-DPO: A Hybrid Rejection Sampling and Direct Preference Optimization Method for Alignment of Large Language Models
par: Khaki, Saeed, et autres
Publié: (2024)
par: Khaki, Saeed, et autres
Publié: (2024)
FocusDPO: Dynamic Preference Optimization for Multi-Subject Personalized Image Generation via Adaptive Focus
par: Jin, Qiaoqiao, et autres
Publié: (2025)
par: Jin, Qiaoqiao, et autres
Publié: (2025)
LightGen: Efficient Image Generation through Knowledge Distillation and Direct Preference Optimization
par: Wu, Xianfeng, et autres
Publié: (2025)
par: Wu, Xianfeng, et autres
Publié: (2025)
S2H-DPO: Hardness-Aware Preference Optimization for Vision-Language Models
par: Shukla, Nitish, et autres
Publié: (2026)
par: Shukla, Nitish, et autres
Publié: (2026)
PhyRPR: Training-Free Physics-Constrained Video Generation
par: Zhao, Yibo, et autres
Publié: (2026)
par: Zhao, Yibo, et autres
Publié: (2026)
StreamingEffect: Real-Time Human-Centric Video Effect Generation
par: Song, Yiren, et autres
Publié: (2026)
par: Song, Yiren, et autres
Publié: (2026)
InpaintDPO: Mitigating Spatial Relationship Hallucinations in Foreground-conditioned Inpainting via Diverse Preference Optimization
par: Li, Qirui, et autres
Publié: (2025)
par: Li, Qirui, et autres
Publié: (2025)
ViPO: Visual Preference Optimization at Scale
par: Li, Ming, et autres
Publié: (2026)
par: Li, Ming, et autres
Publié: (2026)
PatchDPO: Patch-level DPO for Finetuning-free Personalized Image Generation
par: Huang, Qihan, et autres
Publié: (2024)
par: Huang, Qihan, et autres
Publié: (2024)
V-DPO: Mitigating Hallucination in Large Vision Language Models via Vision-Guided Direct Preference Optimization
par: Xie, Yuxi, et autres
Publié: (2024)
par: Xie, Yuxi, et autres
Publié: (2024)
BideDPO: Conditional Image Generation with Simultaneous Text and Condition Alignment
par: Zhou, Dewei, et autres
Publié: (2025)
par: Zhou, Dewei, et autres
Publié: (2025)
ViLA: Efficient Video-Language Alignment for Video Question Answering
par: Wang, Xijun, et autres
Publié: (2023)
par: Wang, Xijun, et autres
Publié: (2023)
RealDPO: Real or Not Real, that is the Preference
par: Cheng, Guo, et autres
Publié: (2025)
par: Cheng, Guo, et autres
Publié: (2025)
Modality-Fair Preference Optimization for Trustworthy MLLM Alignment
par: Jiang, Songtao, et autres
Publié: (2024)
par: Jiang, Songtao, et autres
Publié: (2024)
OpenHumanVid: A Large-Scale High-Quality Dataset for Enhancing Human-Centric Video Generation
par: Li, Hui, et autres
Publié: (2024)
par: Li, Hui, et autres
Publié: (2024)
Documents similaires
-
VidSketch: Hand-drawn Sketch-Driven Video Generation with Diffusion Control
par: Jiang, Lifan, et autres
Publié: (2025) -
MagicID: Hybrid Preference Optimization for ID-Consistent and Dynamic-Preserved Video Customization
par: Li, Hengjia, et autres
Publié: (2025) -
VideoDPO: Omni-Preference Alignment for Video Diffusion Generation
par: Liu, Runtao, et autres
Publié: (2024) -
HuM-Eval: A Coarse-to-Fine Framework for Human-Centric Video Evaluation
par: Zhang, Bingzi, et autres
Publié: (2026) -
AVC-DPO: Aligned Video Captioning via Direct Preference Optimization
par: Tang, Jiyang, et autres
Publié: (2025)