Implicit Preference Alignment for Human Image Animation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Yuanzhi, Ren, Xuhua, Cheng, Jiaxiang, Ma, Bing, Yu, Kai, Zheng, Tianxiang, Lu, Qinglin, Cui, Zhen |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
FaithfulFaces: Pose-Faithful Facial Identity Preservation for Text-to-Video Generation
von: Wang, Yuanzhi, et al.
Veröffentlicht: (2026)
von: Wang, Yuanzhi, et al.
Veröffentlicht: (2026)
PersonaVlog: Personalized Multimodal Vlog Generation with Multi-Agent Collaboration and Iterative Self-Correction
von: Hou, Xiaolu, et al.
Veröffentlicht: (2025)
von: Hou, Xiaolu, et al.
Veröffentlicht: (2025)
Beyond Reward Margin: Rethinking and Resolving Likelihood Displacement in Diffusion Models via Video Generation
von: Xu, Ruojun, et al.
Veröffentlicht: (2025)
von: Xu, Ruojun, et al.
Veröffentlicht: (2025)
Phased One-Step Adversarial Equilibrium for Video Diffusion Models
von: Cheng, Jiaxiang, et al.
Veröffentlicht: (2025)
von: Cheng, Jiaxiang, et al.
Veröffentlicht: (2025)
StableAnimator++: Overcoming Pose Misalignment and Face Distortion for Human Image Animation
von: Tu, Shuyuan, et al.
Veröffentlicht: (2025)
von: Tu, Shuyuan, et al.
Veröffentlicht: (2025)
StableAnimator: High-Quality Identity-Preserving Human Image Animation
von: Tu, Shuyuan, et al.
Veröffentlicht: (2024)
von: Tu, Shuyuan, et al.
Veröffentlicht: (2024)
One-to-All Animation: Alignment-Free Character Animation and Image Pose Transfer
von: Shi, Shijun, et al.
Veröffentlicht: (2025)
von: Shi, Shijun, et al.
Veröffentlicht: (2025)
EvAnimate: Event-conditioned Image-to-Video Generation for Human Animation
von: Qu, Qiang, et al.
Veröffentlicht: (2025)
von: Qu, Qiang, et al.
Veröffentlicht: (2025)
Modality-Fair Preference Optimization for Trustworthy MLLM Alignment
von: Jiang, Songtao, et al.
Veröffentlicht: (2024)
von: Jiang, Songtao, et al.
Veröffentlicht: (2024)
Dormant: Defending against Pose-driven Human Image Animation
von: Zhou, Jiachen, et al.
Veröffentlicht: (2024)
von: Zhou, Jiachen, et al.
Veröffentlicht: (2024)
HunyuanPortrait: Implicit Condition Control for Enhanced Portrait Animation
von: Xu, Zunnan, et al.
Veröffentlicht: (2025)
von: Xu, Zunnan, et al.
Veröffentlicht: (2025)
Versatile Multimodal Controls for Expressive Talking Human Animation
von: Qin, Zheng, et al.
Veröffentlicht: (2025)
von: Qin, Zheng, et al.
Veröffentlicht: (2025)
Multi-identity Human Image Animation with Structural Video Diffusion
von: Wang, Zhenzhi, et al.
Veröffentlicht: (2025)
von: Wang, Zhenzhi, et al.
Veröffentlicht: (2025)
AnimateAnywhere: Rouse the Background in Human Image Animation
von: Liu, Xiaoyu, et al.
Veröffentlicht: (2025)
von: Liu, Xiaoyu, et al.
Veröffentlicht: (2025)
ILDiff: Generate Transparent Animated Stickers by Implicit Layout Distillation
von: Zhang, Ting, et al.
Veröffentlicht: (2024)
von: Zhang, Ting, et al.
Veröffentlicht: (2024)
Free Lunch Alignment of Text-to-Image Diffusion Models without Preference Image Pairs
von: Xian, Jia Jun Cheng, et al.
Veröffentlicht: (2025)
von: Xian, Jia Jun Cheng, et al.
Veröffentlicht: (2025)
HumanVid: Demystifying Training Data for Camera-controllable Human Image Animation
von: Wang, Zhenzhi, et al.
Veröffentlicht: (2024)
von: Wang, Zhenzhi, et al.
Veröffentlicht: (2024)
Improving Human Image Animation via Semantic Representation Alignment
von: Liu, Chang, et al.
Veröffentlicht: (2026)
von: Liu, Chang, et al.
Veröffentlicht: (2026)
SteadyDancer: Harmonized and Coherent Human Image Animation with First-Frame Preservation
von: Zhang, Jiaming, et al.
Veröffentlicht: (2025)
von: Zhang, Jiaming, et al.
Veröffentlicht: (2025)
Instant Preference Alignment for Text-to-Image Diffusion Models
von: Li, Yang, et al.
Veröffentlicht: (2025)
von: Li, Yang, et al.
Veröffentlicht: (2025)
EverAnimate: Minute-Scale Human Animation via Latent Flow Restoration
von: Li, Wuyang, et al.
Veröffentlicht: (2026)
von: Li, Wuyang, et al.
Veröffentlicht: (2026)
LoopAnimate: Loopable Salient Object Animation
von: Wang, Fanyi, et al.
Veröffentlicht: (2024)
von: Wang, Fanyi, et al.
Veröffentlicht: (2024)
Open-Vocabulary Scene Text Recognition via Pseudo-Image Labeling and Margin Loss
von: Ren, Xuhua, et al.
Veröffentlicht: (2024)
von: Ren, Xuhua, et al.
Veröffentlicht: (2024)
PIA: Your Personalized Image Animator via Plug-and-Play Modules in Text-to-Image Models
von: Zhang, Yiming, et al.
Veröffentlicht: (2023)
von: Zhang, Yiming, et al.
Veröffentlicht: (2023)
HunyuanVideo-Avatar: High-Fidelity Audio-Driven Human Animation for Multiple Characters
von: Chen, Yi, et al.
Veröffentlicht: (2025)
von: Chen, Yi, et al.
Veröffentlicht: (2025)
Anomaly-Preference Image Generation
von: Wang, Fuyun, et al.
Veröffentlicht: (2026)
von: Wang, Fuyun, et al.
Veröffentlicht: (2026)
TCAN: Animating Human Images with Temporally Consistent Pose Guidance using Diffusion Models
von: Kim, Jeongho, et al.
Veröffentlicht: (2024)
von: Kim, Jeongho, et al.
Veröffentlicht: (2024)
LHM: Large Animatable Human Reconstruction Model from a Single Image in Seconds
von: Qiu, Lingteng, et al.
Veröffentlicht: (2025)
von: Qiu, Lingteng, et al.
Veröffentlicht: (2025)
HunyuanVideo-HOMA: Generic Human-Object Interaction in Multimodal Driven Human Animation
von: Huang, Ziyao, et al.
Veröffentlicht: (2025)
von: Huang, Ziyao, et al.
Veröffentlicht: (2025)
X-UniMotion: Animating Human Images with Expressive, Unified and Identity-Agnostic Motion Latents
von: Song, Guoxian, et al.
Veröffentlicht: (2025)
von: Song, Guoxian, et al.
Veröffentlicht: (2025)
DreamActor-M1: Holistic, Expressive and Robust Human Image Animation with Hybrid Guidance
von: Luo, Yuxuan, et al.
Veröffentlicht: (2025)
von: Luo, Yuxuan, et al.
Veröffentlicht: (2025)
SSMamba: A Self-Supervised Hybrid State Space Model for Pathological Image Classification
von: Chai, Enhui, et al.
Veröffentlicht: (2026)
von: Chai, Enhui, et al.
Veröffentlicht: (2026)
Towards Multiple Character Image Animation Through Enhancing Implicit Decoupling
von: Xue, Jingyun, et al.
Veröffentlicht: (2024)
von: Xue, Jingyun, et al.
Veröffentlicht: (2024)
DiffSpeaker: Speech-Driven 3D Facial Animation with Diffusion Transformer
von: Ma, Zhiyuan, et al.
Veröffentlicht: (2024)
von: Ma, Zhiyuan, et al.
Veröffentlicht: (2024)
iHuman: Instant Animatable Digital Humans From Monocular Videos
von: Paudel, Pramish, et al.
Veröffentlicht: (2024)
von: Paudel, Pramish, et al.
Veröffentlicht: (2024)
IM-Animation: An Implicit Motion Representation for Identity-decoupled Character Animation
von: Xu, Zhufeng, et al.
Veröffentlicht: (2026)
von: Xu, Zhufeng, et al.
Veröffentlicht: (2026)
OptiScene: LLM-driven Indoor Scene Layout Generation via Scaled Human-aligned Data Synthesis and Multi-Stage Preference Optimization
von: Yang, Yixuan, et al.
Veröffentlicht: (2025)
von: Yang, Yixuan, et al.
Veröffentlicht: (2025)
LEO: Generative Latent Image Animator for Human Video Synthesis
von: Wang, Yaohui, et al.
Veröffentlicht: (2023)
von: Wang, Yaohui, et al.
Veröffentlicht: (2023)
Diffusion Blend: Inference-Time Multi-Preference Alignment for Diffusion Models
von: Cheng, Min, et al.
Veröffentlicht: (2025)
von: Cheng, Min, et al.
Veröffentlicht: (2025)
InterActHuman: Multi-Concept Human Animation with Layout-Aligned Audio Conditions
von: Wang, Zhenzhi, et al.
Veröffentlicht: (2025)
von: Wang, Zhenzhi, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
FaithfulFaces: Pose-Faithful Facial Identity Preservation for Text-to-Video Generation
von: Wang, Yuanzhi, et al.
Veröffentlicht: (2026) -
PersonaVlog: Personalized Multimodal Vlog Generation with Multi-Agent Collaboration and Iterative Self-Correction
von: Hou, Xiaolu, et al.
Veröffentlicht: (2025) -
Beyond Reward Margin: Rethinking and Resolving Likelihood Displacement in Diffusion Models via Video Generation
von: Xu, Ruojun, et al.
Veröffentlicht: (2025) -
Phased One-Step Adversarial Equilibrium for Video Diffusion Models
von: Cheng, Jiaxiang, et al.
Veröffentlicht: (2025) -
StableAnimator++: Overcoming Pose Misalignment and Face Distortion for Human Image Animation
von: Tu, Shuyuan, et al.
Veröffentlicht: (2025)