McSc: Motion-Corrective Preference Alignment for Video Generation with Self-Critic Hierarchical Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Qiushi, Chen, Yingjie, Yao, Yuan, Men, Yifang, Liu, Huaizhuo, Cui, Miaomiao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Perception-as-Control: Fine-grained Controllable Image Animation with 3D-aware Motion Representation
di: Chen, Yingjie, et al.
Pubblicazione: (2025)
di: Chen, Yingjie, et al.
Pubblicazione: (2025)
MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling
di: Men, Yifang, et al.
Pubblicazione: (2024)
di: Men, Yifang, et al.
Pubblicazione: (2024)
Qwen3-VL-Seg: Unlocking Open-World Referring Segmentation with Vision-Language Grounding
di: Yao, Yuan, et al.
Pubblicazione: (2026)
di: Yao, Yuan, et al.
Pubblicazione: (2026)
En3D: An Enhanced Generative Model for Sculpting 3D Humans from 2D Synthetic Data
di: Men, Yifang, et al.
Pubblicazione: (2024)
di: Men, Yifang, et al.
Pubblicazione: (2024)
MoSAM: Motion-Guided Segment Anything Model with Spatial-Temporal Memory Selection
di: Yang, Qiushi, et al.
Pubblicazione: (2025)
di: Yang, Qiushi, et al.
Pubblicazione: (2025)
Towards Fine-grained Interactive Segmentation in Images and Videos
di: Yao, Yuan, et al.
Pubblicazione: (2025)
di: Yao, Yuan, et al.
Pubblicazione: (2025)
Fleximo: Towards Flexible Text-to-Human Motion Video Generation
di: Zhang, Yuhang, et al.
Pubblicazione: (2024)
di: Zhang, Yuhang, et al.
Pubblicazione: (2024)
Disentangling Foreground and Background Motion for Enhanced Realism in Human Video Generation
di: Liu, Jinlin, et al.
Pubblicazione: (2024)
di: Liu, Jinlin, et al.
Pubblicazione: (2024)
Creating Your Editable 3D Photorealistic Avatar with Tetrahedron-constrained Gaussian Splatting
di: Liu, Hanxi, et al.
Pubblicazione: (2025)
di: Liu, Hanxi, et al.
Pubblicazione: (2025)
TextAlign: Preference Alignment for Text Rendering with Hierarchical Rewards
di: Cui, Mingxuan, et al.
Pubblicazione: (2026)
di: Cui, Mingxuan, et al.
Pubblicazione: (2026)
GaussianIP: Identity-Preserving Realistic 3D Human Generation via Human-Centric Diffusion Prior
di: Tang, Zichen, et al.
Pubblicazione: (2025)
di: Tang, Zichen, et al.
Pubblicazione: (2025)
MotiMotion: Motion-Controlled Video Generation with Visual Reasoning
di: Hsin-Ying, Lee, et al.
Pubblicazione: (2026)
di: Hsin-Ying, Lee, et al.
Pubblicazione: (2026)
Hierarchical Fine-grained Preference Optimization for Physically Plausible Video Generation
di: Chen, Harold Haodong, et al.
Pubblicazione: (2025)
di: Chen, Harold Haodong, et al.
Pubblicazione: (2025)
InteractPro: A Unified Framework for Motion-Aware Image Composition
di: Tao, Weijing, et al.
Pubblicazione: (2024)
di: Tao, Weijing, et al.
Pubblicazione: (2024)
Generating Editable Head Avatars with 3D Gaussian GANs
di: Li, Guohao, et al.
Pubblicazione: (2024)
di: Li, Guohao, et al.
Pubblicazione: (2024)
EgoMotion: Hierarchical Reasoning and Diffusion for Egocentric Vision-Language Motion Generation
di: Hou, Ruibing, et al.
Pubblicazione: (2026)
di: Hou, Ruibing, et al.
Pubblicazione: (2026)
MotionFlux: Efficient Text-Guided Motion Generation through Rectified Flow Matching and Preference Alignment
di: Gao, Zhiting, et al.
Pubblicazione: (2025)
di: Gao, Zhiting, et al.
Pubblicazione: (2025)
LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs
di: Wang, Xiaodong, et al.
Pubblicazione: (2025)
di: Wang, Xiaodong, et al.
Pubblicazione: (2025)
Joint-Motion Mutual Learning for Pose Estimation in Videos
di: Wu, Sifan, et al.
Pubblicazione: (2024)
di: Wu, Sifan, et al.
Pubblicazione: (2024)
SMRABooth: Subject and Motion Representation Alignment for Customized Video Generation
di: Xu, Xuancheng, et al.
Pubblicazione: (2025)
di: Xu, Xuancheng, et al.
Pubblicazione: (2025)
VideoDPO: Omni-Preference Alignment for Video Diffusion Generation
di: Liu, Runtao, et al.
Pubblicazione: (2024)
di: Liu, Runtao, et al.
Pubblicazione: (2024)
I4VGen: Image as Free Stepping Stone for Text-to-Video Generation
di: Guo, Xiefan, et al.
Pubblicazione: (2024)
di: Guo, Xiefan, et al.
Pubblicazione: (2024)
ShortFT: Diffusion Model Alignment via Shortcut-based Fine-Tuning
di: Guo, Xiefan, et al.
Pubblicazione: (2025)
di: Guo, Xiefan, et al.
Pubblicazione: (2025)
MMSummary: Multimodal Summary Generation for Fetal Ultrasound Video
di: Guo, Xiaoqing, et al.
Pubblicazione: (2024)
di: Guo, Xiaoqing, et al.
Pubblicazione: (2024)
SHAPE : Self-Improved Visual Preference Alignment by Iteratively Generating Holistic Winner
di: Chen, Kejia, et al.
Pubblicazione: (2025)
di: Chen, Kejia, et al.
Pubblicazione: (2025)
The Consistency Critic: Correcting Inconsistencies in Generated Images via Reference-Guided Attentive Alignment
di: Ouyang, Ziheng, et al.
Pubblicazione: (2025)
di: Ouyang, Ziheng, et al.
Pubblicazione: (2025)
A Self-supervised Motion Representation for Portrait Video Generation
di: Zhang, Qiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Qiyuan, et al.
Pubblicazione: (2025)
Tempered Self-Similarity Alignment for Physically Plausible Video Generation
di: Kim, Manjin, et al.
Pubblicazione: (2026)
di: Kim, Manjin, et al.
Pubblicazione: (2026)
VideoPASTA: 7K Preference Pairs That Matter for Video-LLM Alignment
di: Kulkarni, Yogesh, et al.
Pubblicazione: (2025)
di: Kulkarni, Yogesh, et al.
Pubblicazione: (2025)
LongVPO: From Anchored Cues to Self-Reasoning for Long-Form Video Preference Optimization
di: Huang, Zhenpeng, et al.
Pubblicazione: (2026)
di: Huang, Zhenpeng, et al.
Pubblicazione: (2026)
Motion Dreamer: Boundary Conditional Motion Reasoning for Physically Coherent Video Generation
di: Xu, Tianshuo, et al.
Pubblicazione: (2024)
di: Xu, Tianshuo, et al.
Pubblicazione: (2024)
Joint Optimization of Neural Radiance Fields and Continuous Camera Motion from a Monocular Video
di: Nguyen, Hoang Chuong, et al.
Pubblicazione: (2025)
di: Nguyen, Hoang Chuong, et al.
Pubblicazione: (2025)
SAMA: Factorized Semantic Anchoring and Motion Alignment for Instruction-Guided Video Editing
di: Zhang, Xinyao, et al.
Pubblicazione: (2026)
di: Zhang, Xinyao, et al.
Pubblicazione: (2026)
Pressure2Motion: Hierarchical Human Motion Reconstruction from Ground Pressure with Text Guidance
di: Li, Zhengxuan, et al.
Pubblicazione: (2025)
di: Li, Zhengxuan, et al.
Pubblicazione: (2025)
MotionPro: A Precise Motion Controller for Image-to-Video Generation
di: Zhang, Zhongwei, et al.
Pubblicazione: (2025)
di: Zhang, Zhongwei, et al.
Pubblicazione: (2025)
SHIFT: Motion Alignment in Video Diffusion Models with Adversarial Hybrid Fine-Tuning
di: Ye, Xi, et al.
Pubblicazione: (2026)
di: Ye, Xi, et al.
Pubblicazione: (2026)
Improving Alignment in LVLMs with Debiased Self-Judgment
di: Yang, Sihan, et al.
Pubblicazione: (2025)
di: Yang, Sihan, et al.
Pubblicazione: (2025)
VideoLifter: Lifting Videos to 3D with Fast Hierarchical Stereo Alignment
di: Cong, Wenyan, et al.
Pubblicazione: (2025)
di: Cong, Wenyan, et al.
Pubblicazione: (2025)
Exploring Motion-Language Alignment for Text-driven Motion Generation
di: Gu, Ruxi, et al.
Pubblicazione: (2026)
di: Gu, Ruxi, et al.
Pubblicazione: (2026)
MoLingo: Motion-Language Alignment for Text-to-Motion Generation
di: He, Yannan, et al.
Pubblicazione: (2025)
di: He, Yannan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Perception-as-Control: Fine-grained Controllable Image Animation with 3D-aware Motion Representation
di: Chen, Yingjie, et al.
Pubblicazione: (2025) -
MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling
di: Men, Yifang, et al.
Pubblicazione: (2024) -
Qwen3-VL-Seg: Unlocking Open-World Referring Segmentation with Vision-Language Grounding
di: Yao, Yuan, et al.
Pubblicazione: (2026) -
En3D: An Enhanced Generative Model for Sculpting 3D Humans from 2D Synthetic Data
di: Men, Yifang, et al.
Pubblicazione: (2024) -
MoSAM: Motion-Guided Segment Anything Model with Spatial-Temporal Memory Selection
di: Yang, Qiushi, et al.
Pubblicazione: (2025)