SHIFT: Motion Alignment in Video Diffusion Models with Adversarial Hybrid Fine-Tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ye, Xi, Yang, Wenjia, Xu, Yangyang, Liu, Xiaoyang, Su, Duo, Xia, Mengfei, Zhu, Jun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi-Task Dense Prediction Fine-Tuning with Mixture of Fine-Grained Experts
par: Xu, Yangyang, et autres
Publié: (2025)
par: Xu, Yangyang, et autres
Publié: (2025)
$h$-control: Training-Free Camera Control via Block-Conditional Gibbs Refinement
par: Wang, Yuzhu, et autres
Publié: (2026)
par: Wang, Yuzhu, et autres
Publié: (2026)
Cross-Frame Representation Alignment for Fine-Tuning Video Diffusion Models
par: Hwang, Sungwon, et autres
Publié: (2025)
par: Hwang, Sungwon, et autres
Publié: (2025)
CityLLaVA: Efficient Fine-Tuning for VLMs in City Scenario
par: Duan, Zhizhao, et autres
Publié: (2024)
par: Duan, Zhizhao, et autres
Publié: (2024)
Spectral Motion Alignment for Video Motion Transfer using Diffusion Models
par: Park, Geon Yeong, et autres
Publié: (2024)
par: Park, Geon Yeong, et autres
Publié: (2024)
Fine-Grained Spatiotemporal Motion Alignment for Contrastive Video Representation Learning
par: Zhu, Minghao, et autres
Publié: (2023)
par: Zhu, Minghao, et autres
Publié: (2023)
MoBind: Motion Binding for Fine-Grained IMU-Video Pose Alignment
par: Nguyen, Duc Duy, et autres
Publié: (2026)
par: Nguyen, Duc Duy, et autres
Publié: (2026)
MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization
par: Zhang, Zhexin, et autres
Publié: (2026)
par: Zhang, Zhexin, et autres
Publié: (2026)
DAPE: Dual-Stage Parameter-Efficient Fine-Tuning for Consistent Video Editing with Diffusion Models
par: Xia, Junhao, et autres
Publié: (2025)
par: Xia, Junhao, et autres
Publié: (2025)
MoAlign: Motion-Centric Representation Alignment for Video Diffusion Models
par: Bhowmik, Aritra, et autres
Publié: (2025)
par: Bhowmik, Aritra, et autres
Publié: (2025)
ShortFT: Diffusion Model Alignment via Shortcut-based Fine-Tuning
par: Guo, Xiefan, et autres
Publié: (2025)
par: Guo, Xiefan, et autres
Publié: (2025)
VAU-R1: Advancing Video Anomaly Understanding via Reinforcement Fine-Tuning
par: Zhu, Liyun, et autres
Publié: (2025)
par: Zhu, Liyun, et autres
Publié: (2025)
EasyTune: Efficient Step-Aware Fine-Tuning for Diffusion-Based Motion Generation
par: Tan, Xiaofeng, et autres
Publié: (2026)
par: Tan, Xiaofeng, et autres
Publié: (2026)
Diffusion-DRF: Free, Rich, and Differentiable Reward for Video Diffusion Fine-Tuning
par: Wang, Yifan, et autres
Publié: (2026)
par: Wang, Yifan, et autres
Publié: (2026)
One-Step Diffusion Model for Image Motion-Deblurring
par: Liu, Xiaoyang, et autres
Publié: (2025)
par: Liu, Xiaoyang, et autres
Publié: (2025)
Zero-Shot Video Translation via Token Warping
par: Zhu, Haiming, et autres
Publié: (2024)
par: Zhu, Haiming, et autres
Publié: (2024)
Video Anomaly Detection with Motion and Appearance Guided Patch Diffusion Model
par: Zhou, Hang, et autres
Publié: (2024)
par: Zhou, Hang, et autres
Publié: (2024)
SmoothVideo: Smooth Video Synthesis with Noise Constraints on Diffusion Models for One-shot Video Tuning
par: Peng, Liang, et autres
Publié: (2023)
par: Peng, Liang, et autres
Publié: (2023)
Temporal In-Context Fine-Tuning with Temporal Reasoning for Versatile Control of Video Diffusion Models
par: Kim, Kinam, et autres
Publié: (2025)
par: Kim, Kinam, et autres
Publié: (2025)
Frame-wise Conditioning Adaptation for Fine-Tuning Diffusion Models in Text-to-Video Prediction
par: Liu, Zheyuan, et autres
Publié: (2025)
par: Liu, Zheyuan, et autres
Publié: (2025)
SHIFT: Stochastic Hidden-Trajectory Deflection for Removing Diffusion-based Watermark
par: Bao, Rui, et autres
Publié: (2026)
par: Bao, Rui, et autres
Publié: (2026)
GVDIFF: Grounded Text-to-Video Generation with Diffusion Models
par: Dou, Huanzhang, et autres
Publié: (2024)
par: Dou, Huanzhang, et autres
Publié: (2024)
Forcing-KV: Hybrid KV Cache Compression for Efficient Autoregressive Video Diffusion Models
par: Ji, Yicheng, et autres
Publié: (2026)
par: Ji, Yicheng, et autres
Publié: (2026)
FideDiff: Efficient Diffusion Model for High-Fidelity Image Motion Deblurring
par: Liu, Xiaoyang, et autres
Publié: (2025)
par: Liu, Xiaoyang, et autres
Publié: (2025)
Motion-Guided Latent Diffusion for Temporally Consistent Real-world Video Super-resolution
par: Yang, Xi, et autres
Publié: (2023)
par: Yang, Xi, et autres
Publié: (2023)
FreeTraj: Tuning-Free Trajectory Control in Video Diffusion Models
par: Qiu, Haonan, et autres
Publié: (2024)
par: Qiu, Haonan, et autres
Publié: (2024)
MotionStone: Decoupled Motion Intensity Modulation with Diffusion Transformer for Image-to-Video Generation
par: Shi, Shuwei, et autres
Publié: (2024)
par: Shi, Shuwei, et autres
Publié: (2024)
Trajectory Attention for Fine-grained Video Motion Control
par: Xiao, Zeqi, et autres
Publié: (2024)
par: Xiao, Zeqi, et autres
Publié: (2024)
6Bit-Diffusion: Inference-Time Mixed-Precision Quantization for Video Diffusion Models
par: Su, Rundong, et autres
Publié: (2026)
par: Su, Rundong, et autres
Publié: (2026)
MoGAN: Improving Motion Quality in Video Diffusion via Few-Step Motion Adversarial Post-Training
par: Xue, Haotian, et autres
Publié: (2025)
par: Xue, Haotian, et autres
Publié: (2025)
VideoRFT: Incentivizing Video Reasoning Capability in MLLMs via Reinforced Fine-Tuning
par: Wang, Qi, et autres
Publié: (2025)
par: Wang, Qi, et autres
Publié: (2025)
MotionBench: Benchmarking and Improving Fine-grained Video Motion Understanding for Vision Language Models
par: Hong, Wenyi, et autres
Publié: (2025)
par: Hong, Wenyi, et autres
Publié: (2025)
LUMA: Low-Dimension Unified Motion Alignment with Dual-Path Anchoring for Text-to-Motion Diffusion Model
par: Jia, Haozhe, et autres
Publié: (2025)
par: Jia, Haozhe, et autres
Publié: (2025)
Diff-Tracker: Text-to-Image Diffusion Models are Unsupervised Trackers
par: Zhang, Zhengbo, et autres
Publié: (2024)
par: Zhang, Zhengbo, et autres
Publié: (2024)
A Diffusion Model Translator for Efficient Image-to-Image Translation
par: Xia, Mengfei, et autres
Publié: (2025)
par: Xia, Mengfei, et autres
Publié: (2025)
Motion-aware Latent Diffusion Models for Video Frame Interpolation
par: Huang, Zhilin, et autres
Publié: (2024)
par: Huang, Zhilin, et autres
Publié: (2024)
Video Diffusion Models are Training-free Motion Interpreter and Controller
par: Xiao, Zeqi, et autres
Publié: (2024)
par: Xiao, Zeqi, et autres
Publié: (2024)
Motion Consistency Model: Accelerating Video Diffusion with Disentangled Motion-Appearance Distillation
par: Zhai, Yuanhao, et autres
Publié: (2024)
par: Zhai, Yuanhao, et autres
Publié: (2024)
Beyond Global Alignment: Fine-Grained Motion-Language Retrieval via Pyramidal Shapley-Taylor Learning
par: Chen, Hanmo, et autres
Publié: (2026)
par: Chen, Hanmo, et autres
Publié: (2026)
MotionRFT: Unified Reinforcement Fine-Tuning for Text-to-Motion Generation
par: Tan, Xiaofeng, et autres
Publié: (2026)
par: Tan, Xiaofeng, et autres
Publié: (2026)
Documents similaires
-
Multi-Task Dense Prediction Fine-Tuning with Mixture of Fine-Grained Experts
par: Xu, Yangyang, et autres
Publié: (2025) -
$h$-control: Training-Free Camera Control via Block-Conditional Gibbs Refinement
par: Wang, Yuzhu, et autres
Publié: (2026) -
Cross-Frame Representation Alignment for Fine-Tuning Video Diffusion Models
par: Hwang, Sungwon, et autres
Publié: (2025) -
CityLLaVA: Efficient Fine-Tuning for VLMs in City Scenario
par: Duan, Zhizhao, et autres
Publié: (2024) -
Spectral Motion Alignment for Video Motion Transfer using Diffusion Models
par: Park, Geon Yeong, et autres
Publié: (2024)