MotionFollower: Editing Video Motion via Lightweight Score-Guided Diffusion
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tu, Shuyuan, Dai, Qi, Zhang, Zihao, Xie, Sicheng, Cheng, Zhi-Qi, Luo, Chong, Han, Xintong, Wu, Zuxuan, Jiang, Yu-Gang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AUTHENTICATION: Identifying Rare Failure Modes in Autonomous Vehicle Perception Systems using Adversarially Guided Diffusion Models
par: Zarei, Mohammad, et autres
Publié: (2025)
par: Zarei, Mohammad, et autres
Publié: (2025)
Human Motion Capture from Loose and Sparse Inertial Sensors with Garment-aware Diffusion Models
par: Ilic, Andela, et autres
Publié: (2025)
par: Ilic, Andela, et autres
Publié: (2025)
Motion Consistency Loss for Monocular Visual Odometry with Attention-Based Deep Learning
par: Françani, André O., et autres
Publié: (2024)
par: Françani, André O., et autres
Publié: (2024)
Hodge Laplacians and Hodge Diffusion Maps
par: Gomez, Alvaro Almeida, et autres
Publié: (2025)
par: Gomez, Alvaro Almeida, et autres
Publié: (2025)
CigTime: Corrective Instruction Generation Through Inverse Motion Editing
par: Fang, Qihang, et autres
Publié: (2024)
par: Fang, Qihang, et autres
Publié: (2024)
Meaning over Motion: A Semantic-First Approach to 360° Viewport Prediction
par: Khah, Arman Nik, et autres
Publié: (2026)
par: Khah, Arman Nik, et autres
Publié: (2026)
Minimal Solvers for Full DoF Motion Estimation from Asynchronous Tracks
par: Hruby, Petr, et autres
Publié: (2025)
par: Hruby, Petr, et autres
Publié: (2025)
Extrapolating and Decoupling Image-to-Video Generation Models: Motion Modeling is Easier Than You Think
par: Tian, Jie, et autres
Publié: (2025)
par: Tian, Jie, et autres
Publié: (2025)
EatGAN: An Edge-Attention Guided Generative Adversarial Network for Single Image Super-Resolution
par: Rao, Penghao, et autres
Publié: (2025)
par: Rao, Penghao, et autres
Publié: (2025)
TWIG: Two-Step Image Generation using Segmentation Masks in Diffusion Models
par: Rakib, Mazharul Islam, et autres
Publié: (2025)
par: Rakib, Mazharul Islam, et autres
Publié: (2025)
PAT-VCM: Plug-and-Play Auxiliary Tokens for Video Coding for Machines
par: Jiang, Wei, et autres
Publié: (2026)
par: Jiang, Wei, et autres
Publié: (2026)
Depth Priors in Removal Neural Radiance Fields
par: Guo, Zhihao, et autres
Publié: (2024)
par: Guo, Zhihao, et autres
Publié: (2024)
Memory-augmented Online Video Anomaly Detection
par: Rossi, Leonardo, et autres
Publié: (2023)
par: Rossi, Leonardo, et autres
Publié: (2023)
Large Language Models Powered Context-aware Motion Prediction in Autonomous Driving
par: Zheng, Xiaoji, et autres
Publié: (2024)
par: Zheng, Xiaoji, et autres
Publié: (2024)
Reduced Jeffries-Matusita distance: A Novel Loss Function to Improve Generalization Performance of Deep Classification Models
par: Lashkari, Mohammad, et autres
Publié: (2024)
par: Lashkari, Mohammad, et autres
Publié: (2024)
How Well Do Vision-Language Models Understand Sequential Driving Scenes? A Sensitivity Study
par: Brusnicki, Roberto, et autres
Publié: (2026)
par: Brusnicki, Roberto, et autres
Publié: (2026)
MvBody: Multi-View-Based Hybrid Transformer Using Optical 3D Body Scan for Explainable Cesarean Section Prediction
par: Cheng, Ruting, et autres
Publié: (2025)
par: Cheng, Ruting, et autres
Publié: (2025)
Socratic Planner: Self-QA-Based Zero-Shot Planning for Embodied Instruction Following
par: Shin, Suyeon, et autres
Publié: (2024)
par: Shin, Suyeon, et autres
Publié: (2024)
The Shape of Math To Come
par: Kontorovich, Alex
Publié: (2025)
par: Kontorovich, Alex
Publié: (2025)
Attire-Based Anomaly Detection in Restricted Areas Using YOLOv8 for Enhanced CCTV Security
par: B, Abdul Aziz A., et autres
Publié: (2024)
par: B, Abdul Aziz A., et autres
Publié: (2024)
Motion-Based Sign Language Video Summarization using Curvature and Torsion
par: Sartinas, Evangelos G., et autres
Publié: (2023)
par: Sartinas, Evangelos G., et autres
Publié: (2023)
Knowledge-Guided Failure Prediction: Detecting When Object Detectors Miss Safety-Critical Objects
par: Zimmermann, Jakob Paul, et autres
Publié: (2026)
par: Zimmermann, Jakob Paul, et autres
Publié: (2026)
Quality Over Quantity? LLM-Based Curation for a Data-Efficient Audio-Video Foundation Model
par: Vosoughi, Ali, et autres
Publié: (2025)
par: Vosoughi, Ali, et autres
Publié: (2025)
Z-Order Transformer for Feed-Forward Gaussian Splatting
par: Wang, Can, et autres
Publié: (2026)
par: Wang, Can, et autres
Publié: (2026)
Isolated Sign Language Recognition with Segmentation and Pose Estimation
par: Perkins, Daniel, et autres
Publié: (2025)
par: Perkins, Daniel, et autres
Publié: (2025)
Multimodal Integration Challenges in Emotionally Expressive Child Avatars for Training Applications
par: Salehi, Pegah, et autres
Publié: (2025)
par: Salehi, Pegah, et autres
Publié: (2025)
Optimizing MoE Routers: Design, Implementation, and Evaluation in Transformer Models
par: Harvey, Daniel Fidel, et autres
Publié: (2025)
par: Harvey, Daniel Fidel, et autres
Publié: (2025)
Interactive Image Selection and Training for Brain Tumor Segmentation Network
par: Cerqueira, Matheus A., et autres
Publié: (2024)
par: Cerqueira, Matheus A., et autres
Publié: (2024)
Product gales and Finite state dimension
par: S, Akhil
Publié: (2025)
par: S, Akhil
Publié: (2025)
Performance Decay in Deepfake Detection: The Limitations of Training on Outdated Data
par: Richings, Jack, et autres
Publié: (2025)
par: Richings, Jack, et autres
Publié: (2025)
SealD-NeRF: Interactive Pixel-Level Editing for Dynamic Scenes by Neural Radiance Fields
par: Huang, Zhentao, et autres
Publié: (2024)
par: Huang, Zhentao, et autres
Publié: (2024)
RefineFormer3D: Efficient 3D Medical Image Segmentation via Adaptive Multi-Scale Transformer with Cross Attention Fusion
par: Tyagi, Kavyansh, et autres
Publié: (2026)
par: Tyagi, Kavyansh, et autres
Publié: (2026)
Transformer-Based Model for Monocular Visual Odometry: A Video Understanding Approach
par: Françani, André O., et autres
Publié: (2023)
par: Françani, André O., et autres
Publié: (2023)
Black-box Adversarial Attacks on CNN-based SLAM Algorithms
par: Gkeka, Maria Rafaela, et autres
Publié: (2025)
par: Gkeka, Maria Rafaela, et autres
Publié: (2025)
Probabilistic Selection in AgentSpeak(L)
par: Coelho, Francisco, et autres
Publié: (2014)
par: Coelho, Francisco, et autres
Publié: (2014)
Computational Imaging Priors for Wireless Capsule Endoscopy: Monte Carlo-Guided Hemoglobin Mapping for Rare-Anomaly Detection
par: Yang, Chengshuai, et autres
Publié: (2026)
par: Yang, Chengshuai, et autres
Publié: (2026)
Pre-Asymptotic Trainability in Photonic Variational Circuits under Postselection
par: Xie, Yichen, et autres
Publié: (2026)
par: Xie, Yichen, et autres
Publié: (2026)
Multimodal Structure-Aware Quantum Data Processing
par: Hawashin, Hala, et autres
Publié: (2024)
par: Hawashin, Hala, et autres
Publié: (2024)
Floorplan2Guide: LLM-Guided Floorplan Parsing for BLV Indoor Navigation
par: Ayanzadeh, Aydin, et autres
Publié: (2025)
par: Ayanzadeh, Aydin, et autres
Publié: (2025)
A Comprehensive LLM-powered Framework for Driving Intelligence Evaluation
par: You, Shanhe, et autres
Publié: (2025)
par: You, Shanhe, et autres
Publié: (2025)
Documents similaires
-
AUTHENTICATION: Identifying Rare Failure Modes in Autonomous Vehicle Perception Systems using Adversarially Guided Diffusion Models
par: Zarei, Mohammad, et autres
Publié: (2025) -
Human Motion Capture from Loose and Sparse Inertial Sensors with Garment-aware Diffusion Models
par: Ilic, Andela, et autres
Publié: (2025) -
Motion Consistency Loss for Monocular Visual Odometry with Attention-Based Deep Learning
par: Françani, André O., et autres
Publié: (2024) -
Hodge Laplacians and Hodge Diffusion Maps
par: Gomez, Alvaro Almeida, et autres
Publié: (2025) -
CigTime: Corrective Instruction Generation Through Inverse Motion Editing
par: Fang, Qihang, et autres
Publié: (2024)