Proteus-ID: ID-Consistent and Motion-Coherent Video Customization
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Guiyu, Shi, Chen, Jiang, Zijian, Xiang, Xunzhi, Qian, Jingjing, Shi, Shaoshuai, Jiang, Li |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SymphoMotion: Joint Control of Camera Motion and Object Dynamics for Coherent Video Generation
von: Zhang, Guiyu, et al.
Veröffentlicht: (2026)
von: Zhang, Guiyu, et al.
Veröffentlicht: (2026)
MagicID: Hybrid Preference Optimization for ID-Consistent and Dynamic-Preserved Video Customization
von: Li, Hengjia, et al.
Veröffentlicht: (2025)
von: Li, Hengjia, et al.
Veröffentlicht: (2025)
LIVE: Long-horizon Interactive Video World Modeling
von: Huang, Junchao, et al.
Veröffentlicht: (2026)
von: Huang, Junchao, et al.
Veröffentlicht: (2026)
PersonalVideo: High ID-Fidelity Video Customization without Dynamic and Semantic Degradation
von: Li, Hengjia, et al.
Veröffentlicht: (2024)
von: Li, Hengjia, et al.
Veröffentlicht: (2024)
MTR++: Multi-Agent Motion Prediction with Symmetric Scene Modeling and Guided Intention Querying
von: Shi, Shaoshuai, et al.
Veröffentlicht: (2023)
von: Shi, Shaoshuai, et al.
Veröffentlicht: (2023)
DriveWAM: Video Generative Priors Enable Scalable World-Action Modeling for Autonomous Driving
von: Shi, Chen, et al.
Veröffentlicht: (2026)
von: Shi, Chen, et al.
Veröffentlicht: (2026)
GeoPredict: Leveraging Predictive Kinematics and 3D Gaussian Geometry for Precise VLA Manipulation
von: Qian, Jingjing, et al.
Veröffentlicht: (2025)
von: Qian, Jingjing, et al.
Veröffentlicht: (2025)
PuLID: Pure and Lightning ID Customization via Contrastive Alignment
von: Guo, Zinan, et al.
Veröffentlicht: (2024)
von: Guo, Zinan, et al.
Veröffentlicht: (2024)
FantasyID: Face Knowledge Enhanced ID-Preserving Video Generation
von: Zhang, Yunpeng, et al.
Veröffentlicht: (2025)
von: Zhang, Yunpeng, et al.
Veröffentlicht: (2025)
DriveX: Omni Scene Modeling for Learning Generalizable World Knowledge in Autonomous Driving
von: Shi, Chen, et al.
Veröffentlicht: (2025)
von: Shi, Chen, et al.
Veröffentlicht: (2025)
EditID: Training-Free Editable ID Customization for Text-to-Image Generation
von: Li, Guandong, et al.
Veröffentlicht: (2025)
von: Li, Guandong, et al.
Veröffentlicht: (2025)
Pathwise Test-Time Correction for Autoregressive Long Video Generation
von: Xiang, Xunzhi, et al.
Veröffentlicht: (2026)
von: Xiang, Xunzhi, et al.
Veröffentlicht: (2026)
Denoising Vision Transformer Autoencoder with Spectral Self-Regularization
von: Xiang, Xunzhi, et al.
Veröffentlicht: (2025)
von: Xiang, Xunzhi, et al.
Veröffentlicht: (2025)
Memory Forcing: Spatio-Temporal Memory for Consistent Scene Generation on Minecraft
von: Huang, Junchao, et al.
Veröffentlicht: (2025)
von: Huang, Junchao, et al.
Veröffentlicht: (2025)
EditIDv2: Editable ID Customization with Data-Lubricated ID Feature Integration for Text-to-Image Generation
von: Li, Guandong, et al.
Veröffentlicht: (2025)
von: Li, Guandong, et al.
Veröffentlicht: (2025)
Motion Inversion for Video Customization
von: Wang, Luozhou, et al.
Veröffentlicht: (2024)
von: Wang, Luozhou, et al.
Veröffentlicht: (2024)
MovieTeller: Tool-augmented Movie Synopsis with ID Consistent Progressive Abstraction
von: Li, Yizhi, et al.
Veröffentlicht: (2026)
von: Li, Yizhi, et al.
Veröffentlicht: (2026)
Customize-A-Video: One-Shot Motion Customization of Text-to-Video Diffusion Models
von: Ren, Yixuan, et al.
Veröffentlicht: (2024)
von: Ren, Yixuan, et al.
Veröffentlicht: (2024)
ConsID-Gen: View-Consistent and Identity-Preserving Image-to-Video Generation
von: Wu, Mingyang, et al.
Veröffentlicht: (2026)
von: Wu, Mingyang, et al.
Veröffentlicht: (2026)
Macro-from-Micro Planning for High-Quality and Parallelized Autoregressive Long Video Generation
von: Xiang, Xunzhi, et al.
Veröffentlicht: (2025)
von: Xiang, Xunzhi, et al.
Veröffentlicht: (2025)
ID-Patch: Robust ID Association for Group Photo Personalization
von: Zhang, Yimeng, et al.
Veröffentlicht: (2024)
von: Zhang, Yimeng, et al.
Veröffentlicht: (2024)
AMP: Autoregressive Motion Prediction Revisited with Next Token Prediction for Autonomous Driving
von: Jia, Xiaosong, et al.
Veröffentlicht: (2024)
von: Jia, Xiaosong, et al.
Veröffentlicht: (2024)
CoMo: Compositional Motion Customization for Text-to-Video Generation
von: Xu, Youcan, et al.
Veröffentlicht: (2025)
von: Xu, Youcan, et al.
Veröffentlicht: (2025)
QA-ReID: Quality-Aware Query-Adaptive Convolution Leveraging Fused Global and Structural Cues for Clothes-Changing ReID
von: Wang, Yuxiang, et al.
Veröffentlicht: (2026)
von: Wang, Yuxiang, et al.
Veröffentlicht: (2026)
MotionBooth: Motion-Aware Customized Text-to-Video Generation
von: Wu, Jianzong, et al.
Veröffentlicht: (2024)
von: Wu, Jianzong, et al.
Veröffentlicht: (2024)
WithAnyone: Towards Controllable and ID Consistent Image Generation
von: Xu, Hengyuan, et al.
Veröffentlicht: (2025)
von: Xu, Hengyuan, et al.
Veröffentlicht: (2025)
FaceSnap: Enhanced ID-fidelity Network for Tuning-free Portrait Customization
von: Zhai, Benxiang, et al.
Veröffentlicht: (2026)
von: Zhai, Benxiang, et al.
Veröffentlicht: (2026)
Ctrl-U: Robust Conditional Image Generation via Uncertainty-aware Reward Modeling
von: Zhang, Guiyu, et al.
Veröffentlicht: (2024)
von: Zhang, Guiyu, et al.
Veröffentlicht: (2024)
UniSplat: Unified Spatio-Temporal Fusion via 3D Latent Scaffolds for Dynamic Driving Scene Reconstruction
von: Shi, Chen, et al.
Veröffentlicht: (2025)
von: Shi, Chen, et al.
Veröffentlicht: (2025)
IDPro: Flexible Interactive Video Object Segmentation by ID-queried Concurrent Propagation
von: Li, Kexin, et al.
Veröffentlicht: (2024)
von: Li, Kexin, et al.
Veröffentlicht: (2024)
FaceID-6M: A Large-Scale, Open-Source FaceID Customization Dataset
von: Wang, Shuhe, et al.
Veröffentlicht: (2025)
von: Wang, Shuhe, et al.
Veröffentlicht: (2025)
HAMoBE: Hierarchical and Adaptive Mixture of Biometric Experts for Video-based Person ReID
von: Su, Yiyang, et al.
Veröffentlicht: (2025)
von: Su, Yiyang, et al.
Veröffentlicht: (2025)
JiSAM: Alleviate Labeling Burden and Corner Case Problems in Autonomous Driving via Minimal Real-World Data
von: Chen, Runjian, et al.
Veröffentlicht: (2025)
von: Chen, Runjian, et al.
Veröffentlicht: (2025)
Foresight in Motion: Reinforcing Trajectory Prediction with Reward Heuristics
von: Pei, Muleilan, et al.
Veröffentlicht: (2025)
von: Pei, Muleilan, et al.
Veröffentlicht: (2025)
ID-Crafter: VLM-Grounded Online RL for Compositional Multi-Subject Video Generation
von: Pan, Panwang, et al.
Veröffentlicht: (2025)
von: Pan, Panwang, et al.
Veröffentlicht: (2025)
Inv-Adapter: ID Customization Generation via Image Inversion and Lightweight Adapter
von: Xing, Peng, et al.
Veröffentlicht: (2024)
von: Xing, Peng, et al.
Veröffentlicht: (2024)
From Synthetic to Real: Toward Identity-Consistent Makeup Transfer with Synthetic and Real Data
von: Yu, Yue, et al.
Veröffentlicht: (2026)
von: Yu, Yue, et al.
Veröffentlicht: (2026)
Synthetic-To-Real Video Person Re-ID
von: Zhang, Xiangqun, et al.
Veröffentlicht: (2024)
von: Zhang, Xiangqun, et al.
Veröffentlicht: (2024)
ID-Animator: Zero-Shot Identity-Preserving Human Video Generation
von: He, Xuanhua, et al.
Veröffentlicht: (2024)
von: He, Xuanhua, et al.
Veröffentlicht: (2024)
DreamID-Omni: Unified Framework for Controllable Human-Centric Audio-Video Generation
von: Guo, Xu, et al.
Veröffentlicht: (2026)
von: Guo, Xu, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
SymphoMotion: Joint Control of Camera Motion and Object Dynamics for Coherent Video Generation
von: Zhang, Guiyu, et al.
Veröffentlicht: (2026) -
MagicID: Hybrid Preference Optimization for ID-Consistent and Dynamic-Preserved Video Customization
von: Li, Hengjia, et al.
Veröffentlicht: (2025) -
LIVE: Long-horizon Interactive Video World Modeling
von: Huang, Junchao, et al.
Veröffentlicht: (2026) -
PersonalVideo: High ID-Fidelity Video Customization without Dynamic and Semantic Degradation
von: Li, Hengjia, et al.
Veröffentlicht: (2024) -
MTR++: Multi-Agent Motion Prediction with Symmetric Scene Modeling and Guided Intention Querying
von: Shi, Shaoshuai, et al.
Veröffentlicht: (2023)