Identity-Consistent Video Generation under Large Facial-Angle Variations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hu, Bin, Qi, Zipeng, Huang, Guoxi, Xu, Zunnan, Zhang, Ruicheng, Ye, Chongjie, Zhou, Jun, Li, Xiu, Wang, Jingdong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Zo3T: Zero-Shot 3D-Aware Trajectory-Guided Image-to-Video Generation via Test-Time Training
par: Zhang, Ruicheng, et autres
Publié: (2025)
par: Zhang, Ruicheng, et autres
Publié: (2025)
Layered Rendering Diffusion Model for Controllable Zero-Shot Image Synthesis
par: Qi, Zipeng, et autres
Publié: (2023)
par: Qi, Zipeng, et autres
Publié: (2023)
KVPO: ODE-Native GRPO for Autoregressive Video Alignment via KV Semantic Exploration
par: Zhang, Ruicheng, et autres
Publié: (2026)
par: Zhang, Ruicheng, et autres
Publié: (2026)
DiffMagicFace: Identity Consistent Facial Editing of Real Videos
par: Yin, Huanghao, et autres
Publié: (2026)
par: Yin, Huanghao, et autres
Publié: (2026)
RoboStereo: Dual-Tower 4D Embodied World Models for Unified Policy Optimization
par: Zhang, Ruicheng, et autres
Publié: (2026)
par: Zhang, Ruicheng, et autres
Publié: (2026)
Audio-visual Controlled Video Diffusion with Masked Selective State Spaces Modeling for Natural Talking Head Generation
par: Hong, Fa-Ting, et autres
Publié: (2025)
par: Hong, Fa-Ting, et autres
Publié: (2025)
Consistent123: One Image to Highly Consistent 3D Asset Using Case-Aware Diffusion Priors
par: Lin, Yukang, et autres
Publié: (2023)
par: Lin, Yukang, et autres
Publié: (2023)
MIND-V: Hierarchical World Model for Long-Horizon Robotic Manipulation with RL-based Physical Alignment
par: Zhang, Ruicheng, et autres
Publié: (2025)
par: Zhang, Ruicheng, et autres
Publié: (2025)
From Restoration to Reconstruction: Rethinking 3D Gaussian Splatting for Underwater Scenes
par: Huang, Guoxi, et autres
Publié: (2025)
par: Huang, Guoxi, et autres
Publié: (2025)
Bayesian Neural Networks for One-to-Many Mapping in Image Enhancement
par: Huang, Guoxi, et autres
Publié: (2025)
par: Huang, Guoxi, et autres
Publié: (2025)
Diverse and Lifespan Facial Age Transformation Synthesis with Identity Variation Rationality Metric
par: Xie, Jiu-Cheng, et autres
Publié: (2024)
par: Xie, Jiu-Cheng, et autres
Publié: (2024)
Controllable Layer Decomposition for Reversible Multi-Layer Image Generation
par: Liu, Zihao, et autres
Publié: (2025)
par: Liu, Zihao, et autres
Publié: (2025)
Collaborative Face Experts Fusion in Video Generation: Boosting Identity Consistency Across Large Face Poses
par: Wang, Yuji, et autres
Publié: (2025)
par: Wang, Yuji, et autres
Publié: (2025)
Alignment is All You Need: A Training-free Augmentation Strategy for Pose-guided Video Generation
par: Jin, Xiaoyu, et autres
Publié: (2024)
par: Jin, Xiaoyu, et autres
Publié: (2024)
LumiSculpt: Enabling Consistent Portrait Lighting in Video Generation
par: Zhang, Yuxin, et autres
Publié: (2024)
par: Zhang, Yuxin, et autres
Publié: (2024)
HaploOmni: Unified Single Transformer for Multimodal Video Understanding and Generation
par: Xiao, Yicheng, et autres
Publié: (2025)
par: Xiao, Yicheng, et autres
Publié: (2025)
Dynamic Weight-based Temporal Aggregation for Low-light Video Enhancement Under Extreme Noise
par: Lin, Ruirui, et autres
Publié: (2025)
par: Lin, Ruirui, et autres
Publié: (2025)
Identity-Preserving Pose-Guided Character Animation via Facial Landmarks Transformation
par: Mu, Lianrui, et autres
Publié: (2024)
par: Mu, Lianrui, et autres
Publié: (2024)
Facial Identity Anonymization via Intrinsic and Extrinsic Attention Distraction
par: Kuang, Zhenzhong, et autres
Publié: (2024)
par: Kuang, Zhenzhong, et autres
Publié: (2024)
SAM-R1: Leveraging SAM for Reward Feedback in Multimodal Segmentation via Reinforcement Learning
par: Huang, Jiaqi, et autres
Publié: (2025)
par: Huang, Jiaqi, et autres
Publié: (2025)
FaithfulFaces: Pose-Faithful Facial Identity Preservation for Text-to-Video Generation
par: Wang, Yuanzhi, et autres
Publié: (2026)
par: Wang, Yuanzhi, et autres
Publié: (2026)
VGGTFace: Topologically Consistent Facial Geometry Reconstruction in the Wild
par: Ming, Xin, et autres
Publié: (2025)
par: Ming, Xin, et autres
Publié: (2025)
VideoMV: Consistent Multi-View Generation Based on Large Video Generative Model
par: Zuo, Qi, et autres
Publié: (2024)
par: Zuo, Qi, et autres
Publié: (2024)
Densely Connected Parameter-Efficient Tuning for Referring Image Segmentation
par: Huang, Jiaqi, et autres
Publié: (2025)
par: Huang, Jiaqi, et autres
Publié: (2025)
BeyondFacial: Identity-Preserving Personalized Generation Beyond Facial Close-ups
par: Zhang, Songsong, et autres
Publié: (2025)
par: Zhang, Songsong, et autres
Publié: (2025)
InstaVSR: Taming Diffusion for Efficient and Temporally Consistent Video Super-Resolution
par: Hu, Jintong, et autres
Publié: (2026)
par: Hu, Jintong, et autres
Publié: (2026)
ContextGen: Contextual Layout Anchoring for Identity-Consistent Multi-Instance Generation
par: Xu, Ruihang, et autres
Publié: (2025)
par: Xu, Ruihang, et autres
Publié: (2025)
Optimizing ID Consistency in Multimodal Large Models: Facial Restoration via Alignment, Entanglement, and Disentanglement
par: Dong, Yuran, et autres
Publié: (2026)
par: Dong, Yuran, et autres
Publié: (2026)
Identity-Consistent Multi-Pose Generation of Contactless Fingerprints
par: Pan, Zhiyu, et autres
Publié: (2026)
par: Pan, Zhiyu, et autres
Publié: (2026)
ConsID-Gen: View-Consistent and Identity-Preserving Image-to-Video Generation
par: Wu, Mingyang, et autres
Publié: (2026)
par: Wu, Mingyang, et autres
Publié: (2026)
IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion
par: Anand, Tharun, et autres
Publié: (2025)
par: Anand, Tharun, et autres
Publié: (2025)
ConsistentID: Portrait Generation with Multimodal Fine-Grained Identity Preserving
par: Huang, Jiehui, et autres
Publié: (2024)
par: Huang, Jiehui, et autres
Publié: (2024)
DynamicFace: High-Quality and Consistent Face Swapping for Image and Video using Composable 3D Facial Priors
par: Wang, Runqi, et autres
Publié: (2025)
par: Wang, Runqi, et autres
Publié: (2025)
PyGS: Large-scale Scene Representation with Pyramidal 3D Gaussian Splatting
par: Wang, Zipeng, et autres
Publié: (2024)
par: Wang, Zipeng, et autres
Publié: (2024)
VideoMemory: Toward Consistent Video Generation via Memory Integration
par: Zhou, Jinsong, et autres
Publié: (2026)
par: Zhou, Jinsong, et autres
Publié: (2026)
COVE: Unleashing the Diffusion Feature Correspondence for Consistent Video Editing
par: Wang, Jiangshan, et autres
Publié: (2024)
par: Wang, Jiangshan, et autres
Publié: (2024)
Light-X: Generative 4D Video Rendering with Camera and Illumination Control
par: Liu, Tianqi, et autres
Publié: (2025)
par: Liu, Tianqi, et autres
Publié: (2025)
Video Object Segmentation with Dynamic Query Modulation
par: Zhou, Hantao, et autres
Publié: (2024)
par: Zhou, Hantao, et autres
Publié: (2024)
AToM: Aligning Text-to-Motion Model at Event-Level with GPT-4Vision Reward
par: Han, Haonan, et autres
Publié: (2024)
par: Han, Haonan, et autres
Publié: (2024)
Separate to Collaborate: Dual-Stream Diffusion Model for Coordinated Piano Hand Motion Synthesis
par: Liu, Zihao, et autres
Publié: (2025)
par: Liu, Zihao, et autres
Publié: (2025)
Documents similaires
-
Zo3T: Zero-Shot 3D-Aware Trajectory-Guided Image-to-Video Generation via Test-Time Training
par: Zhang, Ruicheng, et autres
Publié: (2025) -
Layered Rendering Diffusion Model for Controllable Zero-Shot Image Synthesis
par: Qi, Zipeng, et autres
Publié: (2023) -
KVPO: ODE-Native GRPO for Autoregressive Video Alignment via KV Semantic Exploration
par: Zhang, Ruicheng, et autres
Publié: (2026) -
DiffMagicFace: Identity Consistent Facial Editing of Real Videos
par: Yin, Huanghao, et autres
Publié: (2026) -
RoboStereo: Dual-Tower 4D Embodied World Models for Unified Policy Optimization
par: Zhang, Ruicheng, et autres
Publié: (2026)