DEMO: Disentangled Motion Latent Flow Matching for Fine-Grained Controllable Talking Portrait Synthesis
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Peiyin, Yang, Zhuowei, Feng, Hui, Jiang, Sheng, Yan, Rui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FLOAT: Generative Motion Latent Flow Matching for Audio-driven Talking Portrait
por: Ki, Taekyung, et al.
Publicado: (2024)
por: Ki, Taekyung, et al.
Publicado: (2024)
FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis
por: Wang, Mengchao, et al.
Publicado: (2025)
por: Wang, Mengchao, et al.
Publicado: (2025)
DeX-Portrait: Disentangled and Expressive Portrait Animation via Explicit and Latent Motion Representations
por: Shi, Yuxiang, et al.
Publicado: (2025)
por: Shi, Yuxiang, et al.
Publicado: (2025)
DEMO: A Statistical Perspective for Efficient Image-Text Matching
por: Zhang, Fan, et al.
Publicado: (2024)
por: Zhang, Fan, et al.
Publicado: (2024)
CogPortrait: Fine-Grained Eye-Region Control in Portrait Animation via Hierarchical Agent Planning
por: Feng, He, et al.
Publicado: (2026)
por: Feng, He, et al.
Publicado: (2026)
Real3D-Portrait: One-shot Realistic 3D Talking Portrait Synthesis
por: Ye, Zhenhui, et al.
Publicado: (2024)
por: Ye, Zhenhui, et al.
Publicado: (2024)
Disentangle Identity, Cooperate Emotion: Correlation-Aware Emotional Talking Portrait Generation
por: Tan, Weipeng, et al.
Publicado: (2025)
por: Tan, Weipeng, et al.
Publicado: (2025)
FactorPortrait: Controllable Portrait Animation via Disentangled Expression, Pose, and Viewpoint
por: Tang, Jiapeng, et al.
Publicado: (2025)
por: Tang, Jiapeng, et al.
Publicado: (2025)
EDTalk++: Full Disentanglement for Controllable Talking Head Synthesis
por: Tan, Shuai, et al.
Publicado: (2025)
por: Tan, Shuai, et al.
Publicado: (2025)
PortraitDirector: A Hierarchical Disentanglement Framework for Controllable and Real-time Facial Reenactment
por: Ji, Chaonan, et al.
Publicado: (2026)
por: Ji, Chaonan, et al.
Publicado: (2026)
Toward Fine-Grained Facial Control in 3D Talking Head Generation
por: Xie, Shaoyang, et al.
Publicado: (2026)
por: Xie, Shaoyang, et al.
Publicado: (2026)
LVLMs as inspectors: an agentic framework for category-level structural defect annotation
por: Jiang, Sheng, et al.
Publicado: (2025)
por: Jiang, Sheng, et al.
Publicado: (2025)
LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis
por: Li, Tianqi, et al.
Publicado: (2024)
por: Li, Tianqi, et al.
Publicado: (2024)
HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis
por: Liu, Shiyu, et al.
Publicado: (2025)
por: Liu, Shiyu, et al.
Publicado: (2025)
FineXtrol: Controllable Motion Generation via Fine-Grained Text
por: Shen, Keming, et al.
Publicado: (2025)
por: Shen, Keming, et al.
Publicado: (2025)
CDST: Color Disentangled Style Transfer for Universal Style Reference Customization
por: Zhang, Shiwen, et al.
Publicado: (2025)
por: Zhang, Shiwen, et al.
Publicado: (2025)
MotionSight: Boosting Fine-Grained Motion Understanding in Multimodal LLMs
por: Du, Yipeng, et al.
Publicado: (2025)
por: Du, Yipeng, et al.
Publicado: (2025)
Talk3D: High-Fidelity Talking Portrait Synthesis via Personalized 3D Generative Prior
por: Ko, Jaehoon, et al.
Publicado: (2024)
por: Ko, Jaehoon, et al.
Publicado: (2024)
Make Your Actor Talk: Generalizable and High-Fidelity Lip Sync with Motion and Appearance Disentanglement
por: Yu, Runyi, et al.
Publicado: (2024)
por: Yu, Runyi, et al.
Publicado: (2024)
I2VControl: Disentangled and Unified Video Motion Synthesis Control
por: Feng, Wanquan, et al.
Publicado: (2024)
por: Feng, Wanquan, et al.
Publicado: (2024)
Bitrate-Controlled Diffusion for Disentangling Motion and Content in Video
por: Li, Xiao, et al.
Publicado: (2025)
por: Li, Xiao, et al.
Publicado: (2025)
EDTalk: Efficient Disentanglement for Emotional Talking Head Synthesis
por: Tan, Shuai, et al.
Publicado: (2024)
por: Tan, Shuai, et al.
Publicado: (2024)
IC-Portrait: In-Context Matching for View-Consistent Personalized Portrait
por: Yang, Han, et al.
Publicado: (2025)
por: Yang, Han, et al.
Publicado: (2025)
LIA-X: Interpretable Latent Portrait Animator
por: Wang, Yaohui, et al.
Publicado: (2025)
por: Wang, Yaohui, et al.
Publicado: (2025)
MotionCharacter: Fine-Grained Motion Controllable Human Video Generation
por: Fang, Haopeng, et al.
Publicado: (2024)
por: Fang, Haopeng, et al.
Publicado: (2024)
RAW-Flow: Advancing RGB-to-RAW Image Reconstruction with Deterministic Latent Flow Matching
por: Liu, Zhen, et al.
Publicado: (2026)
por: Liu, Zhen, et al.
Publicado: (2026)
ConsistentID: Portrait Generation with Multimodal Fine-Grained Identity Preserving
por: Huang, Jiehui, et al.
Publicado: (2024)
por: Huang, Jiehui, et al.
Publicado: (2024)
DiffPortrait3D: Controllable Diffusion for Zero-Shot Portrait View Synthesis
por: Gu, Yuming, et al.
Publicado: (2023)
por: Gu, Yuming, et al.
Publicado: (2023)
EmoCAST: Emotional Talking Portrait via Emotive Text Description
por: Jiang, Yiguo, et al.
Publicado: (2025)
por: Jiang, Yiguo, et al.
Publicado: (2025)
Visually-Guided Controllable Medical Image Generation via Fine-Grained Semantic Disentanglement
por: Huang, Xin, et al.
Publicado: (2026)
por: Huang, Xin, et al.
Publicado: (2026)
MAGIC-Talk: Motion-aware Audio-Driven Talking Face Generation with Customizable Identity Control
por: Nazarieh, Fatemeh, et al.
Publicado: (2025)
por: Nazarieh, Fatemeh, et al.
Publicado: (2025)
FREAK: Frequency-modulated High-fidelity and Real-time Audio-driven Talking Portrait Synthesis
por: Ni, Ziqi, et al.
Publicado: (2025)
por: Ni, Ziqi, et al.
Publicado: (2025)
Splat-Portrait: Generalizing Talking Heads with Gaussian Splatting
por: Shi, Tong, et al.
Publicado: (2026)
por: Shi, Tong, et al.
Publicado: (2026)
UniTalking: A Unified Audio-Video Framework for Talking Portrait Generation
por: Li, Hebeizi, et al.
Publicado: (2026)
por: Li, Hebeizi, et al.
Publicado: (2026)
Unlock Pose Diversity: Accurate and Efficient Implicit Keypoint-based Spatiotemporal Diffusion for Audio-driven Talking Portrait
por: Yang, Chaolong, et al.
Publicado: (2025)
por: Yang, Chaolong, et al.
Publicado: (2025)
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
por: Fei, Zhengcong, et al.
Publicado: (2025)
por: Fei, Zhengcong, et al.
Publicado: (2025)
Fine-Grained VLM Fine-tuning via Latent Hierarchical Adapter Learning
por: Zhao, Yumiao, et al.
Publicado: (2025)
por: Zhao, Yumiao, et al.
Publicado: (2025)
From Attenuation to Attention: Variational Information Flow Manipulation for Fine-Grained Visual Perception
por: Zhu, Jilong, et al.
Publicado: (2026)
por: Zhu, Jilong, et al.
Publicado: (2026)
A Comprehensive Taxonomy and Analysis of Talking Head Synthesis: Techniques for Portrait Generation, Driving Mechanisms, and Editing
por: Meng, Ming, et al.
Publicado: (2024)
por: Meng, Ming, et al.
Publicado: (2024)
PortraitTalk: Towards Customizable One-Shot Audio-to-Talking Face Generation
por: Nazarieh, Fatemeh, et al.
Publicado: (2024)
por: Nazarieh, Fatemeh, et al.
Publicado: (2024)
Ejemplares similares
-
FLOAT: Generative Motion Latent Flow Matching for Audio-driven Talking Portrait
por: Ki, Taekyung, et al.
Publicado: (2024) -
FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis
por: Wang, Mengchao, et al.
Publicado: (2025) -
DeX-Portrait: Disentangled and Expressive Portrait Animation via Explicit and Latent Motion Representations
por: Shi, Yuxiang, et al.
Publicado: (2025) -
DEMO: A Statistical Perspective for Efficient Image-Text Matching
por: Zhang, Fan, et al.
Publicado: (2024) -
CogPortrait: Fine-Grained Eye-Region Control in Portrait Animation via Hierarchical Agent Planning
por: Feng, He, et al.
Publicado: (2026)