MegActor-$Σ$: Unlocking Flexible Mixed-Modal Control in Portrait Animation with Diffusion Transformer
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Shurong, Li, Huadong, Wu, Juhao, Jing, Minhao, Li, Linze, Ji, Renhe, Liang, Jiajun, Fan, Haoqiang, Wang, Jin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MegActor: Harness the Power of Raw Video for Vivid Portrait Animation
di: Yang, Shurong, et al.
Pubblicazione: (2024)
di: Yang, Shurong, et al.
Pubblicazione: (2024)
Sparse Beats Dense: Rethinking Supervision in Radar-Camera Depth Completion
di: Li, Huadong, et al.
Pubblicazione: (2023)
di: Li, Huadong, et al.
Pubblicazione: (2023)
Towards RGB-NIR Cross-modality Image Registration and Beyond
di: Li, Huadong, et al.
Pubblicazione: (2024)
di: Li, Huadong, et al.
Pubblicazione: (2024)
FantasyPortrait: Enhancing Multi-Character Portrait Animation with Expression-Augmented Diffusion Transformers
di: Wang, Qiang, et al.
Pubblicazione: (2025)
di: Wang, Qiang, et al.
Pubblicazione: (2025)
Optimizing Knowledge Distillation in Transformers: Enabling Multi-Head Attention without Alignment Barriers
di: Bing, Zhaodong, et al.
Pubblicazione: (2025)
di: Bing, Zhaodong, et al.
Pubblicazione: (2025)
SkyReels-A1: Expressive Portrait Animation in Video Diffusion Transformers
di: Qiu, Di, et al.
Pubblicazione: (2025)
di: Qiu, Di, et al.
Pubblicazione: (2025)
HunyuanPortrait: Implicit Condition Control for Enhanced Portrait Animation
di: Xu, Zunnan, et al.
Pubblicazione: (2025)
di: Xu, Zunnan, et al.
Pubblicazione: (2025)
RAP: Real-time Audio-driven Portrait Animation with Video Diffusion Transformer
di: Du, Fangyu, et al.
Pubblicazione: (2025)
di: Du, Fangyu, et al.
Pubblicazione: (2025)
SOAP: Style-Omniscient Animatable Portraits
di: Liao, Tingting, et al.
Pubblicazione: (2025)
di: Liao, Tingting, et al.
Pubblicazione: (2025)
Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer
di: Cui, Jiahao, et al.
Pubblicazione: (2024)
di: Cui, Jiahao, et al.
Pubblicazione: (2024)
Playmate: Flexible Control of Portrait Animation via 3D-Implicit Space Guided Diffusion
di: Ma, Xingpei, et al.
Pubblicazione: (2025)
di: Ma, Xingpei, et al.
Pubblicazione: (2025)
Loki: Representation over Architecture for Diffusion-Based Portrait Animation
di: Navard, Pouyan, et al.
Pubblicazione: (2026)
di: Navard, Pouyan, et al.
Pubblicazione: (2026)
Meg Stuart
di: Jochim, Annamira
Pubblicazione: (2020)
di: Jochim, Annamira
Pubblicazione: (2020)
Joint Learning of Depth and Appearance for Portrait Image Animation
di: Ji, Xinya, et al.
Pubblicazione: (2025)
di: Ji, Xinya, et al.
Pubblicazione: (2025)
FactorPortrait: Controllable Portrait Animation via Disentangled Expression, Pose, and Viewpoint
di: Tang, Jiapeng, et al.
Pubblicazione: (2025)
di: Tang, Jiapeng, et al.
Pubblicazione: (2025)
AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation
di: Wei, Huawei, et al.
Pubblicazione: (2024)
di: Wei, Huawei, et al.
Pubblicazione: (2024)
X-Portrait: Expressive Portrait Animation with Hierarchical Motion Attention
di: Xie, You, et al.
Pubblicazione: (2024)
di: Xie, You, et al.
Pubblicazione: (2024)
LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control
di: Guo, Jianzhu, et al.
Pubblicazione: (2024)
di: Guo, Jianzhu, et al.
Pubblicazione: (2024)
CogPortrait: Fine-Grained Eye-Region Control in Portrait Animation via Hierarchical Agent Planning
di: Feng, He, et al.
Pubblicazione: (2026)
di: Feng, He, et al.
Pubblicazione: (2026)
DeX-Portrait: Disentangled and Expressive Portrait Animation via Explicit and Latent Motion Representations
di: Shi, Yuxiang, et al.
Pubblicazione: (2025)
di: Shi, Yuxiang, et al.
Pubblicazione: (2025)
FG-Portrait: 3D Flow Guided Editable Portrait Animation
di: Xu, Yating, et al.
Pubblicazione: (2026)
di: Xu, Yating, et al.
Pubblicazione: (2026)
PersonaLive! Expressive Portrait Image Animation for Live Streaming
di: Li, Zhiyuan, et al.
Pubblicazione: (2025)
di: Li, Zhiyuan, et al.
Pubblicazione: (2025)
Sonic: Shifting Focus to Global Audio Perception in Portrait Animation
di: Ji, Xiaozhong, et al.
Pubblicazione: (2024)
di: Ji, Xiaozhong, et al.
Pubblicazione: (2024)
LIA-X: Interpretable Latent Portrait Animator
di: Wang, Yaohui, et al.
Pubblicazione: (2025)
di: Wang, Yaohui, et al.
Pubblicazione: (2025)
Nossos agradecimentos à Meg
di: Deise Mancebo
Pubblicazione: (2006)
di: Deise Mancebo
Pubblicazione: (2006)
High-Fidelity Relightable Monocular Portrait Animation with Lighting-Controllable Video Diffusion Model
di: Guo, Mingtao, et al.
Pubblicazione: (2025)
di: Guo, Mingtao, et al.
Pubblicazione: (2025)
FlashPortrait: 6x Faster Infinite Portrait Animation with Adaptive Latent Prediction
di: Tu, Shuyuan, et al.
Pubblicazione: (2025)
di: Tu, Shuyuan, et al.
Pubblicazione: (2025)
Davenport-Heilbronn Function Ratio Properties and Non-Trivial Zeros Study
di: Liu, Tao, et al.
Pubblicazione: (2025)
di: Liu, Tao, et al.
Pubblicazione: (2025)
FPGA: Flexible Portrait Generation Approach
di: Deng, Zhaoli, et al.
Pubblicazione: (2024)
di: Deng, Zhaoli, et al.
Pubblicazione: (2024)
Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation
di: Xu, Mingwang, et al.
Pubblicazione: (2024)
di: Xu, Mingwang, et al.
Pubblicazione: (2024)
SynergyWarpNet: Attention-Guided Cooperative Warping for Neural Portrait Animation
di: Li, Shihang, et al.
Pubblicazione: (2025)
di: Li, Shihang, et al.
Pubblicazione: (2025)
LEDiT: Your Length-Extrapolatable Diffusion Transformer without Positional Encoding
di: Zhang, Shen, et al.
Pubblicazione: (2025)
di: Zhang, Shen, et al.
Pubblicazione: (2025)
Broadly Tunable Liquid‐State Lasers and Solid‐State Single‐Longitudinal‐Mode Near‐Infrared Lasers Utilizing Halogen‐Doped Graphene Quantum Dots
di: Shurong Ding, et al.
Pubblicazione: (2025)
di: Shurong Ding, et al.
Pubblicazione: (2025)
MVP4D: Multi-View Portrait Video Diffusion for Animatable 4D Avatars
di: Taubner, Felix, et al.
Pubblicazione: (2025)
di: Taubner, Felix, et al.
Pubblicazione: (2025)
DiffPortrait360: Consistent Portrait Diffusion for 360 View Synthesis
di: Gu, Yuming, et al.
Pubblicazione: (2025)
di: Gu, Yuming, et al.
Pubblicazione: (2025)
Follow the Leader: Enhancing Systematic Trend-Following Using Network Momentum
di: Li, Linze, et al.
Pubblicazione: (2025)
di: Li, Linze, et al.
Pubblicazione: (2025)
EchoMimic: Lifelike Audio-Driven Portrait Animations through Editable Landmark Conditions
di: Chen, Zhiyuan, et al.
Pubblicazione: (2024)
di: Chen, Zhiyuan, et al.
Pubblicazione: (2024)
FantasyTalking2: Timestep-Layer Adaptive Preference Optimization for Audio-Driven Portrait Animation
di: Wang, MengChao, et al.
Pubblicazione: (2025)
di: Wang, MengChao, et al.
Pubblicazione: (2025)
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
di: Fei, Zhengcong, et al.
Pubblicazione: (2025)
di: Fei, Zhengcong, et al.
Pubblicazione: (2025)
Knot Forcing: Taming Autoregressive Video Diffusion Models for Real-time Infinite Interactive Portrait Animation
di: Xiao, Steven, et al.
Pubblicazione: (2025)
di: Xiao, Steven, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MegActor: Harness the Power of Raw Video for Vivid Portrait Animation
di: Yang, Shurong, et al.
Pubblicazione: (2024) -
Sparse Beats Dense: Rethinking Supervision in Radar-Camera Depth Completion
di: Li, Huadong, et al.
Pubblicazione: (2023) -
Towards RGB-NIR Cross-modality Image Registration and Beyond
di: Li, Huadong, et al.
Pubblicazione: (2024) -
FantasyPortrait: Enhancing Multi-Character Portrait Animation with Expression-Augmented Diffusion Transformers
di: Wang, Qiang, et al.
Pubblicazione: (2025) -
Optimizing Knowledge Distillation in Transformers: Enabling Multi-Head Attention without Alignment Barriers
di: Bing, Zhaodong, et al.
Pubblicazione: (2025)