MegActor-$Σ$: Unlocking Flexible Mixed-Modal Control in Portrait Animation with Diffusion Transformer
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Shurong, Li, Huadong, Wu, Juhao, Jing, Minhao, Li, Linze, Ji, Renhe, Liang, Jiajun, Fan, Haoqiang, Wang, Jin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MegActor: Harness the Power of Raw Video for Vivid Portrait Animation
par: Yang, Shurong, et autres
Publié: (2024)
par: Yang, Shurong, et autres
Publié: (2024)
Sparse Beats Dense: Rethinking Supervision in Radar-Camera Depth Completion
par: Li, Huadong, et autres
Publié: (2023)
par: Li, Huadong, et autres
Publié: (2023)
Towards RGB-NIR Cross-modality Image Registration and Beyond
par: Li, Huadong, et autres
Publié: (2024)
par: Li, Huadong, et autres
Publié: (2024)
FantasyPortrait: Enhancing Multi-Character Portrait Animation with Expression-Augmented Diffusion Transformers
par: Wang, Qiang, et autres
Publié: (2025)
par: Wang, Qiang, et autres
Publié: (2025)
Optimizing Knowledge Distillation in Transformers: Enabling Multi-Head Attention without Alignment Barriers
par: Bing, Zhaodong, et autres
Publié: (2025)
par: Bing, Zhaodong, et autres
Publié: (2025)
SkyReels-A1: Expressive Portrait Animation in Video Diffusion Transformers
par: Qiu, Di, et autres
Publié: (2025)
par: Qiu, Di, et autres
Publié: (2025)
HunyuanPortrait: Implicit Condition Control for Enhanced Portrait Animation
par: Xu, Zunnan, et autres
Publié: (2025)
par: Xu, Zunnan, et autres
Publié: (2025)
RAP: Real-time Audio-driven Portrait Animation with Video Diffusion Transformer
par: Du, Fangyu, et autres
Publié: (2025)
par: Du, Fangyu, et autres
Publié: (2025)
SOAP: Style-Omniscient Animatable Portraits
par: Liao, Tingting, et autres
Publié: (2025)
par: Liao, Tingting, et autres
Publié: (2025)
Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer
par: Cui, Jiahao, et autres
Publié: (2024)
par: Cui, Jiahao, et autres
Publié: (2024)
Playmate: Flexible Control of Portrait Animation via 3D-Implicit Space Guided Diffusion
par: Ma, Xingpei, et autres
Publié: (2025)
par: Ma, Xingpei, et autres
Publié: (2025)
Loki: Representation over Architecture for Diffusion-Based Portrait Animation
par: Navard, Pouyan, et autres
Publié: (2026)
par: Navard, Pouyan, et autres
Publié: (2026)
Meg Stuart
par: Jochim, Annamira
Publié: (2020)
par: Jochim, Annamira
Publié: (2020)
Joint Learning of Depth and Appearance for Portrait Image Animation
par: Ji, Xinya, et autres
Publié: (2025)
par: Ji, Xinya, et autres
Publié: (2025)
FactorPortrait: Controllable Portrait Animation via Disentangled Expression, Pose, and Viewpoint
par: Tang, Jiapeng, et autres
Publié: (2025)
par: Tang, Jiapeng, et autres
Publié: (2025)
AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation
par: Wei, Huawei, et autres
Publié: (2024)
par: Wei, Huawei, et autres
Publié: (2024)
X-Portrait: Expressive Portrait Animation with Hierarchical Motion Attention
par: Xie, You, et autres
Publié: (2024)
par: Xie, You, et autres
Publié: (2024)
LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control
par: Guo, Jianzhu, et autres
Publié: (2024)
par: Guo, Jianzhu, et autres
Publié: (2024)
CogPortrait: Fine-Grained Eye-Region Control in Portrait Animation via Hierarchical Agent Planning
par: Feng, He, et autres
Publié: (2026)
par: Feng, He, et autres
Publié: (2026)
DeX-Portrait: Disentangled and Expressive Portrait Animation via Explicit and Latent Motion Representations
par: Shi, Yuxiang, et autres
Publié: (2025)
par: Shi, Yuxiang, et autres
Publié: (2025)
FG-Portrait: 3D Flow Guided Editable Portrait Animation
par: Xu, Yating, et autres
Publié: (2026)
par: Xu, Yating, et autres
Publié: (2026)
PersonaLive! Expressive Portrait Image Animation for Live Streaming
par: Li, Zhiyuan, et autres
Publié: (2025)
par: Li, Zhiyuan, et autres
Publié: (2025)
Sonic: Shifting Focus to Global Audio Perception in Portrait Animation
par: Ji, Xiaozhong, et autres
Publié: (2024)
par: Ji, Xiaozhong, et autres
Publié: (2024)
LIA-X: Interpretable Latent Portrait Animator
par: Wang, Yaohui, et autres
Publié: (2025)
par: Wang, Yaohui, et autres
Publié: (2025)
Nossos agradecimentos à Meg
par: Deise Mancebo
Publié: (2006)
par: Deise Mancebo
Publié: (2006)
High-Fidelity Relightable Monocular Portrait Animation with Lighting-Controllable Video Diffusion Model
par: Guo, Mingtao, et autres
Publié: (2025)
par: Guo, Mingtao, et autres
Publié: (2025)
FlashPortrait: 6x Faster Infinite Portrait Animation with Adaptive Latent Prediction
par: Tu, Shuyuan, et autres
Publié: (2025)
par: Tu, Shuyuan, et autres
Publié: (2025)
Davenport-Heilbronn Function Ratio Properties and Non-Trivial Zeros Study
par: Liu, Tao, et autres
Publié: (2025)
par: Liu, Tao, et autres
Publié: (2025)
FPGA: Flexible Portrait Generation Approach
par: Deng, Zhaoli, et autres
Publié: (2024)
par: Deng, Zhaoli, et autres
Publié: (2024)
Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation
par: Xu, Mingwang, et autres
Publié: (2024)
par: Xu, Mingwang, et autres
Publié: (2024)
SynergyWarpNet: Attention-Guided Cooperative Warping for Neural Portrait Animation
par: Li, Shihang, et autres
Publié: (2025)
par: Li, Shihang, et autres
Publié: (2025)
LEDiT: Your Length-Extrapolatable Diffusion Transformer without Positional Encoding
par: Zhang, Shen, et autres
Publié: (2025)
par: Zhang, Shen, et autres
Publié: (2025)
Broadly Tunable Liquid‐State Lasers and Solid‐State Single‐Longitudinal‐Mode Near‐Infrared Lasers Utilizing Halogen‐Doped Graphene Quantum Dots
par: Shurong Ding, et autres
Publié: (2025)
par: Shurong Ding, et autres
Publié: (2025)
MVP4D: Multi-View Portrait Video Diffusion for Animatable 4D Avatars
par: Taubner, Felix, et autres
Publié: (2025)
par: Taubner, Felix, et autres
Publié: (2025)
DiffPortrait360: Consistent Portrait Diffusion for 360 View Synthesis
par: Gu, Yuming, et autres
Publié: (2025)
par: Gu, Yuming, et autres
Publié: (2025)
Follow the Leader: Enhancing Systematic Trend-Following Using Network Momentum
par: Li, Linze, et autres
Publié: (2025)
par: Li, Linze, et autres
Publié: (2025)
EchoMimic: Lifelike Audio-Driven Portrait Animations through Editable Landmark Conditions
par: Chen, Zhiyuan, et autres
Publié: (2024)
par: Chen, Zhiyuan, et autres
Publié: (2024)
FantasyTalking2: Timestep-Layer Adaptive Preference Optimization for Audio-Driven Portrait Animation
par: Wang, MengChao, et autres
Publié: (2025)
par: Wang, MengChao, et autres
Publié: (2025)
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
par: Fei, Zhengcong, et autres
Publié: (2025)
par: Fei, Zhengcong, et autres
Publié: (2025)
Knot Forcing: Taming Autoregressive Video Diffusion Models for Real-time Infinite Interactive Portrait Animation
par: Xiao, Steven, et autres
Publié: (2025)
par: Xiao, Steven, et autres
Publié: (2025)
Documents similaires
-
MegActor: Harness the Power of Raw Video for Vivid Portrait Animation
par: Yang, Shurong, et autres
Publié: (2024) -
Sparse Beats Dense: Rethinking Supervision in Radar-Camera Depth Completion
par: Li, Huadong, et autres
Publié: (2023) -
Towards RGB-NIR Cross-modality Image Registration and Beyond
par: Li, Huadong, et autres
Publié: (2024) -
FantasyPortrait: Enhancing Multi-Character Portrait Animation with Expression-Augmented Diffusion Transformers
par: Wang, Qiang, et autres
Publié: (2025) -
Optimizing Knowledge Distillation in Transformers: Enabling Multi-Head Attention without Alignment Barriers
par: Bing, Zhaodong, et autres
Publié: (2025)