TALK-Act: Enhance Textural-Awareness for 2D Speaking Avatar Reenactment with Diffusion Model
Fuente:
arXiv
Saved in:
| Main Authors: | Guan, Jiazhi, Yang, Quanwei, Wang, Kaisiyuan, Zhou, Hang, He, Shengyi, Xu, Zhiliang, Feng, Haocheng, Ding, Errui, Wang, Jingdong, Xie, Hongtao, Zhao, Youjian, Liu, Ziwei |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
AudCast: Audio-Driven Human Video Generation by Cascaded Diffusion Transformers
by: Guan, Jiazhi, et al.
Published: (2025)
by: Guan, Jiazhi, et al.
Published: (2025)
ReSyncer: Rewiring Style-based Generator for Unified Audio-Visually Synced Facial Performer
by: Guan, Jiazhi, et al.
Published: (2024)
by: Guan, Jiazhi, et al.
Published: (2024)
iDiT-HOI: Inpainting-based Hand Object Interaction Reenactment via Video Diffusion Transformer
by: Shen, Zhelun, et al.
Published: (2025)
by: Shen, Zhelun, et al.
Published: (2025)
Re-HOLD: Video Hand Object Interaction Reenactment via adaptive Layout-instructed Diffusion Model
by: Fan, Yingying, et al.
Published: (2025)
by: Fan, Yingying, et al.
Published: (2025)
THGS: Lifelike Talking Human Avatar Synthesis From Monocular Video Via 3D Gaussian Splatting
by: Chuang Chen, et al.
Published: (2025)
by: Chuang Chen, et al.
Published: (2025)
AnyAct: Towards Human Reenactment of Character Motion From Video
by: Chen, Liuhan, et al.
Published: (2026)
by: Chen, Liuhan, et al.
Published: (2026)
Cosh-DiT: Co-Speech Gesture Video Synthesis via Hybrid Audio-Visual Diffusion Transformers
by: Sun, Yasheng, et al.
Published: (2025)
by: Sun, Yasheng, et al.
Published: (2025)
GestureHYDRA: Semantic Co-speech Gesture Synthesis via Hybrid Modality Diffusion Transformer and Cascaded-Synchronized Retrieval-Augmented Generation
by: Yang, Quanwei, et al.
Published: (2025)
by: Yang, Quanwei, et al.
Published: (2025)
AvatarBrush: Monocular Reconstruction of Gaussian Avatars with Intuitive Local Editing
by: Li, Mengtian, et al.
Published: (2025)
by: Li, Mengtian, et al.
Published: (2025)
GTAvatar: Bridging Gaussian Splatting and Texture Mapping for Relightable and Editable Gaussian Avatars
by: Kelian Baert, et al.
Published: (2026)
by: Kelian Baert, et al.
Published: (2026)
D-Rex : Diffusion Rendering for Relightable Expressive Avatars
by: Teufel, Timo, et al.
Published: (2026)
by: Teufel, Timo, et al.
Published: (2026)
SMPLX-Lite: A Realistic and Drivable Avatar Benchmark with Rich Geometry and Texture Annotations
by: Jiang, Yujiao, et al.
Published: (2024)
by: Jiang, Yujiao, et al.
Published: (2024)
Splatter-360: Generalizable 360$^{\circ}$ Gaussian Splatting for Wide-baseline Panoramic Images
by: Chen, Zheng, et al.
Published: (2024)
by: Chen, Zheng, et al.
Published: (2024)
Fast Texture Transfer for XR Avatars via Barycentric UV Conversion
by: Song, Hail, et al.
Published: (2025)
by: Song, Hail, et al.
Published: (2025)
Frequency‐Aware Facial Image Shadow Removal through Skin Color and Texture Learning
by: Ling Zhang, et al.
Published: (2024)
by: Ling Zhang, et al.
Published: (2024)
LDM: Large Tensorial SDF Model for Textured Mesh Generation
by: Xie, Rengan, et al.
Published: (2024)
by: Xie, Rengan, et al.
Published: (2024)
DISPLAY: Directable Human-Object Interaction Video Generation via Sparse Motion Guidance and Multi-Task Auxiliary
by: Guan, Jiazhi, et al.
Published: (2026)
by: Guan, Jiazhi, et al.
Published: (2026)
3D Gaussian Model for Animation and Texturing
by: Wang, Xiangzhi Eric, et al.
Published: (2024)
by: Wang, Xiangzhi Eric, et al.
Published: (2024)
GTAvatar: Bridging Gaussian Splatting and Texture Mapping for Relightable and Editable Gaussian Avatars
by: Baert, Kelian, et al.
Published: (2025)
by: Baert, Kelian, et al.
Published: (2025)
FACT-GS: Frequency-Aligned Complexity-Aware Texture Reparameterization for 2D Gaussian Splatting
by: Xie, Tianhao, et al.
Published: (2025)
by: Xie, Tianhao, et al.
Published: (2025)
Hyper Diffusion Avatars: Dynamic Human Avatar Generation using Network Weight Space Diffusion
by: Cao, Dongliang, et al.
Published: (2025)
by: Cao, Dongliang, et al.
Published: (2025)
From Architectural Sketch to Conceptual Representation: Using Structure-Aware Diffusion Model to Generate Renderings of School Buildings
by: Wang, Zhengyang, et al.
Published: (2025)
by: Wang, Zhengyang, et al.
Published: (2025)
HRM^2Avatar: High-Fidelity Real-Time Mobile Avatars from Monocular Phone Scans
by: Shi, Chao, et al.
Published: (2025)
by: Shi, Chao, et al.
Published: (2025)
VOODOO XP: Expressive One-Shot Head Reenactment for VR Telepresence
by: Tran, Phong, et al.
Published: (2024)
by: Tran, Phong, et al.
Published: (2024)
DynamicAvatars: Accurate Dynamic Facial Avatars Reconstruction and Precise Editing with Diffusion Models
by: Qian, Yangyang, et al.
Published: (2024)
by: Qian, Yangyang, et al.
Published: (2024)
Distinguishing Structures from Textures by Patch‐based Contrasts around Pixels for High‐quality and Efficient Texture filtering
by: Shengchun Wang, et al.
Published: (2024)
by: Shengchun Wang, et al.
Published: (2024)
Make-A-Texture: Fast Shape-Aware Texture Generation in 3 Seconds
by: Xiang, Xiaoyu, et al.
Published: (2024)
by: Xiang, Xiaoyu, et al.
Published: (2024)
Infusion: Internal Diffusion for Inpainting of Dynamic Textures and Complex Motion
by: N. Cherel, et al.
Published: (2025)
by: N. Cherel, et al.
Published: (2025)
Content-Aware Texturing for Gaussian Splatting
by: Papantonakis, Panagiotis, et al.
Published: (2025)
by: Papantonakis, Panagiotis, et al.
Published: (2025)
SplattingAvatar: Realistic Real-Time Human Avatars with Mesh-Embedded Gaussian Splatting
by: Shao, Zhijing, et al.
Published: (2024)
by: Shao, Zhijing, et al.
Published: (2024)
Textured Word-As-Image illustration
by: Farzaneh, Mohammad Javadian, et al.
Published: (2025)
by: Farzaneh, Mohammad Javadian, et al.
Published: (2025)
Controlling Avatar Diffusion with Learnable Gaussian Embedding
by: Gao, Xuan, et al.
Published: (2025)
by: Gao, Xuan, et al.
Published: (2025)
MeshGen: Generating PBR Textured Mesh with Render-Enhanced Auto-Encoder and Generative Data Augmentation
by: Chen, Zilong, et al.
Published: (2025)
by: Chen, Zilong, et al.
Published: (2025)
TextureDreamer: Image-guided Texture Synthesis through Geometry-aware Diffusion
by: Yeh, Yu-Ying, et al.
Published: (2024)
by: Yeh, Yu-Ying, et al.
Published: (2024)
CrystalNet: Texture‐Aware Neural Refraction Baking for Global Illumination
by: Z. Zhang, et al.
Published: (2024)
by: Z. Zhang, et al.
Published: (2024)
AniGaussian: Animatable Gaussian Avatar With Pose‐Guided Deformation
by: M. Li, et al.
Published: (2026)
by: M. Li, et al.
Published: (2026)
SIMART: Decomposing Monolithic Meshes into Sim-ready Articulated Assets via MLLM
by: Zhang, Chuanrui, et al.
Published: (2026)
by: Zhang, Chuanrui, et al.
Published: (2026)
SOAR: Self-Occluded Avatar Recovery from a Single Video In the Wild
by: Pan, Zhuoyang, et al.
Published: (2024)
by: Pan, Zhuoyang, et al.
Published: (2024)
Simplifying Textured Triangle Meshes in the Wild
by: Liu, Hsueh-Ti Derek, et al.
Published: (2024)
by: Liu, Hsueh-Ti Derek, et al.
Published: (2024)
Interactive Holographic Visualization for 3D Facial Avatar
by: Nguyen, Tri Tung Nguyen, et al.
Published: (2025)
by: Nguyen, Tri Tung Nguyen, et al.
Published: (2025)
Similar Items
-
AudCast: Audio-Driven Human Video Generation by Cascaded Diffusion Transformers
by: Guan, Jiazhi, et al.
Published: (2025) -
ReSyncer: Rewiring Style-based Generator for Unified Audio-Visually Synced Facial Performer
by: Guan, Jiazhi, et al.
Published: (2024) -
iDiT-HOI: Inpainting-based Hand Object Interaction Reenactment via Video Diffusion Transformer
by: Shen, Zhelun, et al.
Published: (2025) -
Re-HOLD: Video Hand Object Interaction Reenactment via adaptive Layout-instructed Diffusion Model
by: Fan, Yingying, et al.
Published: (2025) -
THGS: Lifelike Talking Human Avatar Synthesis From Monocular Video Via 3D Gaussian Splatting
by: Chuang Chen, et al.
Published: (2025)