InsTaG: Learning Personalized 3D Talking Head from Few-Second Video
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Jiahe, Zhang, Jiawei, Bai, Xiao, Zheng, Jin, Zhou, Jun, Gu, Lin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TalkingGaussian: Structure-Persistent 3D Talking Head Synthesis via Gaussian Splatting
por: Li, Jiahe, et al.
Publicado: (2024)
por: Li, Jiahe, et al.
Publicado: (2024)
EmoTaG: Emotion-Aware Talking Head Synthesis on Gaussian Splatting with Few-Shot Personalization
por: Xu, Haolan, et al.
Publicado: (2026)
por: Xu, Haolan, et al.
Publicado: (2026)
DNGaussian: Optimizing Sparse-View 3D Gaussian Radiance Fields with Global-Local Depth Normalization
por: Li, Jiahe, et al.
Publicado: (2024)
por: Li, Jiahe, et al.
Publicado: (2024)
CoR-GS: Sparse-View 3D Gaussian Splatting via Co-Regularization
por: Zhang, Jiawei, et al.
Publicado: (2024)
por: Zhang, Jiawei, et al.
Publicado: (2024)
SparseSurf: Sparse-View 3D Gaussian Splatting for Surface Reconstruction
por: Gu, Meiying, et al.
Publicado: (2025)
por: Gu, Meiying, et al.
Publicado: (2025)
IM-Portrait: Learning 3D-aware Video Diffusion for Photorealistic Talking Heads from Monocular Videos
por: Li, Yuan, et al.
Publicado: (2025)
por: Li, Yuan, et al.
Publicado: (2025)
OT-Talk: Animating 3D Talking Head with Optimal Transportation
por: Wang, Xinmu, et al.
Publicado: (2025)
por: Wang, Xinmu, et al.
Publicado: (2025)
Few-Shot Identity Adaptation for 3D Talking Heads via Global Gaussian Field
por: Nie, Hong, et al.
Publicado: (2025)
por: Nie, Hong, et al.
Publicado: (2025)
GeoSVR: Taming Sparse Voxels for Geometrically Accurate Surface Reconstruction
por: Li, Jiahe, et al.
Publicado: (2025)
por: Li, Jiahe, et al.
Publicado: (2025)
Robust Synthetic-to-Real Transfer for Stereo Matching
por: Zhang, Jiawei, et al.
Publicado: (2024)
por: Zhang, Jiawei, et al.
Publicado: (2024)
Revisiting Photometric Ambiguity for Accurate Gaussian-Splatting Surface Reconstruction
por: Li, Jiahe, et al.
Publicado: (2026)
por: Li, Jiahe, et al.
Publicado: (2026)
EmoDiffTalk:Emotion-aware Diffusion for Editable 3D Gaussian Talking Head
por: Liu, Chang, et al.
Publicado: (2025)
por: Liu, Chang, et al.
Publicado: (2025)
D^3-Talker: Dual-Branch Decoupled Deformation Fields for Few-Shot 3D Talking Head Synthesis
por: Guo, Yuhang, et al.
Publicado: (2025)
por: Guo, Yuhang, et al.
Publicado: (2025)
MultiTalk: Enhancing 3D Talking Head Generation Across Languages with Multilingual Video Dataset
por: Sung-Bin, Kim, et al.
Publicado: (2024)
por: Sung-Bin, Kim, et al.
Publicado: (2024)
FreeTalk: Emotional Topology-Free 3D Talking Heads
por: Nocentini, Federico, et al.
Publicado: (2026)
por: Nocentini, Federico, et al.
Publicado: (2026)
ScanTalk: 3D Talking Heads from Unregistered Scans
por: Nocentini, Federico, et al.
Publicado: (2024)
por: Nocentini, Federico, et al.
Publicado: (2024)
GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
por: Agarwal, Madhav, et al.
Publicado: (2025)
por: Agarwal, Madhav, et al.
Publicado: (2025)
Audio-visual Controlled Video Diffusion with Masked Selective State Spaces Modeling for Natural Talking Head Generation
por: Hong, Fa-Ting, et al.
Publicado: (2025)
por: Hong, Fa-Ting, et al.
Publicado: (2025)
DualTalk: Dual-Speaker Interaction for 3D Talking Head Conversations
por: Peng, Ziqiao, et al.
Publicado: (2025)
por: Peng, Ziqiao, et al.
Publicado: (2025)
Towards Native Generative Model for 3D Head Avatar
por: Zhuang, Yiyu, et al.
Publicado: (2024)
por: Zhuang, Yiyu, et al.
Publicado: (2024)
EmoTalk3D: High-Fidelity Free-View Synthesis of Emotional 3D Talking Head
por: He, Qianyun, et al.
Publicado: (2024)
por: He, Qianyun, et al.
Publicado: (2024)
SyncTalk: The Devil is in the Synchronization for Talking Head Synthesis
por: Peng, Ziqiao, et al.
Publicado: (2023)
por: Peng, Ziqiao, et al.
Publicado: (2023)
Learning Online Scale Transformation for Talking Head Video Generation
por: Hong, Fa-Ting, et al.
Publicado: (2024)
por: Hong, Fa-Ting, et al.
Publicado: (2024)
Learn2Talk: 3D Talking Face Learns from 2D Talking Face
por: Zhuang, Yixiang, et al.
Publicado: (2024)
por: Zhuang, Yixiang, et al.
Publicado: (2024)
THEval. Evaluation Framework for Talking Head Video Generation
por: Quignon, Nabyl, et al.
Publicado: (2025)
por: Quignon, Nabyl, et al.
Publicado: (2025)
PTalker: Personalized Speech-Driven 3D Talking Head Animation via Style Disentanglement and Modality Alignment
por: Wang, Bin, et al.
Publicado: (2025)
por: Wang, Bin, et al.
Publicado: (2025)
HeadGAP: Few-Shot 3D Head Avatar via Generalizable Gaussian Priors
por: Zheng, Xiaozheng, et al.
Publicado: (2024)
por: Zheng, Xiaozheng, et al.
Publicado: (2024)
Bidirectional Learned Facial Animation Codec for Low Bitrate Talking Head Videos
por: Takahashi, Riku, et al.
Publicado: (2025)
por: Takahashi, Riku, et al.
Publicado: (2025)
Efficient and Robust Video Defense Framework against 3D-field Personalized Talking Face
por: Sun, Rui-qing, et al.
Publicado: (2025)
por: Sun, Rui-qing, et al.
Publicado: (2025)
TalkingHeadBench: A Multi-Modal Benchmark & Analysis of Talking-Head DeepFake Detection
por: Xiong, Xinqi, et al.
Publicado: (2025)
por: Xiong, Xinqi, et al.
Publicado: (2025)
CapTalk: Text-Guided Stylization and Speech-Driven 3D Head Animation
por: Chu, Xuangeng, et al.
Publicado: (2026)
por: Chu, Xuangeng, et al.
Publicado: (2026)
Avatar Fingerprinting for Authorized Use of Synthetic Talking-Head Videos
por: Prashnani, Ekta, et al.
Publicado: (2023)
por: Prashnani, Ekta, et al.
Publicado: (2023)
DipGuava: Disentangling Personalized Gaussian Features for 3D Head Avatars from Monocular Video
por: Lee, Jeonghaeng, et al.
Publicado: (2026)
por: Lee, Jeonghaeng, et al.
Publicado: (2026)
Jump Cut Smoothing for Talking Heads
por: Wang, Xiaojuan, et al.
Publicado: (2024)
por: Wang, Xiaojuan, et al.
Publicado: (2024)
Talk3D: High-Fidelity Talking Portrait Synthesis via Personalized 3D Generative Prior
por: Ko, Jaehoon, et al.
Publicado: (2024)
por: Ko, Jaehoon, et al.
Publicado: (2024)
Ins-HOI: Instance Aware Human-Object Interactions Recovery
por: Zhang, Jiajun, et al.
Publicado: (2023)
por: Zhang, Jiajun, et al.
Publicado: (2023)
Audio-Visual Driven Compression for Low-Bitrate Talking Head Videos
por: Takahashi, Riku, et al.
Publicado: (2025)
por: Takahashi, Riku, et al.
Publicado: (2025)
EmoVOCA: Speech-Driven Emotional 3D Talking Heads
por: Nocentini, Federico, et al.
Publicado: (2024)
por: Nocentini, Federico, et al.
Publicado: (2024)
EmotiveTalk: Expressive Talking Head Generation through Audio Information Decoupling and Emotional Video Diffusion
por: Wang, Haotian, et al.
Publicado: (2024)
por: Wang, Haotian, et al.
Publicado: (2024)
DAWN: Dynamic Frame Avatar with Non-autoregressive Diffusion Framework for Talking Head Video Generation
por: Cheng, Hanbo, et al.
Publicado: (2024)
por: Cheng, Hanbo, et al.
Publicado: (2024)
Ejemplares similares
-
TalkingGaussian: Structure-Persistent 3D Talking Head Synthesis via Gaussian Splatting
por: Li, Jiahe, et al.
Publicado: (2024) -
EmoTaG: Emotion-Aware Talking Head Synthesis on Gaussian Splatting with Few-Shot Personalization
por: Xu, Haolan, et al.
Publicado: (2026) -
DNGaussian: Optimizing Sparse-View 3D Gaussian Radiance Fields with Global-Local Depth Normalization
por: Li, Jiahe, et al.
Publicado: (2024) -
CoR-GS: Sparse-View 3D Gaussian Splatting via Co-Regularization
por: Zhang, Jiawei, et al.
Publicado: (2024) -
SparseSurf: Sparse-View 3D Gaussian Splatting for Surface Reconstruction
por: Gu, Meiying, et al.
Publicado: (2025)