SingingHead: A Large-scale 4D Dataset for Singing Head Animation
Fuente:
arXiv
Saved in:
| Main Authors: | Wu, Sijing, Li, Yunhao, Zhang, Weitian, Jia, Jun, Zhu, Yucheng, Yan, Yichao, Zhai, Guangtao, Yang, Xiaokang |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MMHead: Towards Fine-grained Multi-modal 3D Facial Animation
by: Wu, Sijing, et al.
Published: (2024)
by: Wu, Sijing, et al.
Published: (2024)
DHQA-4D: Perceptual Quality Assessment of Dynamic 4D Digital Human
by: Li, Yunhao, et al.
Published: (2025)
by: Li, Yunhao, et al.
Published: (2025)
A Comparative Study of Perceptual Quality Metrics for Audio-driven Talking Head Videos
by: Zhang, Weixia, et al.
Published: (2024)
by: Zhang, Weixia, et al.
Published: (2024)
SFQA: A Comprehensive Perceptual Quality Assessment Dataset for Singing Face Generation
by: Gao, Zhilin, et al.
Published: (2026)
by: Gao, Zhilin, et al.
Published: (2026)
Disentangled Clothed Avatar Generation with Layered Representation
by: Zhang, Weitian, et al.
Published: (2025)
by: Zhang, Weitian, et al.
Published: (2025)
Exploring Instruction Data Quality for Explainable Image Quality Assessment
by: Li, Yunhao, et al.
Published: (2025)
by: Li, Yunhao, et al.
Published: (2025)
FVQ: A Large-Scale Dataset and an LMM-based Method for Face Video Quality Assessment
by: Wu, Sijing, et al.
Published: (2025)
by: Wu, Sijing, et al.
Published: (2025)
AGHI-QA: A Subjective-Aligned Dataset and Metric for AI-Generated Human Images
by: Li, Yunhao, et al.
Published: (2025)
by: Li, Yunhao, et al.
Published: (2025)
MVBIND: Self-Supervised Music Recommendation For Videos Via Embedding Space Binding
by: Teng, Jiajie, et al.
Published: (2024)
by: Teng, Jiajie, et al.
Published: (2024)
VTONQA: A Multi-Dimensional Quality Assessment Dataset for Virtual Try-on
by: Wei, Xinyi, et al.
Published: (2026)
by: Wei, Xinyi, et al.
Published: (2026)
$E^{3}$Gen: Efficient, Expressive and Editable Avatars Generation
by: Zhang, Weitian, et al.
Published: (2024)
by: Zhang, Weitian, et al.
Published: (2024)
HeadStudio: Text to Animatable Head Avatars with 3D Gaussian Splatting
by: Zhou, Zhenglin, et al.
Published: (2024)
by: Zhou, Zhenglin, et al.
Published: (2024)
Topo4D: Topology-Preserving Gaussian Splatting for High-Fidelity 4D Head Capture
by: Li, Xuanchen, et al.
Published: (2024)
by: Li, Xuanchen, et al.
Published: (2024)
VideoAesBench: Benchmarking the Video Aesthetics Perception Capabilities of Large Multimodal Models
by: Li, Yunhao, et al.
Published: (2026)
by: Li, Yunhao, et al.
Published: (2026)
Q-Bench-Portrait: Benchmarking Multimodal Large Language Models on Portrait Image Quality Perception
by: Wu, Sijing, et al.
Published: (2026)
by: Wu, Sijing, et al.
Published: (2026)
Can Large Models Fool the Eye? A New Turing Test for Biological Animation
by: Chen, Zijian, et al.
Published: (2025)
by: Chen, Zijian, et al.
Published: (2025)
Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation
by: Huang, Zikai, et al.
Published: (2025)
by: Huang, Zikai, et al.
Published: (2025)
Surveillance Facial Image Quality Assessment: A Multi-dimensional Dataset and Lightweight Model
by: Jiang, Yanwei, et al.
Published: (2026)
by: Jiang, Yanwei, et al.
Published: (2026)
Stabilizing Diffusion Posterior Sampling by Noise--Frequency Continuation
by: Tian, Feng, et al.
Published: (2026)
by: Tian, Feng, et al.
Published: (2026)
SingingBot: An Avatar-Driven System for Robotic Face Singing Performance
by: Xu, Zhuoxiong, et al.
Published: (2026)
by: Xu, Zhuoxiong, et al.
Published: (2026)
HeadGaS: Real-Time Animatable Head Avatars via 3D Gaussian Splatting
by: Dhamo, Helisa, et al.
Published: (2023)
by: Dhamo, Helisa, et al.
Published: (2023)
3D Gaussian Blendshapes for Head Avatar Animation
by: Ma, Shengjie, et al.
Published: (2024)
by: Ma, Shengjie, et al.
Published: (2024)
Generalizable and Animatable Gaussian Head Avatar
by: Chu, Xuangeng, et al.
Published: (2024)
by: Chu, Xuangeng, et al.
Published: (2024)
LAM: Large Avatar Model for One-shot Animatable Gaussian Head
by: He, Yisheng, et al.
Published: (2025)
by: He, Yisheng, et al.
Published: (2025)
Monocular and Generalizable Gaussian Talking Head Animation
by: Gong, Shengjie, et al.
Published: (2025)
by: Gong, Shengjie, et al.
Published: (2025)
Video-Driven Animation of Neural Head Avatars
by: Paier, Wolfgang, et al.
Published: (2024)
by: Paier, Wolfgang, et al.
Published: (2024)
UniProcessor: A Text-induced Unified Low-level Image Processor
by: Duan, Huiyu, et al.
Published: (2024)
by: Duan, Huiyu, et al.
Published: (2024)
HTTM: Head-wise Temporal Token Merging for Faster VGGT
by: Wang, Weitian, et al.
Published: (2025)
by: Wang, Weitian, et al.
Published: (2025)
Task-Specific Normalization for Continual Learning of Blind Image Quality Models
by: Zhang, Weixia, et al.
Published: (2021)
by: Zhang, Weixia, et al.
Published: (2021)
RGC-VQA: An Exploration Database for Robotic-Generated Video Quality Assessment
by: Jin, Jianing, et al.
Published: (2025)
by: Jin, Jianing, et al.
Published: (2025)
ODI-Bench: Can MLLMs Understand Immersive Omnidirectional Environments?
by: Yang, Liu, et al.
Published: (2025)
by: Yang, Liu, et al.
Published: (2025)
OT-Talk: Animating 3D Talking Head with Optimal Transportation
by: Wang, Xinmu, et al.
Published: (2025)
by: Wang, Xinmu, et al.
Published: (2025)
SINGER: Vivid Audio-driven Singing Video Generation with Multi-scale Spectral Diffusion Model
by: Li, Yan, et al.
Published: (2024)
by: Li, Yan, et al.
Published: (2024)
ImHead: A Large-scale Implicit Morphable Model for Localized Head Modeling
by: Potamias, Rolandos Alexandros, et al.
Published: (2025)
by: Potamias, Rolandos Alexandros, et al.
Published: (2025)
AvatarMakeup: Realistic Makeup Transfer for 3D Animatable Head Avatars
by: Zhong, Yiming, et al.
Published: (2025)
by: Zhong, Yiming, et al.
Published: (2025)
ARTalk: Speech-Driven 3D Head Animation via Autoregressive Model
by: Chu, Xuangeng, et al.
Published: (2025)
by: Chu, Xuangeng, et al.
Published: (2025)
AniSDF: Fused-Granularity Neural Surfaces with Anisotropic Encoding for High-Fidelity 3D Reconstruction
by: Gao, Jingnan, et al.
Published: (2024)
by: Gao, Jingnan, et al.
Published: (2024)
Avat3r: Large Animatable Gaussian Reconstruction Model for High-fidelity 3D Head Avatars
by: Kirschstein, Tobias, et al.
Published: (2025)
by: Kirschstein, Tobias, et al.
Published: (2025)
Who is a Better Talker: Subjective and Objective Quality Assessment for AI-Generated Talking Heads
by: Zhou, Yingjie, et al.
Published: (2025)
by: Zhou, Yingjie, et al.
Published: (2025)
FAGhead: Fully Animate Gaussian Head from Monocular Videos
by: Xuan, Yixin, et al.
Published: (2024)
by: Xuan, Yixin, et al.
Published: (2024)
Similar Items
-
MMHead: Towards Fine-grained Multi-modal 3D Facial Animation
by: Wu, Sijing, et al.
Published: (2024) -
DHQA-4D: Perceptual Quality Assessment of Dynamic 4D Digital Human
by: Li, Yunhao, et al.
Published: (2025) -
A Comparative Study of Perceptual Quality Metrics for Audio-driven Talking Head Videos
by: Zhang, Weixia, et al.
Published: (2024) -
SFQA: A Comprehensive Perceptual Quality Assessment Dataset for Singing Face Generation
by: Gao, Zhilin, et al.
Published: (2026) -
Disentangled Clothed Avatar Generation with Layered Representation
by: Zhang, Weitian, et al.
Published: (2025)