A Comparative Study of Perceptual Quality Metrics for Audio-driven Talking Head Videos
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Weixia, Zhu, Chengguang, Gao, Jingnan, Yan, Yichao, Zhai, Guangtao, Yang, Xiaokang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Task-Specific Normalization for Continual Learning of Blind Image Quality Models
por: Zhang, Weixia, et al.
Publicado: (2021)
por: Zhang, Weixia, et al.
Publicado: (2021)
When No-Reference Image Quality Models Meet MAP Estimation in Diffusion Latents
por: Zhang, Weixia, et al.
Publicado: (2024)
por: Zhang, Weixia, et al.
Publicado: (2024)
THQA: A Perceptual Quality Assessment Database for Talking Heads
por: Zhou, Yingjie, et al.
Publicado: (2024)
por: Zhou, Yingjie, et al.
Publicado: (2024)
SingingHead: A Large-scale 4D Dataset for Singing Head Animation
por: Wu, Sijing, et al.
Publicado: (2023)
por: Wu, Sijing, et al.
Publicado: (2023)
AniSDF: Fused-Granularity Neural Surfaces with Anisotropic Encoding for High-Fidelity 3D Reconstruction
por: Gao, Jingnan, et al.
Publicado: (2024)
por: Gao, Jingnan, et al.
Publicado: (2024)
Multi-times Monte Carlo Rendering for Inter-reflection Reconstruction
por: Zhu, Tengjie, et al.
Publicado: (2024)
por: Zhu, Tengjie, et al.
Publicado: (2024)
ESVQA: Perceptual Quality Assessment of Egocentric Spatial Videos
por: Zhu, Xilei, et al.
Publicado: (2024)
por: Zhu, Xilei, et al.
Publicado: (2024)
Perceptual Video Quality Assessment: A Survey
por: Min, Xiongkuo, et al.
Publicado: (2024)
por: Min, Xiongkuo, et al.
Publicado: (2024)
AIGV-Assessor: Benchmarking and Evaluating the Perceptual Quality of Text-to-Video Generation with LMM
por: Wang, Jiarui, et al.
Publicado: (2024)
por: Wang, Jiarui, et al.
Publicado: (2024)
VQAThinker: Exploring Generalizable and Explainable Video Quality Assessment via Reinforcement Learning
por: Cao, Linhan, et al.
Publicado: (2025)
por: Cao, Linhan, et al.
Publicado: (2025)
Scaling-up Perceptual Video Quality Assessment
por: Jia, Ziheng, et al.
Publicado: (2025)
por: Jia, Ziheng, et al.
Publicado: (2025)
Directional Texture Editing for 3D Models
por: Liu, Shengqi, et al.
Publicado: (2023)
por: Liu, Shengqi, et al.
Publicado: (2023)
DHQA-4D: Perceptual Quality Assessment of Dynamic 4D Digital Human
por: Li, Yunhao, et al.
Publicado: (2025)
por: Li, Yunhao, et al.
Publicado: (2025)
InfiniteTalk: Audio-driven Video Generation for Sparse-Frame Video Dubbing
por: Yang, Shaoshu, et al.
Publicado: (2025)
por: Yang, Shaoshu, et al.
Publicado: (2025)
Audio-driven High-resolution Seamless Talking Head Video Editing via StyleGAN
por: Su, Jiacheng, et al.
Publicado: (2024)
por: Su, Jiacheng, et al.
Publicado: (2024)
ESIQA: Perceptual Quality Assessment of Vision-Pro-based Egocentric Spatial Images
por: Zhu, Xilei, et al.
Publicado: (2024)
por: Zhu, Xilei, et al.
Publicado: (2024)
Efficient Face Image Quality Assessment via Self-training and Knowledge Distillation
por: Sun, Wei, et al.
Publicado: (2025)
por: Sun, Wei, et al.
Publicado: (2025)
Subjective-Aligned Dataset and Metric for Text-to-Video Quality Assessment
por: Kou, Tengchuan, et al.
Publicado: (2024)
por: Kou, Tengchuan, et al.
Publicado: (2024)
Dimitra: Audio-driven Diffusion model for Expressive Talking Head Generation
por: Chopin, Baptiste, et al.
Publicado: (2025)
por: Chopin, Baptiste, et al.
Publicado: (2025)
EvaSurf: Efficient View-Aware Implicit Textured Surface Reconstruction
por: Gao, Jingnan, et al.
Publicado: (2023)
por: Gao, Jingnan, et al.
Publicado: (2023)
QualiRAG: Retrieval-Augmented Generation for Visual Quality Understanding
por: Cao, Linhan, et al.
Publicado: (2026)
por: Cao, Linhan, et al.
Publicado: (2026)
POLAR: A Portrait OLAT Dataset and Generative Framework for Illumination-Aware Face Modeling
por: Chen, Zhuo, et al.
Publicado: (2025)
por: Chen, Zhuo, et al.
Publicado: (2025)
Who is a Better Talker: Subjective and Objective Quality Assessment for AI-Generated Talking Heads
por: Zhou, Yingjie, et al.
Publicado: (2025)
por: Zhou, Yingjie, et al.
Publicado: (2025)
GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
por: Agarwal, Madhav, et al.
Publicado: (2025)
por: Agarwal, Madhav, et al.
Publicado: (2025)
Perceptually Accurate 3D Talking Head Generation: New Definitions, Speech-Mesh Representation, and Evaluation Metrics
por: Chae-Yeon, Lee, et al.
Publicado: (2025)
por: Chae-Yeon, Lee, et al.
Publicado: (2025)
How Does Audio Influence Visual Attention in Omnidirectional Videos? Database and Model
por: Zhu, Yuxin, et al.
Publicado: (2024)
por: Zhu, Yuxin, et al.
Publicado: (2024)
A Coding Framework and Benchmark towards Low-Bitrate Video Understanding
por: Tian, Yuan, et al.
Publicado: (2022)
por: Tian, Yuan, et al.
Publicado: (2022)
TalkVid: A Large-Scale Diversified Dataset for Audio-Driven Talking Head Synthesis
por: Chen, Shunian, et al.
Publicado: (2025)
por: Chen, Shunian, et al.
Publicado: (2025)
Perceptual Visual Quality Assessment: Principles, Methods, and Future Directions
por: Zhou, Wei, et al.
Publicado: (2025)
por: Zhou, Wei, et al.
Publicado: (2025)
EmotiveTalk: Expressive Talking Head Generation through Audio Information Decoupling and Emotional Video Diffusion
por: Wang, Haotian, et al.
Publicado: (2024)
por: Wang, Haotian, et al.
Publicado: (2024)
AIGCOIQA2024: Perceptual Quality Assessment of AI Generated Omnidirectional Images
por: Yang, Liu, et al.
Publicado: (2024)
por: Yang, Liu, et al.
Publicado: (2024)
Low-Light Image Enhancement via Generative Perceptual Priors
por: Zhou, Han, et al.
Publicado: (2024)
por: Zhou, Han, et al.
Publicado: (2024)
Audio-Visual Driven Compression for Low-Bitrate Talking Head Videos
por: Takahashi, Riku, et al.
Publicado: (2025)
por: Takahashi, Riku, et al.
Publicado: (2025)
Learning Dynamic Tetrahedra for High-Quality Talking Head Synthesis
por: Zhang, Zicheng, et al.
Publicado: (2024)
por: Zhang, Zicheng, et al.
Publicado: (2024)
Engagement Prediction of Short Videos with Large Multimodal Models
por: Sun, Wei, et al.
Publicado: (2025)
por: Sun, Wei, et al.
Publicado: (2025)
Exploiting Temporal Audio-Visual Correlation Embedding for Audio-Driven One-Shot Talking Head Animation
por: Xu, Zhihua, et al.
Publicado: (2025)
por: Xu, Zhihua, et al.
Publicado: (2025)
DPC-VQA: Decoupling Quality Perception and Residual Calibration for Video Quality Assessment
por: Li, Xinyue, et al.
Publicado: (2026)
por: Li, Xinyue, et al.
Publicado: (2026)
Generalizable Video Quality Assessment via Weak-to-Strong Learning
por: Cao, Linhan, et al.
Publicado: (2025)
por: Cao, Linhan, et al.
Publicado: (2025)
Mask-Free Audio-driven Talking Face Generation for Enhanced Visual Quality and Identity Preservation
por: Yaman, Dogucan, et al.
Publicado: (2025)
por: Yaman, Dogucan, et al.
Publicado: (2025)
READ: Real-time and Efficient Asynchronous Diffusion for Audio-driven Talking Head Generation
por: Wang, Haotian, et al.
Publicado: (2025)
por: Wang, Haotian, et al.
Publicado: (2025)
Ejemplares similares
-
Task-Specific Normalization for Continual Learning of Blind Image Quality Models
por: Zhang, Weixia, et al.
Publicado: (2021) -
When No-Reference Image Quality Models Meet MAP Estimation in Diffusion Latents
por: Zhang, Weixia, et al.
Publicado: (2024) -
THQA: A Perceptual Quality Assessment Database for Talking Heads
por: Zhou, Yingjie, et al.
Publicado: (2024) -
SingingHead: A Large-scale 4D Dataset for Singing Head Animation
por: Wu, Sijing, et al.
Publicado: (2023) -
AniSDF: Fused-Granularity Neural Surfaces with Anisotropic Encoding for High-Fidelity 3D Reconstruction
por: Gao, Jingnan, et al.
Publicado: (2024)