EvalTalker: Learning to Evaluate Real-Portrait-Driven Multi-Subject Talking Humans
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhou, Yingjie, Zhu, Xilei, Ren, Siyu, Zhao, Ziyi, Wang, Ziwen, Wen, Farong, Zhou, Yu, Cao, Jiezhang, Min, Xiongkuo, Chen, Fengjiao, Li, Xiaoyu, Cao, Xuezhi, Zhai, Guangtao, Liu, Xiaohong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Who is a Better Talker: Subjective and Objective Quality Assessment for AI-Generated Talking Heads
par: Zhou, Yingjie, et autres
Publié: (2025)
par: Zhou, Yingjie, et autres
Publié: (2025)
MEMO-Bench: A Multiple Benchmark for Text-to-Image and Multimodal Large Language Models on Human Emotion Analysis
par: Zhou, Yingjie, et autres
Publié: (2024)
par: Zhou, Yingjie, et autres
Publié: (2024)
Q-Agent: Quality-Driven Chain-of-Thought Image Restoration Agent through Robust Multimodal Large Language Model
par: Zhou, Yingjie, et autres
Publié: (2025)
par: Zhou, Yingjie, et autres
Publié: (2025)
Who is a Better Player: LLM against LLM
par: Zhou, Yingjie, et autres
Publié: (2025)
par: Zhou, Yingjie, et autres
Publié: (2025)
3DGCQA: A Quality Assessment Database for 3D AI-Generated Contents
par: Zhou, Yingjie, et autres
Publié: (2024)
par: Zhou, Yingjie, et autres
Publié: (2024)
Efficient One-Step Diffusion Restoration Model with Compact Token Compression and Linear Attention
par: Qiao, Bingtian, et autres
Publié: (2026)
par: Qiao, Bingtian, et autres
Publié: (2026)
THQA: A Perceptual Quality Assessment Database for Talking Heads
par: Zhou, Yingjie, et autres
Publié: (2024)
par: Zhou, Yingjie, et autres
Publié: (2024)
Q-Eval-100K: Evaluating Visual Quality and Alignment Level for Text-to-Vision Content
par: Zhang, Zicheng, et autres
Publié: (2025)
par: Zhang, Zicheng, et autres
Publié: (2025)
Q-REAL: Towards Realism and Plausibility Evaluation for AI-Generated Content
par: Wang, Shushi, et autres
Publié: (2025)
par: Wang, Shushi, et autres
Publié: (2025)
Resolution-Agnostic Neural Compression for High-Fidelity Portrait Video Conferencing via Implicit Radiance Fields
par: Li, Yifei, et autres
Publié: (2024)
par: Li, Yifei, et autres
Publié: (2024)
Dual-Branch Network for Portrait Image Quality Assessment
par: Sun, Wei, et autres
Publié: (2024)
par: Sun, Wei, et autres
Publié: (2024)
Q-Bench-Portrait: Benchmarking Multimodal Large Language Models on Portrait Image Quality Perception
par: Wu, Sijing, et autres
Publié: (2026)
par: Wu, Sijing, et autres
Publié: (2026)
ESIQA: Perceptual Quality Assessment of Vision-Pro-based Egocentric Spatial Images
par: Zhu, Xilei, et autres
Publié: (2024)
par: Zhu, Xilei, et autres
Publié: (2024)
Exploring Rich Subjective Quality Information for Image Quality Assessment in the Wild
par: Min, Xiongkuo, et autres
Publié: (2024)
par: Min, Xiongkuo, et autres
Publié: (2024)
Subjective-Aligned Dataset and Metric for Text-to-Video Quality Assessment
par: Kou, Tengchuan, et autres
Publié: (2024)
par: Kou, Tengchuan, et autres
Publié: (2024)
HazeCLIP: Towards Language Guided Real-World Image Dehazing
par: Wang, Ruiyi, et autres
Publié: (2024)
par: Wang, Ruiyi, et autres
Publié: (2024)
DynT2I-Eval: A Dynamic Evaluation Framework for Text-to-Image Models
par: Wang, Juntong, et autres
Publié: (2026)
par: Wang, Juntong, et autres
Publié: (2026)
AGAV-Rater: Adapting Large Multimodal Model for AI-Generated Audio-Visual Quality Assessment
par: Cao, Yuqin, et autres
Publié: (2025)
par: Cao, Yuqin, et autres
Publié: (2025)
Audio-Visual Quality Assessment for User Generated Content: Database and Method
par: Cao, Yuqin, et autres
Publié: (2023)
par: Cao, Yuqin, et autres
Publié: (2023)
Exploring Image Quality Assessment from a New Perspective: Pupil Size
par: Gao, Yixuan, et autres
Publié: (2025)
par: Gao, Yixuan, et autres
Publié: (2025)
GLARE: Low Light Image Enhancement via Generative Latent Feature based Codebook Retrieval
par: Zhou, Han, et autres
Publié: (2024)
par: Zhou, Han, et autres
Publié: (2024)
Real3D-Portrait: One-shot Realistic 3D Talking Portrait Synthesis
par: Ye, Zhenhui, et autres
Publié: (2024)
par: Ye, Zhenhui, et autres
Publié: (2024)
UniHetero: Could Generation Enhance Understanding for Vision-Language-Model at Large Data Scale?
par: Chen, Fengjiao, et autres
Publié: (2025)
par: Chen, Fengjiao, et autres
Publié: (2025)
ESVQA: Perceptual Quality Assessment of Egocentric Spatial Videos
par: Zhu, Xilei, et autres
Publié: (2024)
par: Zhu, Xilei, et autres
Publié: (2024)
Quality Assessment in the Era of Large Models: A Survey
par: Zhang, Zicheng, et autres
Publié: (2024)
par: Zhang, Zicheng, et autres
Publié: (2024)
LMM-PCQA: Assisting Point Cloud Quality Assessment with LMM
par: Zhang, Zicheng, et autres
Publié: (2024)
par: Zhang, Zicheng, et autres
Publié: (2024)
A-Bench: Are LMMs Masters at Evaluating AI-generated Images?
par: Zhang, Zicheng, et autres
Publié: (2024)
par: Zhang, Zicheng, et autres
Publié: (2024)
fMRI Exploration of Visual Quality Assessment
par: Zhang, Yiming, et autres
Publié: (2024)
par: Zhang, Yiming, et autres
Publié: (2024)
TDVE-Assessor: Benchmarking and Evaluating the Quality of Text-Driven Video Editing with LMMs
par: Wang, Juntong, et autres
Publié: (2025)
par: Wang, Juntong, et autres
Publié: (2025)
IllusionBench+: A Large-scale and Comprehensive Benchmark for Visual Illusion Understanding in Vision-Language Models
par: Zhang, Yiming, et autres
Publié: (2025)
par: Zhang, Yiming, et autres
Publié: (2025)
UNO-Bench: A Unified Benchmark for Exploring the Compositional Law Between Uni-modal and Omni-modal in Omni Models
par: Chen, Chen, et autres
Publié: (2025)
par: Chen, Chen, et autres
Publié: (2025)
AsymTalker: Identity-Consistent Long-Term Talking Head Generation via Asymmetric Distillation
par: Lu, Yuxin, et autres
Publié: (2026)
par: Lu, Yuxin, et autres
Publié: (2026)
How Does Audio Influence Visual Attention in Omnidirectional Videos? Database and Model
par: Zhu, Yuxin, et autres
Publié: (2024)
par: Zhu, Yuxin, et autres
Publié: (2024)
Quality-guided Skin Tone Enhancement for Portrait Photography
par: Gao, Shiqi, et autres
Publié: (2024)
par: Gao, Shiqi, et autres
Publié: (2024)
Adapter Shield: A Unified Framework with Built-in Authentication for Preventing Unauthorized Zero-Shot Image-to-Image Generation
par: Jia, Jun, et autres
Publié: (2025)
par: Jia, Jun, et autres
Publié: (2025)
DLADiff: A Dual-Layer Defense Framework against Fine-Tuning and Zero-Shot Customization of Diffusion Models
par: Jia, Jun, et autres
Publié: (2025)
par: Jia, Jun, et autres
Publié: (2025)
LifeEval: A Multimodal Benchmark for Assistive AI in Egocentric Daily Life Tasks
par: Gao, Hengjian, et autres
Publié: (2026)
par: Gao, Hengjian, et autres
Publié: (2026)
UNQA: Unified No-Reference Quality Assessment for Audio, Image, Video, and Audio-Visual Content
par: Cao, Yuqin, et autres
Publié: (2024)
par: Cao, Yuqin, et autres
Publié: (2024)
Mitigating Low-Level Visual Hallucinations Requires Self-Awareness: Database, Model and Training Strategy
par: Sun, Yinan, et autres
Publié: (2025)
par: Sun, Yinan, et autres
Publié: (2025)
AIGIQA-20K: A Large Database for AI-Generated Image Quality Assessment
par: Li, Chunyi, et autres
Publié: (2024)
par: Li, Chunyi, et autres
Publié: (2024)
Documents similaires
-
Who is a Better Talker: Subjective and Objective Quality Assessment for AI-Generated Talking Heads
par: Zhou, Yingjie, et autres
Publié: (2025) -
MEMO-Bench: A Multiple Benchmark for Text-to-Image and Multimodal Large Language Models on Human Emotion Analysis
par: Zhou, Yingjie, et autres
Publié: (2024) -
Q-Agent: Quality-Driven Chain-of-Thought Image Restoration Agent through Robust Multimodal Large Language Model
par: Zhou, Yingjie, et autres
Publié: (2025) -
Who is a Better Player: LLM against LLM
par: Zhou, Yingjie, et autres
Publié: (2025) -
3DGCQA: A Quality Assessment Database for 3D AI-Generated Contents
par: Zhou, Yingjie, et autres
Publié: (2024)