Face-Human-Bench: A Comprehensive Benchmark of Face and Human Understanding for Multi-modal Assistants
Fuente:
arXiv
Guardado en:
| Autores principales: | Qin, Lixiong, Ou, Shilong, Zhang, Miaoxuan, Wei, Jiangning, Zhang, Yuhang, Song, Xiaoshuai, Liu, Yuchen, Wang, Mei, Xu, Weiran |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Faceptor: A Generalist Model for Face Perception
por: Qin, Lixiong, et al.
Publicado: (2024)
por: Qin, Lixiong, et al.
Publicado: (2024)
FaceScore: Benchmarking and Enhancing Face Quality in Human Generation
por: Liao, Zhenyi, et al.
Publicado: (2024)
por: Liao, Zhenyi, et al.
Publicado: (2024)
F-Bench: Rethinking Human Preference Evaluation Metrics for Benchmarking Face Generation, Customization, and Restoration
por: Liu, Lu, et al.
Publicado: (2024)
por: Liu, Lu, et al.
Publicado: (2024)
FlashFace: Human Image Personalization with High-fidelity Identity Preservation
por: Zhang, Shilong, et al.
Publicado: (2024)
por: Zhang, Shilong, et al.
Publicado: (2024)
Towards the Detection of AI-Synthesized Human Face Images
por: Lu, Yuhang, et al.
Publicado: (2024)
por: Lu, Yuhang, et al.
Publicado: (2024)
Fake-in-Facext: Towards Fine-Grained Explainable DeepFake Analysis
por: Qin, Lixiong, et al.
Publicado: (2025)
por: Qin, Lixiong, et al.
Publicado: (2025)
MuirBench: A Comprehensive Benchmark for Robust Multi-image Understanding
por: Wang, Fei, et al.
Publicado: (2024)
por: Wang, Fei, et al.
Publicado: (2024)
DiffusionFace: Towards a Comprehensive Dataset for Diffusion-Based Face Forgery Analysis
por: Chen, Zhongxi, et al.
Publicado: (2024)
por: Chen, Zhongxi, et al.
Publicado: (2024)
FaceBench: A Multi-View Multi-Level Facial Attribute VQA Dataset for Benchmarking Face Perception MLLMs
por: Wang, Xiaoqin, et al.
Publicado: (2025)
por: Wang, Xiaoqin, et al.
Publicado: (2025)
M$^3$Face: A Unified Multi-Modal Multilingual Framework for Human Face Generation and Editing
por: Mofayezi, Mohammadreza, et al.
Publicado: (2024)
por: Mofayezi, Mohammadreza, et al.
Publicado: (2024)
EmbodiedBench: Comprehensive Benchmarking Multi-modal Large Language Models for Vision-Driven Embodied Agents
por: Yang, Rui, et al.
Publicado: (2025)
por: Yang, Rui, et al.
Publicado: (2025)
Controllable Biophysical Human Faces
por: Minghao Liu, et al.
Publicado: (2025)
por: Minghao Liu, et al.
Publicado: (2025)
HumanAgencyBench: Scalable Evaluation of Human Agency Support in AI Assistants
por: Sturgeon, Benjamin, et al.
Publicado: (2025)
por: Sturgeon, Benjamin, et al.
Publicado: (2025)
Multi-Modal Explainable Medical AI Assistant for Trustworthy Human-AI Collaboration
por: Yang, Honglong, et al.
Publicado: (2025)
por: Yang, Honglong, et al.
Publicado: (2025)
LaTo: Landmark-tokenized Diffusion Transformer for Fine-grained Human Face Editing
por: Zhang, Zhenghao, et al.
Publicado: (2025)
por: Zhang, Zhenghao, et al.
Publicado: (2025)
MVBench: A Comprehensive Multi-modal Video Understanding Benchmark
por: Li, Kunchang, et al.
Publicado: (2023)
por: Li, Kunchang, et al.
Publicado: (2023)
Human Bias in the Face of AI: Examining Human Judgment Against Text Labeled as AI Generated
por: Zhu, Tiffany, et al.
Publicado: (2024)
por: Zhu, Tiffany, et al.
Publicado: (2024)
HumanVideo-MME: Benchmarking MLLMs for Human-Centric Video Understanding
por: Cai, Yuxuan, et al.
Publicado: (2025)
por: Cai, Yuxuan, et al.
Publicado: (2025)
Collaborative Face Experts Fusion in Video Generation: Boosting Identity Consistency Across Large Face Poses
por: Wang, Yuji, et al.
Publicado: (2025)
por: Wang, Yuji, et al.
Publicado: (2025)
Subjective Face Transform using Human First Impressions
por: Roygaga, Chaitanya, et al.
Publicado: (2023)
por: Roygaga, Chaitanya, et al.
Publicado: (2023)
Fast Text-to-3D-Aware Face Generation and Manipulation via Direct Cross-modal Mapping and Geometric Regularization
por: Zhang, Jinlu, et al.
Publicado: (2024)
por: Zhang, Jinlu, et al.
Publicado: (2024)
Towards A Comprehensive Visual Saliency Explanation Framework for AI-based Face Recognition Systems
por: Lu, Yuhang, et al.
Publicado: (2024)
por: Lu, Yuhang, et al.
Publicado: (2024)
LongInsightBench: A Comprehensive Benchmark for Evaluating Omni-Modal Models on Human-Centric Long-Video Understanding
por: Han, ZhaoYang, et al.
Publicado: (2025)
por: Han, ZhaoYang, et al.
Publicado: (2025)
Arc2Face: A Foundation Model for ID-Consistent Human Faces
por: Papantoniou, Foivos Paraperas, et al.
Publicado: (2024)
por: Papantoniou, Foivos Paraperas, et al.
Publicado: (2024)
We-Math: Does Your Large Multimodal Model Achieve Human-like Mathematical Reasoning?
por: Qiao, Runqi, et al.
Publicado: (2024)
por: Qiao, Runqi, et al.
Publicado: (2024)
A Comparison of Human and Machine Learning Errors in Face Recognition
por: Estévez-Almenzar, Marina, et al.
Publicado: (2025)
por: Estévez-Almenzar, Marina, et al.
Publicado: (2025)
HAIC: Improving Human Action Understanding and Generation with Better Captions for Multi-modal Large Language Models
por: Wang, Xiao, et al.
Publicado: (2025)
por: Wang, Xiao, et al.
Publicado: (2025)
Rethinking Vision-Language Model in Face Forensics: Multi-Modal Interpretable Forged Face Detector
por: Guo, Xiao, et al.
Publicado: (2025)
por: Guo, Xiao, et al.
Publicado: (2025)
CS-Bench: A Comprehensive Benchmark for Large Language Models towards Computer Science Mastery
por: Song, Xiaoshuai, et al.
Publicado: (2024)
por: Song, Xiaoshuai, et al.
Publicado: (2024)
LvBench: A Benchmark for Long-form Video Understanding with Versatile Multi-modal Question Answering
por: Zhang, Hongjie, et al.
Publicado: (2023)
por: Zhang, Hongjie, et al.
Publicado: (2023)
FaceGPT: Self-supervised Learning to Chat about 3D Human Faces
por: Wang, Haoran, et al.
Publicado: (2024)
por: Wang, Haoran, et al.
Publicado: (2024)
WritingBench: A Comprehensive Benchmark for Generative Writing
por: Wu, Yuning, et al.
Publicado: (2025)
por: Wu, Yuning, et al.
Publicado: (2025)
PALM-Bench: A Comprehensive Benchmark for Personalized Audio-Language Models
por: Wang, Yuwen, et al.
Publicado: (2026)
por: Wang, Yuwen, et al.
Publicado: (2026)
EgoInstruct: An Egocentric Video Dataset of Face-to-face Instructional Interactions with Multi-modal LLM Benchmarking
por: Sakai, Yuki, et al.
Publicado: (2025)
por: Sakai, Yuki, et al.
Publicado: (2025)
QuantFace: Efficient Quantization for Face Restoration
por: Li, Jiatong, et al.
Publicado: (2025)
por: Li, Jiatong, et al.
Publicado: (2025)
KITAB-Bench: A Comprehensive Multi-Domain Benchmark for Arabic OCR and Document Understanding
por: Heakl, Ahmed, et al.
Publicado: (2025)
por: Heakl, Ahmed, et al.
Publicado: (2025)
FaceXBench: Evaluating Multimodal LLMs on Face Understanding
por: Narayan, Kartik, et al.
Publicado: (2025)
por: Narayan, Kartik, et al.
Publicado: (2025)
MFCLIP: Multi-modal Fine-grained CLIP for Generalizable Diffusion Face Forgery Detection
por: Zhang, Yaning, et al.
Publicado: (2024)
por: Zhang, Yaning, et al.
Publicado: (2024)
FaceLLM: A Multimodal Large Language Model for Face Understanding
por: Shahreza, Hatef Otroshi, et al.
Publicado: (2025)
por: Shahreza, Hatef Otroshi, et al.
Publicado: (2025)
Shared Multi-modal Embedding Space for Face-Voice Association
por: Simic, Christopher, et al.
Publicado: (2025)
por: Simic, Christopher, et al.
Publicado: (2025)
Ejemplares similares
-
Faceptor: A Generalist Model for Face Perception
por: Qin, Lixiong, et al.
Publicado: (2024) -
FaceScore: Benchmarking and Enhancing Face Quality in Human Generation
por: Liao, Zhenyi, et al.
Publicado: (2024) -
F-Bench: Rethinking Human Preference Evaluation Metrics for Benchmarking Face Generation, Customization, and Restoration
por: Liu, Lu, et al.
Publicado: (2024) -
FlashFace: Human Image Personalization with High-fidelity Identity Preservation
por: Zhang, Shilong, et al.
Publicado: (2024) -
Towards the Detection of AI-Synthesized Human Face Images
por: Lu, Yuhang, et al.
Publicado: (2024)