LMME3DHF: Benchmarking and Evaluating Multimodal 3D Human Face Generation with LMMs
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Woo Yi, Wang, Jiarui, Wu, Sijing, Duan, Huiyu, Zhu, Yuxin, Yang, Liu, Fu, Kang, Zhai, Guangtao, Min, Xiongkuo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TDVE-Assessor: Benchmarking and Evaluating the Quality of Text-Driven Video Editing with LMMs
por: Wang, Juntong, et al.
Publicado: (2025)
por: Wang, Juntong, et al.
Publicado: (2025)
LMM4LMM: Benchmarking and Evaluating Large-multimodal Image Generation with LMMs
por: Wang, Jiarui, et al.
Publicado: (2025)
por: Wang, Jiarui, et al.
Publicado: (2025)
LMM4Edit: Benchmarking and Evaluating Multimodal Image Editing with LMMs
por: Xu, Zitong, et al.
Publicado: (2025)
por: Xu, Zitong, et al.
Publicado: (2025)
AIGV-Assessor: Benchmarking and Evaluating the Perceptual Quality of Text-to-Video Generation with LMM
por: Wang, Jiarui, et al.
Publicado: (2024)
por: Wang, Jiarui, et al.
Publicado: (2024)
Enhancing Image Quality Assessment Ability of LMMs via Retrieval-Augmented Generation
por: Fu, Kang, et al.
Publicado: (2026)
por: Fu, Kang, et al.
Publicado: (2026)
Quality Assessment for AI Generated Images with Instruction Tuning
por: Wang, Jiarui, et al.
Publicado: (2024)
por: Wang, Jiarui, et al.
Publicado: (2024)
UniProcessor: A Text-induced Unified Low-level Image Processor
por: Duan, Huiyu, et al.
Publicado: (2024)
por: Duan, Huiyu, et al.
Publicado: (2024)
I2I-Bench: A Comprehensive Benchmark Suite for Image-to-Image Editing Models
por: Wang, Juntong, et al.
Publicado: (2025)
por: Wang, Juntong, et al.
Publicado: (2025)
LM Fight Arena: Benchmarking Large Multimodal Models via Game Competition
por: Zheng, Yushuo, et al.
Publicado: (2025)
por: Zheng, Yushuo, et al.
Publicado: (2025)
BMPCQA: Bioinspired Metaverse Point Cloud Quality Assessment Based on Large Multimodal Models
por: Huiyu Duan, et al.
Publicado: (2025)
por: Huiyu Duan, et al.
Publicado: (2025)
VideoAesBench: Benchmarking the Video Aesthetics Perception Capabilities of Large Multimodal Models
por: Li, Yunhao, et al.
Publicado: (2026)
por: Li, Yunhao, et al.
Publicado: (2026)
Q-Bench-Portrait: Benchmarking Multimodal Large Language Models on Portrait Image Quality Perception
por: Wu, Sijing, et al.
Publicado: (2026)
por: Wu, Sijing, et al.
Publicado: (2026)
DFBench: Benchmarking Deepfake Image Detection Capability of Large Multimodal Models
por: Wang, Jiarui, et al.
Publicado: (2025)
por: Wang, Jiarui, et al.
Publicado: (2025)
DynT2I-Eval: A Dynamic Evaluation Framework for Text-to-Image Models
por: Wang, Juntong, et al.
Publicado: (2026)
por: Wang, Juntong, et al.
Publicado: (2026)
Multi-Dimensional Quality Assessment for Text-to-3D Assets: Dataset and Model
por: Fu, Kang, et al.
Publicado: (2025)
por: Fu, Kang, et al.
Publicado: (2025)
TIT-Score: Evaluating Long-Prompt Based Text-to-Image Alignment via Text-to-Image-to-Text Consistency
por: Wang, Juntong, et al.
Publicado: (2025)
por: Wang, Juntong, et al.
Publicado: (2025)
How is Visual Attention Influenced by Text Guidance? Database and Model
por: Sun, Yinan, et al.
Publicado: (2024)
por: Sun, Yinan, et al.
Publicado: (2024)
LOVE: Benchmarking and Evaluating Text-to-Video Generation and Video-to-Text Interpretation
por: Wang, Jiarui, et al.
Publicado: (2025)
por: Wang, Jiarui, et al.
Publicado: (2025)
Market-Bench: Benchmarking Large Language Models on Economic and Trade Competition
por: Zheng, Yushuo, et al.
Publicado: (2026)
por: Zheng, Yushuo, et al.
Publicado: (2026)
DHQA-4D: Perceptual Quality Assessment of Dynamic 4D Digital Human
por: Li, Yunhao, et al.
Publicado: (2025)
por: Li, Yunhao, et al.
Publicado: (2025)
Textured Mesh Saliency: Bridging Geometry and Texture for Human Perception in 3D Graphics
por: Zhang, Kaiwei, et al.
Publicado: (2024)
por: Zhang, Kaiwei, et al.
Publicado: (2024)
SFQA: A Comprehensive Perceptual Quality Assessment Dataset for Singing Face Generation
por: Gao, Zhilin, et al.
Publicado: (2026)
por: Gao, Zhilin, et al.
Publicado: (2026)
Perceptual Video Quality Assessment: A Survey
por: Min, Xiongkuo, et al.
Publicado: (2024)
por: Min, Xiongkuo, et al.
Publicado: (2024)
VTONQA: A Multi-Dimensional Quality Assessment Dataset for Virtual Try-on
por: Wei, Xinyi, et al.
Publicado: (2026)
por: Wei, Xinyi, et al.
Publicado: (2026)
AGHI-QA: A Subjective-Aligned Dataset and Metric for AI-Generated Human Images
por: Li, Yunhao, et al.
Publicado: (2025)
por: Li, Yunhao, et al.
Publicado: (2025)
MMHead: Towards Fine-grained Multi-modal 3D Facial Animation
por: Wu, Sijing, et al.
Publicado: (2024)
por: Wu, Sijing, et al.
Publicado: (2024)
Learning to Wander: Improving the Global Image Geolocation Ability of LMMs via Actionable Reasoning
por: Zheng, Yushuo, et al.
Publicado: (2026)
por: Zheng, Yushuo, et al.
Publicado: (2026)
Ges-QA: A Multidimensional Quality Assessment Dataset for Audio-to-3D Gesture Generation
por: Gao, Zhilin, et al.
Publicado: (2025)
por: Gao, Zhilin, et al.
Publicado: (2025)
ESIQA: Perceptual Quality Assessment of Vision-Pro-based Egocentric Spatial Images
por: Zhu, Xilei, et al.
Publicado: (2024)
por: Zhu, Xilei, et al.
Publicado: (2024)
HarmonyIQA: Pioneering Benchmark and Model for Image Harmonization Quality Assessment
por: Xu, Zitong, et al.
Publicado: (2025)
por: Xu, Zitong, et al.
Publicado: (2025)
ReasonEdit: Towards Interpretable Image Editing Evaluation via Reinforcement Learning
por: Chen, Honghua, et al.
Publicado: (2026)
por: Chen, Honghua, et al.
Publicado: (2026)
MVBIND: Self-Supervised Music Recommendation For Videos Via Embedding Space Binding
por: Teng, Jiajie, et al.
Publicado: (2024)
por: Teng, Jiajie, et al.
Publicado: (2024)
Preference-Guided Debiasing for No-Reference Enhancement Image Quality Assessment
por: Gao, Shiqi, et al.
Publicado: (2026)
por: Gao, Shiqi, et al.
Publicado: (2026)
VITAL: Vision-Encoder-centered Pre-training for LMMs in Visual Quality Assessment
por: Jia, Ziheng, et al.
Publicado: (2025)
por: Jia, Ziheng, et al.
Publicado: (2025)
RGC-VQA: An Exploration Database for Robotic-Generated Video Quality Assessment
por: Jin, Jianing, et al.
Publicado: (2025)
por: Jin, Jianing, et al.
Publicado: (2025)
ODI-Bench: Can MLLMs Understand Immersive Omnidirectional Environments?
por: Yang, Liu, et al.
Publicado: (2025)
por: Yang, Liu, et al.
Publicado: (2025)
How Does Audio Influence Visual Attention in Omnidirectional Videos? Database and Model
por: Zhu, Yuxin, et al.
Publicado: (2024)
por: Zhu, Yuxin, et al.
Publicado: (2024)
F-Bench: Rethinking Human Preference Evaluation Metrics for Benchmarking Face Generation, Customization, and Restoration
por: Liu, Lu, et al.
Publicado: (2024)
por: Liu, Lu, et al.
Publicado: (2024)
Evaluating Image Editing with LLMs: A Comprehensive Benchmark and Intermediate-Layer Probing Approach
por: Gao, Shiqi, et al.
Publicado: (2026)
por: Gao, Shiqi, et al.
Publicado: (2026)
ESVQA: Perceptual Quality Assessment of Egocentric Spatial Videos
por: Zhu, Xilei, et al.
Publicado: (2024)
por: Zhu, Xilei, et al.
Publicado: (2024)
Ejemplares similares
-
TDVE-Assessor: Benchmarking and Evaluating the Quality of Text-Driven Video Editing with LMMs
por: Wang, Juntong, et al.
Publicado: (2025) -
LMM4LMM: Benchmarking and Evaluating Large-multimodal Image Generation with LMMs
por: Wang, Jiarui, et al.
Publicado: (2025) -
LMM4Edit: Benchmarking and Evaluating Multimodal Image Editing with LMMs
por: Xu, Zitong, et al.
Publicado: (2025) -
AIGV-Assessor: Benchmarking and Evaluating the Perceptual Quality of Text-to-Video Generation with LMM
por: Wang, Jiarui, et al.
Publicado: (2024) -
Enhancing Image Quality Assessment Ability of LMMs via Retrieval-Augmented Generation
por: Fu, Kang, et al.
Publicado: (2026)