PresentBench: A Fine-Grained Rubric-Based Benchmark for Slide Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Xin-Sheng, Zhu, Jiayu, Li, Pei-lin, Wang, Hanzheng, Yang, Shuojin, Guo, Meng-Hao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Agentic Keyframe Search for Video Question Answering
por: Fan, Sunqi, et al.
Publicado: (2025)
por: Fan, Sunqi, et al.
Publicado: (2025)
Tool-Augmented Spatiotemporal Reasoning for Streamlining Video Question Answering Task
por: Fan, Sunqi, et al.
Publicado: (2025)
por: Fan, Sunqi, et al.
Publicado: (2025)
TechImage-Bench: Rubric-Based Evaluation for Technical Image Generation
por: Ni, Minheng, et al.
Publicado: (2025)
por: Ni, Minheng, et al.
Publicado: (2025)
FineState-Bench: A Comprehensive Benchmark for Fine-Grained State Control in GUI Agents
por: Ji, Fengxian, et al.
Publicado: (2025)
por: Ji, Fengxian, et al.
Publicado: (2025)
AIM-Bench: Benchmarking and Improving Affective Image Manipulation via Fine-Grained Hierarchical Control
por: Chen, Shi, et al.
Publicado: (2026)
por: Chen, Shi, et al.
Publicado: (2026)
EPIC-Bench: A Perception-Centric Benchmark for Fine-Grained Embodied Visual Grounding in Vision-Language Models
por: Shan, Haozhe, et al.
Publicado: (2026)
por: Shan, Haozhe, et al.
Publicado: (2026)
CaReBench: A Fine-Grained Benchmark for Video Captioning and Retrieval
por: Xu, Yifan, et al.
Publicado: (2024)
por: Xu, Yifan, et al.
Publicado: (2024)
Generalizable Whole Slide Image Classification with Fine-Grained Visual-Semantic Interaction
por: Li, Hao, et al.
Publicado: (2024)
por: Li, Hao, et al.
Publicado: (2024)
HMIL: Hierarchical Multi-Instance Learning for Fine-Grained Whole Slide Image Classification
por: Jin, Cheng, et al.
Publicado: (2024)
por: Jin, Cheng, et al.
Publicado: (2024)
KPM-Bench: A Kinematic Parsing Motion Benchmark for Fine-grained Motion-centric Video Understanding
por: Lin, Boda, et al.
Publicado: (2026)
por: Lin, Boda, et al.
Publicado: (2026)
S-RRG-Bench: Structured Radiology Report Generation with Fine-Grained Evaluation Framework
por: Li, Yingshu, et al.
Publicado: (2025)
por: Li, Yingshu, et al.
Publicado: (2025)
VCapsBench: A Large-scale Fine-grained Benchmark for Video Caption Quality Evaluation
por: Zhang, Shi-Xue, et al.
Publicado: (2025)
por: Zhang, Shi-Xue, et al.
Publicado: (2025)
MMDocBench: Benchmarking Large Vision-Language Models for Fine-Grained Visual Document Understanding
por: Zhu, Fengbin, et al.
Publicado: (2024)
por: Zhu, Fengbin, et al.
Publicado: (2024)
BihoT: A Large-Scale Dataset and Benchmark for Hyperspectral Camouflaged Object Tracking
por: Wang, Hanzheng, et al.
Publicado: (2024)
por: Wang, Hanzheng, et al.
Publicado: (2024)
FAVOR-Bench: A Comprehensive Benchmark for Fine-Grained Video Motion Understanding
por: Tu, Chongjun, et al.
Publicado: (2025)
por: Tu, Chongjun, et al.
Publicado: (2025)
RoadBench: Benchmarking MLLMs on Fine-Grained Spatial Understanding and Reasoning under Urban Road Scenarios
por: Zhang, Jun, et al.
Publicado: (2025)
por: Zhang, Jun, et al.
Publicado: (2025)
TextToucher: Fine-Grained Text-to-Touch Generation
por: Tu, Jiahang, et al.
Publicado: (2024)
por: Tu, Jiahang, et al.
Publicado: (2024)
HighlightBench: Benchmarking Markup-Driven Table Reasoning in Scientific Documents
por: Wang, Lexin, et al.
Publicado: (2026)
por: Wang, Lexin, et al.
Publicado: (2026)
Beyond Inpainting: Unleash 3D Understanding for Precise Camera-Controlled Video Generation
por: Chen, Dong-Yu, et al.
Publicado: (2026)
por: Chen, Dong-Yu, et al.
Publicado: (2026)
V-ReasonBench: Toward Unified Reasoning Benchmark Suite for Video Generation Models
por: Luo, Yang, et al.
Publicado: (2025)
por: Luo, Yang, et al.
Publicado: (2025)
VER-Bench: Evaluating MLLMs on Reasoning with Fine-Grained Visual Evidence
por: Qiang, Chenhui, et al.
Publicado: (2025)
por: Qiang, Chenhui, et al.
Publicado: (2025)
OmniGenBench: A Benchmark for Omnipotent Multimodal Generation across 50+ Tasks
por: Wang, Jiayu, et al.
Publicado: (2025)
por: Wang, Jiayu, et al.
Publicado: (2025)
MMDG-Bench: A Benchmark for Multimodal Domain Generalization
por: Zhan, Qianshan, et al.
Publicado: (2026)
por: Zhan, Qianshan, et al.
Publicado: (2026)
MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation
por: Tong, Haibo, et al.
Publicado: (2025)
por: Tong, Haibo, et al.
Publicado: (2025)
RxnBench: A Multimodal Benchmark for Evaluating Large Language Models on Chemical Reaction Understanding from Scientific Literature
por: Li, Hanzheng, et al.
Publicado: (2025)
por: Li, Hanzheng, et al.
Publicado: (2025)
Unveiling Perceptual Artifacts: A Fine-Grained Benchmark for Interpretable AI-Generated Image Detection
por: Xiao, Yao, et al.
Publicado: (2026)
por: Xiao, Yao, et al.
Publicado: (2026)
FineState-Bench: Benchmarking State-Conditioned Grounding for Fine-grained GUI State Setting
por: Ji, Fengxian, et al.
Publicado: (2026)
por: Ji, Fengxian, et al.
Publicado: (2026)
IP-Bench: Benchmark for Image Protection Methods in Image-to-Video Generation Scenarios
por: Li, Xiaofeng, et al.
Publicado: (2026)
por: Li, Xiaofeng, et al.
Publicado: (2026)
TraceAV-Bench: Benchmarking Multi-Hop Trajectory Reasoning over Long Audio-Visual Videos
por: Feng, Hengyi, et al.
Publicado: (2026)
por: Feng, Hengyi, et al.
Publicado: (2026)
MM-SafetyBench: A Benchmark for Safety Evaluation of Multimodal Large Language Models
por: Liu, Xin, et al.
Publicado: (2023)
por: Liu, Xin, et al.
Publicado: (2023)
GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing
por: Ma, Xianzhi, et al.
Publicado: (2025)
por: Ma, Xianzhi, et al.
Publicado: (2025)
Res-Bench: Benchmarking the Robustness of Multimodal Large Language Models to Dynamic Resolution Input
por: Li, Chenxu, et al.
Publicado: (2025)
por: Li, Chenxu, et al.
Publicado: (2025)
IMAGGarment: Fine-Grained Garment Generation for Controllable Fashion Design
por: Shen, Fei, et al.
Publicado: (2025)
por: Shen, Fei, et al.
Publicado: (2025)
GIR-Bench: Versatile Benchmark for Generating Images with Reasoning
por: Li, Hongxiang, et al.
Publicado: (2025)
por: Li, Hongxiang, et al.
Publicado: (2025)
Synchronized and Fine-Grained Head for Skeleton-Based Ambiguous Action Recognition
por: Huang, Hao, et al.
Publicado: (2024)
por: Huang, Hao, et al.
Publicado: (2024)
MotionBench: Benchmarking and Improving Fine-grained Video Motion Understanding for Vision Language Models
por: Hong, Wenyi, et al.
Publicado: (2025)
por: Hong, Wenyi, et al.
Publicado: (2025)
PresentAgent: Multimodal Agent for Presentation Video Generation
por: Shi, Jingwei, et al.
Publicado: (2025)
por: Shi, Jingwei, et al.
Publicado: (2025)
VERIFIED: A Video Corpus Moment Retrieval Benchmark for Fine-Grained Video Understanding
por: Chen, Houlun, et al.
Publicado: (2024)
por: Chen, Houlun, et al.
Publicado: (2024)
RoboTrustBench: Benchmarking the Trustworthiness of Video World Models for Robotic Manipulation
por: Li, Huiqiong, et al.
Publicado: (2026)
por: Li, Huiqiong, et al.
Publicado: (2026)
SGIA: Enhancing Fine-Grained Visual Classification with Sequence Generative Image Augmentation
por: Liao, Qiyu, et al.
Publicado: (2024)
por: Liao, Qiyu, et al.
Publicado: (2024)
Ejemplares similares
-
Agentic Keyframe Search for Video Question Answering
por: Fan, Sunqi, et al.
Publicado: (2025) -
Tool-Augmented Spatiotemporal Reasoning for Streamlining Video Question Answering Task
por: Fan, Sunqi, et al.
Publicado: (2025) -
TechImage-Bench: Rubric-Based Evaluation for Technical Image Generation
por: Ni, Minheng, et al.
Publicado: (2025) -
FineState-Bench: A Comprehensive Benchmark for Fine-Grained State Control in GUI Agents
por: Ji, Fengxian, et al.
Publicado: (2025) -
AIM-Bench: Benchmarking and Improving Affective Image Manipulation via Fine-Grained Hierarchical Control
por: Chen, Shi, et al.
Publicado: (2026)