EPIC-Bench: A Perception-Centric Benchmark for Fine-Grained Embodied Visual Grounding in Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shan, Haozhe, Ren, Xiancong, Dong, Han, Shi, Haoyuan, Zhang, Yingji, Hu, Jiayu, Zhang, Yi, Dai, Yong, Shen, Bin, Qu, Lizhen, Xu, Zenglin, Ju, Xiaozhu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VLA-Trace: Diagnosing Vision-Language-Action Models through Representation and Behavior Tracing
par: Shi, Haoyuan, et autres
Publié: (2026)
par: Shi, Haoyuan, et autres
Publié: (2026)
Bridging VLMs and Embodied Intelligence with Deliberate Practice Policy Optimization
par: Zhang, Yi, et autres
Publié: (2025)
par: Zhang, Yi, et autres
Publié: (2025)
Robo-Cortex: A Self-Evolving Embodied Agent via Dual-Grain Cognitive Memory and Autonomous Knowledge Induction
par: Chan, Nga Teng, et autres
Publié: (2026)
par: Chan, Nga Teng, et autres
Publié: (2026)
A2Eval: Agentic and Automated Evaluation for Embodied Brain
par: Zhang, Shuai, et autres
Publié: (2026)
par: Zhang, Shuai, et autres
Publié: (2026)
Pelican-VL 1.0: A Foundation Brain Model for Embodied Intelligence
par: Zhang, Yi, et autres
Publié: (2025)
par: Zhang, Yi, et autres
Publié: (2025)
EgoCoT-Bench: Benchmarking Grounded and Verifiable Operation-Centric Chain of Thought Reasoning for MLLMs
par: Dai, Yang, et autres
Publié: (2026)
par: Dai, Yang, et autres
Publié: (2026)
Pelican-Unify 1.0: A Unified Embodied Intelligence Model for Understanding, Reasoning, Imagination and Action
par: Zhang, Yi, et autres
Publié: (2026)
par: Zhang, Yi, et autres
Publié: (2026)
Simple Yet Effective: Extracting Private Data Across Clients in Federated Fine-Tuning of Large Language Models
par: Hu, Yingqi, et autres
Publié: (2025)
par: Hu, Yingqi, et autres
Publié: (2025)
PresentBench: A Fine-Grained Rubric-Based Benchmark for Slide Generation
par: Chen, Xin-Sheng, et autres
Publié: (2026)
par: Chen, Xin-Sheng, et autres
Publié: (2026)
EmbodiedBench: Comprehensive Benchmarking Multi-modal Large Language Models for Vision-Driven Embodied Agents
par: Yang, Rui, et autres
Publié: (2025)
par: Yang, Rui, et autres
Publié: (2025)
Nexus: An Omni-Perceptive And -Interactive Model for Language, Audio, And Vision
par: Liu, Che, et autres
Publié: (2025)
par: Liu, Che, et autres
Publié: (2025)
AirCopBench: A Benchmark for Multi-drone Collaborative Embodied Perception and Reasoning
par: Zha, Jirong, et autres
Publié: (2025)
par: Zha, Jirong, et autres
Publié: (2025)
Beyond Description: Cognitively Benchmarking Fine-Grained Action for Embodied Agents
par: Liu, Dayong, et autres
Publié: (2025)
par: Liu, Dayong, et autres
Publié: (2025)
GranViT: A Fine-Grained Vision Model With Autoregressive Perception For MLLMs
par: Zheng, Guanghao, et autres
Publié: (2025)
par: Zheng, Guanghao, et autres
Publié: (2025)
UrbanVideo-Bench: Benchmarking Vision-Language Models on Embodied Intelligence with Video Data in Urban Spaces
par: Zhao, Baining, et autres
Publié: (2025)
par: Zhao, Baining, et autres
Publié: (2025)
SAS-Bench: A Fine-Grained Benchmark for Evaluating Short Answer Scoring with Large Language Models
par: Lai, Peichao, et autres
Publié: (2025)
par: Lai, Peichao, et autres
Publié: (2025)
IV-Bench: A Benchmark for Image-Grounded Video Perception and Reasoning in Multimodal LLMs
par: Ma, David, et autres
Publié: (2025)
par: Ma, David, et autres
Publié: (2025)
CoTEvol: Self-Evolving Chain-of-Thoughts for Data Synthesis in Mathematical Reasoning
par: Wang, Zhuo, et autres
Publié: (2026)
par: Wang, Zhuo, et autres
Publié: (2026)
CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation
par: Yuan, Ruifeng, et autres
Publié: (2026)
par: Yuan, Ruifeng, et autres
Publié: (2026)
MMDocBench: Benchmarking Large Vision-Language Models for Fine-Grained Visual Document Understanding
par: Zhu, Fengbin, et autres
Publié: (2024)
par: Zhu, Fengbin, et autres
Publié: (2024)
FB-Bench: A Fine-Grained Multi-Task Benchmark for Evaluating LLMs' Responsiveness to Human Feedback
par: Li, Youquan, et autres
Publié: (2024)
par: Li, Youquan, et autres
Publié: (2024)
Body Discovery of Embodied AI
par: Sun, Zhe, et autres
Publié: (2025)
par: Sun, Zhe, et autres
Publié: (2025)
FAVOR-Bench: A Comprehensive Benchmark for Fine-Grained Video Motion Understanding
par: Tu, Chongjun, et autres
Publié: (2025)
par: Tu, Chongjun, et autres
Publié: (2025)
SEEA-R1: Tree-Structured Reinforcement Fine-Tuning for Self-Evolving Embodied Agents
par: Tian, Wanxin, et autres
Publié: (2025)
par: Tian, Wanxin, et autres
Publié: (2025)
Formal Semantic Control over Language Models
par: Zhang, Yingji
Publié: (2026)
par: Zhang, Yingji
Publié: (2026)
Grounding Actions in Camera Space: Observation-Centric Vision-Language-Action Policy
par: Zhang, Tianyi, et autres
Publié: (2025)
par: Zhang, Tianyi, et autres
Publié: (2025)
SKA-Bench: A Fine-Grained Benchmark for Evaluating Structured Knowledge Understanding of LLMs
par: Liu, Zhiqiang, et autres
Publié: (2025)
par: Liu, Zhiqiang, et autres
Publié: (2025)
PaveBench: A Versatile Benchmark for Pavement Distress Perception and Interactive Vision-Language Analysis
par: Li, Dexiang, et autres
Publié: (2026)
par: Li, Dexiang, et autres
Publié: (2026)
EmboCoach-Bench: Benchmarking AI Agents on Developing Embodied Robots
par: Lei, Zixing, et autres
Publié: (2026)
par: Lei, Zixing, et autres
Publié: (2026)
EyePCR: A Comprehensive Benchmark for Fine-Grained Perception, Knowledge Comprehension and Clinical Reasoning in Ophthalmic Surgery
par: Wang, Gui, et autres
Publié: (2025)
par: Wang, Gui, et autres
Publié: (2025)
SongBench: A Fine-Grained Multi-Aspect Benchmark for Song Quality Assessment
par: Wu, Dapeng, et autres
Publié: (2026)
par: Wu, Dapeng, et autres
Publié: (2026)
FewFedPIT: Towards Privacy-preserving and Few-shot Federated Instruction Tuning
par: Zhang, Zhuo, et autres
Publié: (2024)
par: Zhang, Zhuo, et autres
Publié: (2024)
Factcheck-Bench: Fine-Grained Evaluation Benchmark for Automatic Fact-checkers
par: Wang, Yuxia, et autres
Publié: (2023)
par: Wang, Yuxia, et autres
Publié: (2023)
LiveResearchBench: A Live Benchmark for User-Centric Deep Research in the Wild
par: Wang, Jiayu, et autres
Publié: (2025)
par: Wang, Jiayu, et autres
Publié: (2025)
GeoMathCode: Understanding Interleaved Math-Code Reasoning for Geometry Problem Solving
par: Zhang, Yingji, et autres
Publié: (2026)
par: Zhang, Yingji, et autres
Publié: (2026)
FineState-Bench: Benchmarking State-Conditioned Grounding for Fine-grained GUI State Setting
par: Ji, Fengxian, et autres
Publié: (2026)
par: Ji, Fengxian, et autres
Publié: (2026)
Photo‐induced Thiocyanation of Alkenes Catalyzed by Non‐heme Iron Complexes: Synthetic Methodology and Mechanistic Insights
par: Cece Wang, et autres
Publié: (2025)
par: Cece Wang, et autres
Publié: (2025)
FineState-Bench: A Comprehensive Benchmark for Fine-Grained State Control in GUI Agents
par: Ji, Fengxian, et autres
Publié: (2025)
par: Ji, Fengxian, et autres
Publié: (2025)
Animator-Centric Skeleton Generation on Objects with Fine-Grained Details
par: Sun, Mingze, et autres
Publié: (2026)
par: Sun, Mingze, et autres
Publié: (2026)
EmbSpatial-Bench: Benchmarking Spatial Understanding for Embodied Tasks with Large Vision-Language Models
par: Du, Mengfei, et autres
Publié: (2024)
par: Du, Mengfei, et autres
Publié: (2024)
Documents similaires
-
VLA-Trace: Diagnosing Vision-Language-Action Models through Representation and Behavior Tracing
par: Shi, Haoyuan, et autres
Publié: (2026) -
Bridging VLMs and Embodied Intelligence with Deliberate Practice Policy Optimization
par: Zhang, Yi, et autres
Publié: (2025) -
Robo-Cortex: A Self-Evolving Embodied Agent via Dual-Grain Cognitive Memory and Autonomous Knowledge Induction
par: Chan, Nga Teng, et autres
Publié: (2026) -
A2Eval: Agentic and Automated Evaluation for Embodied Brain
par: Zhang, Shuai, et autres
Publié: (2026) -
Pelican-VL 1.0: A Foundation Brain Model for Embodied Intelligence
par: Zhang, Yi, et autres
Publié: (2025)