EmbodiedBench: Comprehensive Benchmarking Multi-modal Large Language Models for Vision-Driven Embodied Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Rui, Chen, Hanyang, Zhang, Junyu, Zhao, Mark, Qian, Cheng, Wang, Kangrui, Wang, Qineng, Koripella, Teja Venkat, Movahedi, Marziyeh, Li, Manling, Ji, Heng, Zhang, Huan, Zhang, Tong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Embodied Agent Interface: Benchmarking LLMs for Embodied Decision Making
di: Li, Manling, et al.
Pubblicazione: (2024)
di: Li, Manling, et al.
Pubblicazione: (2024)
ENACT: Evaluating Embodied Cognition with World Modeling of Egocentric Interaction
di: Wang, Qineng, et al.
Pubblicazione: (2025)
di: Wang, Qineng, et al.
Pubblicazione: (2025)
Embodied3DBench: Benchmarking Low-Level Embodied Spatial Intelligence of Vision Language Models
di: Zhang, Jiyao, et al.
Pubblicazione: (2026)
di: Zhang, Jiyao, et al.
Pubblicazione: (2026)
ERA: Transforming VLMs into Embodied Agents via Embodied Prior Learning and Online Reinforcement Learning
di: Chen, Hanyang, et al.
Pubblicazione: (2025)
di: Chen, Hanyang, et al.
Pubblicazione: (2025)
BEAT: Visual Backdoor Attacks on VLM-based Embodied Agents via Contrastive Trigger Learning
di: Zhan, Qiusi, et al.
Pubblicazione: (2025)
di: Zhan, Qiusi, et al.
Pubblicazione: (2025)
UrbanVideo-Bench: Benchmarking Vision-Language Models on Embodied Intelligence with Video Data in Urban Spaces
di: Zhao, Baining, et al.
Pubblicazione: (2025)
di: Zhao, Baining, et al.
Pubblicazione: (2025)
ESI-Bench: Towards Embodied Spatial Intelligence that Closes the Perception-Action Loop
di: Hong, Yining, et al.
Pubblicazione: (2026)
di: Hong, Yining, et al.
Pubblicazione: (2026)
ERGeoBench:A Comprehensive Benchmark for Embodied Reasoning and Geo-localization in Multimodal Large Language Models
di: Xue, Kaiwen, et al.
Pubblicazione: (2026)
di: Xue, Kaiwen, et al.
Pubblicazione: (2026)
EPIC-Bench: A Perception-Centric Benchmark for Fine-Grained Embodied Visual Grounding in Vision-Language Models
di: Shan, Haozhe, et al.
Pubblicazione: (2026)
di: Shan, Haozhe, et al.
Pubblicazione: (2026)
EmbSpatial-Bench: Benchmarking Spatial Understanding for Embodied Tasks with Large Vision-Language Models
di: Du, Mengfei, et al.
Pubblicazione: (2024)
di: Du, Mengfei, et al.
Pubblicazione: (2024)
IS-Bench: Evaluating Interactive Safety of VLM-Driven Embodied Agents in Daily Household Tasks
di: Lu, Xiaoya, et al.
Pubblicazione: (2025)
di: Lu, Xiaoya, et al.
Pubblicazione: (2025)
HomeSafeBench: A Benchmark for Embodied Vision-Language Models in Free-Exploration Home Safety Inspection
di: Gao, Siyuan, et al.
Pubblicazione: (2025)
di: Gao, Siyuan, et al.
Pubblicazione: (2025)
Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain
di: Luo, Yulin, et al.
Pubblicazione: (2025)
di: Luo, Yulin, et al.
Pubblicazione: (2025)
Face-Human-Bench: A Comprehensive Benchmark of Face and Human Understanding for Multi-modal Assistants
di: Qin, Lixiong, et al.
Pubblicazione: (2025)
di: Qin, Lixiong, et al.
Pubblicazione: (2025)
NavBench: Probing Multimodal Large Language Models for Embodied Navigation
di: Qiao, Yanyuan, et al.
Pubblicazione: (2025)
di: Qiao, Yanyuan, et al.
Pubblicazione: (2025)
Ella: Embodied Social Agents with Lifelong Memory
di: Zhang, Hongxin, et al.
Pubblicazione: (2025)
di: Zhang, Hongxin, et al.
Pubblicazione: (2025)
AirCopBench: A Benchmark for Multi-drone Collaborative Embodied Perception and Reasoning
di: Zha, Jirong, et al.
Pubblicazione: (2025)
di: Zha, Jirong, et al.
Pubblicazione: (2025)
From Perfect to Noisy World Simulation: Customizable Embodied Multi-modal Perturbations for SLAM Robustness Benchmarking
di: Xu, Xiaohao, et al.
Pubblicazione: (2024)
di: Xu, Xiaohao, et al.
Pubblicazione: (2024)
Embodied-Reasoner: Synergizing Visual Search, Reasoning, and Action for Embodied Interactive Tasks
di: Zhang, Wenqi, et al.
Pubblicazione: (2025)
di: Zhang, Wenqi, et al.
Pubblicazione: (2025)
ECBench: Can Multi-modal Foundation Models Understand the Egocentric World? A Holistic Embodied Cognition Benchmark
di: Dang, Ronghao, et al.
Pubblicazione: (2025)
di: Dang, Ronghao, et al.
Pubblicazione: (2025)
RoboStressBench: Benchmarking VLM Robustness to Physical Visual Stress in Embodied Scenes
di: Wu, Leyi, et al.
Pubblicazione: (2026)
di: Wu, Leyi, et al.
Pubblicazione: (2026)
EmbodiedBrain: Expanding Performance Boundaries of Task Planning for Embodied Intelligence
di: Zou, Ding, et al.
Pubblicazione: (2025)
di: Zou, Ding, et al.
Pubblicazione: (2025)
MindCube: Spatial Mental Modeling from Limited Views
di: Wang, Qineng, et al.
Pubblicazione: (2025)
di: Wang, Qineng, et al.
Pubblicazione: (2025)
MiMo-Embodied: X-Embodied Foundation Model Technical Report
di: Hao, Xiaoshuai, et al.
Pubblicazione: (2025)
di: Hao, Xiaoshuai, et al.
Pubblicazione: (2025)
HomeSafe-Bench: Evaluating Vision-Language Models on Unsafe Action Detection for Embodied Agents in Household Scenarios
di: Pu, Jiayue, et al.
Pubblicazione: (2026)
di: Pu, Jiayue, et al.
Pubblicazione: (2026)
A Comprehensive Survey on World Models for Embodied AI
di: Li, Xinqing, et al.
Pubblicazione: (2025)
di: Li, Xinqing, et al.
Pubblicazione: (2025)
PediaBench: A Comprehensive Chinese Pediatric Dataset for Benchmarking Large Language Models
di: Zhang, Qian, et al.
Pubblicazione: (2024)
di: Zhang, Qian, et al.
Pubblicazione: (2024)
VAGEN: Reinforcing World Model Reasoning for Multi-Turn VLM Agents
di: Wang, Kangrui, et al.
Pubblicazione: (2025)
di: Wang, Kangrui, et al.
Pubblicazione: (2025)
HY-Embodied-0.5: Embodied Foundation Models for Real-World Agents
di: X, Tencent Robotics, et al.
Pubblicazione: (2026)
di: X, Tencent Robotics, et al.
Pubblicazione: (2026)
EmbodiedOcc++: Boosting Embodied 3D Occupancy Prediction with Plane Regularization and Uncertainty Sampler
di: Wang, Hao, et al.
Pubblicazione: (2025)
di: Wang, Hao, et al.
Pubblicazione: (2025)
OceanGym: A Benchmark Environment for Underwater Embodied Agents
di: Xue, Yida, et al.
Pubblicazione: (2025)
di: Xue, Yida, et al.
Pubblicazione: (2025)
3DGen-Bench: Comprehensive Benchmark Suite for 3D Generative Models
di: Zhang, Yuhan, et al.
Pubblicazione: (2025)
di: Zhang, Yuhan, et al.
Pubblicazione: (2025)
UWBench: A Comprehensive Vision-Language Benchmark for Underwater Understanding
di: Zhang, Da, et al.
Pubblicazione: (2025)
di: Zhang, Da, et al.
Pubblicazione: (2025)
PALM-Bench: A Comprehensive Benchmark for Personalized Audio-Language Models
di: Wang, Yuwen, et al.
Pubblicazione: (2026)
di: Wang, Yuwen, et al.
Pubblicazione: (2026)
RescueBench: Can Embodied Agents Save Lives in the Wild ?
di: Wu, Kui, et al.
Pubblicazione: (2026)
di: Wu, Kui, et al.
Pubblicazione: (2026)
PersONAL: Towards a Comprehensive Benchmark for Personalized Embodied Agents
di: Ziliotto, Filippo, et al.
Pubblicazione: (2025)
di: Ziliotto, Filippo, et al.
Pubblicazione: (2025)
Vlaser: Vision-Language-Action Model with Synergistic Embodied Reasoning
di: Yang, Ganlin, et al.
Pubblicazione: (2025)
di: Yang, Ganlin, et al.
Pubblicazione: (2025)
FinChart-Bench: Benchmarking Financial Chart Comprehension in Vision-Language Models
di: Shu, Dong, et al.
Pubblicazione: (2025)
di: Shu, Dong, et al.
Pubblicazione: (2025)
Beyond Description: Cognitively Benchmarking Fine-Grained Action for Embodied Agents
di: Liu, Dayong, et al.
Pubblicazione: (2025)
di: Liu, Dayong, et al.
Pubblicazione: (2025)
Learning from Trials and Errors: Reflective Test-Time Planning for Embodied LLMs
di: Hong, Yining, et al.
Pubblicazione: (2026)
di: Hong, Yining, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Embodied Agent Interface: Benchmarking LLMs for Embodied Decision Making
di: Li, Manling, et al.
Pubblicazione: (2024) -
ENACT: Evaluating Embodied Cognition with World Modeling of Egocentric Interaction
di: Wang, Qineng, et al.
Pubblicazione: (2025) -
Embodied3DBench: Benchmarking Low-Level Embodied Spatial Intelligence of Vision Language Models
di: Zhang, Jiyao, et al.
Pubblicazione: (2026) -
ERA: Transforming VLMs into Embodied Agents via Embodied Prior Learning and Online Reinforcement Learning
di: Chen, Hanyang, et al.
Pubblicazione: (2025) -
BEAT: Visual Backdoor Attacks on VLM-based Embodied Agents via Contrastive Trigger Learning
di: Zhan, Qiusi, et al.
Pubblicazione: (2025)