ManiTaskGen: A Comprehensive Task Generator for Benchmarking and Improving Vision-Language Agents on Embodied Decision-Making
Fuente:
arXiv
Salvato in:
| Autori principali: | Dai, Liu, Wang, Haina, Wan, Weikang, Su, Hao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Embodied Agent Interface: Benchmarking LLMs for Embodied Decision Making
di: Li, Manling, et al.
Pubblicazione: (2024)
di: Li, Manling, et al.
Pubblicazione: (2024)
LogicEnvGen: Task-Logic Driven Generation of Diverse Simulated Environments for Embodied AI
di: Wang, Jianan, et al.
Pubblicazione: (2026)
di: Wang, Jianan, et al.
Pubblicazione: (2026)
ManiSkill-HAB: A Benchmark for Low-Level Manipulation in Home Rearrangement Tasks
di: Shukla, Arth, et al.
Pubblicazione: (2024)
di: Shukla, Arth, et al.
Pubblicazione: (2024)
SafeAgentBench: A Benchmark for Safe Task Planning of Embodied LLM Agents
di: Yin, Sheng, et al.
Pubblicazione: (2024)
di: Yin, Sheng, et al.
Pubblicazione: (2024)
Collective Decision-Making on Task Allocation Feasibility
di: Fuady, Samratul, et al.
Pubblicazione: (2024)
di: Fuady, Samratul, et al.
Pubblicazione: (2024)
Affordance-Graphed Task Worlds: Self-Evolving Task Generation for Scalable Embodied Learning
di: Liu, Xiang, et al.
Pubblicazione: (2026)
di: Liu, Xiang, et al.
Pubblicazione: (2026)
SVLL: Staged Vision-Language Learning for Physically Grounded Embodied Task Planning
di: Yang, Yuyuan, et al.
Pubblicazione: (2026)
di: Yang, Yuyuan, et al.
Pubblicazione: (2026)
EmbodiedGen: Towards a Generative 3D World Engine for Embodied Intelligence
di: Wang, Xinjie, et al.
Pubblicazione: (2025)
di: Wang, Xinjie, et al.
Pubblicazione: (2025)
LoHoVLA: A Unified Vision-Language-Action Model for Long-Horizon Embodied Tasks
di: Yang, Yi, et al.
Pubblicazione: (2025)
di: Yang, Yi, et al.
Pubblicazione: (2025)
BEDI: A Comprehensive Benchmark for Evaluating Embodied Agents on UAVs
di: Guo, Mingning, et al.
Pubblicazione: (2025)
di: Guo, Mingning, et al.
Pubblicazione: (2025)
Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks
di: Zhang, Jiazhao, et al.
Pubblicazione: (2024)
di: Zhang, Jiazhao, et al.
Pubblicazione: (2024)
PARTNR: A Benchmark for Planning and Reasoning in Embodied Multi-agent Tasks
di: Chang, Matthew, et al.
Pubblicazione: (2024)
di: Chang, Matthew, et al.
Pubblicazione: (2024)
ContextFlow: Hierarchical Task-State Alignment for Long-Horizon Embodied Agents
di: Guo, Shuhan, et al.
Pubblicazione: (2026)
di: Guo, Shuhan, et al.
Pubblicazione: (2026)
ManiBox: Enhancing Embodied Spatial Generalization via Scalable Simulation Data Generations
di: Tan, Hengkai, et al.
Pubblicazione: (2024)
di: Tan, Hengkai, et al.
Pubblicazione: (2024)
Fourier Controller Networks for Real-Time Decision-Making in Embodied Learning
di: Tan, Hengkai, et al.
Pubblicazione: (2024)
di: Tan, Hengkai, et al.
Pubblicazione: (2024)
Large Model Empowered Embodied AI: A Survey on Decision-Making and Embodied Learning
di: Liang, Wenlong, et al.
Pubblicazione: (2025)
di: Liang, Wenlong, et al.
Pubblicazione: (2025)
Embodied3DBench: Benchmarking Low-Level Embodied Spatial Intelligence of Vision Language Models
di: Zhang, Jiyao, et al.
Pubblicazione: (2026)
di: Zhang, Jiyao, et al.
Pubblicazione: (2026)
LTLCodeGen: Code Generation of Syntactically Correct Temporal Logic for Robot Task Planning
di: Rabiei, Behrad, et al.
Pubblicazione: (2025)
di: Rabiei, Behrad, et al.
Pubblicazione: (2025)
The Great March 100: 100 Detail-oriented Tasks for Evaluating Embodied AI Agents
di: Wang, Ziyu, et al.
Pubblicazione: (2026)
di: Wang, Ziyu, et al.
Pubblicazione: (2026)
Beyond Text: Utilizing Vocal Cues to Improve Decision Making in LLMs for Robot Navigation Tasks
di: Sun, Xingpeng, et al.
Pubblicazione: (2024)
di: Sun, Xingpeng, et al.
Pubblicazione: (2024)
V-CAGE: Context-Aware Generation and Verification for Scalable Long-Horizon Embodied Tasks
di: Liu, Yaru, et al.
Pubblicazione: (2026)
di: Liu, Yaru, et al.
Pubblicazione: (2026)
Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain
di: Luo, Yulin, et al.
Pubblicazione: (2025)
di: Luo, Yulin, et al.
Pubblicazione: (2025)
TANGO: Training-free Embodied AI Agents for Open-world Tasks
di: Ziliotto, Filippo, et al.
Pubblicazione: (2024)
di: Ziliotto, Filippo, et al.
Pubblicazione: (2024)
CLEA: Closed-Loop Embodied Agent for Enhancing Task Execution in Dynamic Environments
di: Lei, Mingcong, et al.
Pubblicazione: (2025)
di: Lei, Mingcong, et al.
Pubblicazione: (2025)
ET-Plan-Bench: Embodied Task-level Planning Benchmark Towards Spatial-Temporal Cognition with Foundation Models
di: Zhang, Lingfeng, et al.
Pubblicazione: (2024)
di: Zhang, Lingfeng, et al.
Pubblicazione: (2024)
EmbodiedBrain: Expanding Performance Boundaries of Task Planning for Embodied Intelligence
di: Zou, Ding, et al.
Pubblicazione: (2025)
di: Zou, Ding, et al.
Pubblicazione: (2025)
RoboAgent: Chaining Basic Capabilities for Embodied Task Planning
di: Xu, Peiran, et al.
Pubblicazione: (2026)
di: Xu, Peiran, et al.
Pubblicazione: (2026)
FOUNDER: Grounding Foundation Models in World Models for Open-Ended Embodied Decision Making
di: Wang, Yucen, et al.
Pubblicazione: (2025)
di: Wang, Yucen, et al.
Pubblicazione: (2025)
Benchmarking Vision, Language, & Action Models on Robotic Learning Tasks
di: Guruprasad, Pranav, et al.
Pubblicazione: (2024)
di: Guruprasad, Pranav, et al.
Pubblicazione: (2024)
HELP: Hierarchical Embodied Language Planner for Household Tasks
di: Korchemnyi, Alexandr V., et al.
Pubblicazione: (2025)
di: Korchemnyi, Alexandr V., et al.
Pubblicazione: (2025)
MomaGraph: State-Aware Unified Scene Graphs with Vision-Language Model for Embodied Task Planning
di: Ju, Yuanchen, et al.
Pubblicazione: (2025)
di: Ju, Yuanchen, et al.
Pubblicazione: (2025)
LLM-Driven Self-Refinement for Embodied Drone Task Planning
di: Zhang, Deyu, et al.
Pubblicazione: (2025)
di: Zhang, Deyu, et al.
Pubblicazione: (2025)
RealMirror: A Comprehensive, Open-Source Vision-Language-Action Platform for Embodied AI
di: Tai, Cong, et al.
Pubblicazione: (2025)
di: Tai, Cong, et al.
Pubblicazione: (2025)
ManiPose: A Comprehensive Benchmark for Pose-aware Object Manipulation in Robotics
di: Yu, Qiaojun, et al.
Pubblicazione: (2024)
di: Yu, Qiaojun, et al.
Pubblicazione: (2024)
ROVER: Recursive Reasoning Over Videos with Vision-Language Models for Embodied Tasks
di: Schroeder, Philip, et al.
Pubblicazione: (2025)
di: Schroeder, Philip, et al.
Pubblicazione: (2025)
NORA: A Small Open-Sourced Generalist Vision Language Action Model for Embodied Tasks
di: Hung, Chia-Yu, et al.
Pubblicazione: (2025)
di: Hung, Chia-Yu, et al.
Pubblicazione: (2025)
Embodied Interpretability: Linking Causal Understanding to Generalization in Vision-Language-Action Models
di: Zhang, Hanxin, et al.
Pubblicazione: (2026)
di: Zhang, Hanxin, et al.
Pubblicazione: (2026)
OMNI-PoseX: A Fast Vision Model for 6D Object Pose Estimation in Embodied Tasks
di: Zhang, Michael, et al.
Pubblicazione: (2026)
di: Zhang, Michael, et al.
Pubblicazione: (2026)
EmboMatrix: A Scalable Training-Ground for Embodied Decision-Making
di: Lei, Zixing, et al.
Pubblicazione: (2025)
di: Lei, Zixing, et al.
Pubblicazione: (2025)
AGENTSAFE: Benchmarking the Safety of Embodied Agents on Hazardous Instructions
di: Ying, Zonghao, et al.
Pubblicazione: (2025)
di: Ying, Zonghao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Embodied Agent Interface: Benchmarking LLMs for Embodied Decision Making
di: Li, Manling, et al.
Pubblicazione: (2024) -
LogicEnvGen: Task-Logic Driven Generation of Diverse Simulated Environments for Embodied AI
di: Wang, Jianan, et al.
Pubblicazione: (2026) -
ManiSkill-HAB: A Benchmark for Low-Level Manipulation in Home Rearrangement Tasks
di: Shukla, Arth, et al.
Pubblicazione: (2024) -
SafeAgentBench: A Benchmark for Safe Task Planning of Embodied LLM Agents
di: Yin, Sheng, et al.
Pubblicazione: (2024) -
Collective Decision-Making on Task Allocation Feasibility
di: Fuady, Samratul, et al.
Pubblicazione: (2024)