Beyond Description: Cognitively Benchmarking Fine-Grained Action for Embodied Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Dayong, Xu, Chao, Chen, Weihong, Zhang, Suyu, Wang, Juncheng, Deng, Jiankang, Sun, Baigui, Liu, Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Embodied Navigation with Auxiliary Task of Action Description Prediction
di: Kondoh, Haru, et al.
Pubblicazione: (2025)
di: Kondoh, Haru, et al.
Pubblicazione: (2025)
Robo-Cortex: A Self-Evolving Embodied Agent via Dual-Grain Cognitive Memory and Autonomous Knowledge Induction
di: Chan, Nga Teng, et al.
Pubblicazione: (2026)
di: Chan, Nga Teng, et al.
Pubblicazione: (2026)
RoboView-Bias: Benchmarking Visual Bias in Embodied Agents for Robotic Manipulation
di: Liu, Enguang, et al.
Pubblicazione: (2025)
di: Liu, Enguang, et al.
Pubblicazione: (2025)
Fine-Grained Action Segmentation for Renorrhaphy in Robot-Assisted Partial Nephrectomy
di: Dai, Jiaheng, et al.
Pubblicazione: (2026)
di: Dai, Jiaheng, et al.
Pubblicazione: (2026)
The Yes-Man Syndrome: Benchmarking Abstention in Embodied Robotic Agents
di: Yeke, Doguhan, et al.
Pubblicazione: (2026)
di: Yeke, Doguhan, et al.
Pubblicazione: (2026)
RoboTidy : A 3D Gaussian Splatting Household Tidying Benchmark for Embodied Navigation and Action
di: Sun, Xiaoquan, et al.
Pubblicazione: (2025)
di: Sun, Xiaoquan, et al.
Pubblicazione: (2025)
DualVLA: Building a Generalizable Embodied Agent via Partial Decoupling of Reasoning and Action
di: Fang, Zhen, et al.
Pubblicazione: (2025)
di: Fang, Zhen, et al.
Pubblicazione: (2025)
VLNVerse: A Benchmark for Vision-Language Navigation with Versatile, Embodied, Realistic Simulation and Evaluation
di: Lin, Sihao, et al.
Pubblicazione: (2025)
di: Lin, Sihao, et al.
Pubblicazione: (2025)
FindingDory: A Benchmark to Evaluate Memory in Embodied Agents
di: Yadav, Karmesh, et al.
Pubblicazione: (2025)
di: Yadav, Karmesh, et al.
Pubblicazione: (2025)
From Imagined Futures to Executable Actions: Mixture of Latent Actions for Robot Manipulation
di: Li, Yajie, et al.
Pubblicazione: (2026)
di: Li, Yajie, et al.
Pubblicazione: (2026)
Embodied Image Captioning: Self-supervised Learning Agents for Spatially Coherent Image Descriptions
di: Galliena, Tommaso, et al.
Pubblicazione: (2025)
di: Galliena, Tommaso, et al.
Pubblicazione: (2025)
NavAgent: Multi-scale Urban Street View Fusion For UAV Embodied Vision-and-Language Navigation
di: Liu, Youzhi, et al.
Pubblicazione: (2024)
di: Liu, Youzhi, et al.
Pubblicazione: (2024)
PersONAL: Towards a Comprehensive Benchmark for Personalized Embodied Agents
di: Ziliotto, Filippo, et al.
Pubblicazione: (2025)
di: Ziliotto, Filippo, et al.
Pubblicazione: (2025)
Guide, Think, Act: Interactive Embodied Reasoning in Vision-Language-Action Models
di: Ling, Yiran, et al.
Pubblicazione: (2026)
di: Ling, Yiran, et al.
Pubblicazione: (2026)
VAG: Dual-Stream Video-Action Generation for Embodied Data Synthesis
di: Lang, Xiaolei, et al.
Pubblicazione: (2026)
di: Lang, Xiaolei, et al.
Pubblicazione: (2026)
Universal Actions for Enhanced Embodied Foundation Models
di: Zheng, Jinliang, et al.
Pubblicazione: (2025)
di: Zheng, Jinliang, et al.
Pubblicazione: (2025)
EnerVerse-AC: Envisioning Embodied Environments with Action Condition
di: Jiang, Yuxin, et al.
Pubblicazione: (2025)
di: Jiang, Yuxin, et al.
Pubblicazione: (2025)
Embodied3DBench: Benchmarking Low-Level Embodied Spatial Intelligence of Vision Language Models
di: Zhang, Jiyao, et al.
Pubblicazione: (2026)
di: Zhang, Jiyao, et al.
Pubblicazione: (2026)
Uni-LaViRA: Language-Vision-Robot Actions Translation for Unified Embodied Navigation
di: Ding, Hongyu, et al.
Pubblicazione: (2026)
di: Ding, Hongyu, et al.
Pubblicazione: (2026)
TransFace++: Rethinking the Face Recognition Paradigm with a Focus on Accuracy, Efficiency, and Security
di: Dan, Jun, et al.
Pubblicazione: (2023)
di: Dan, Jun, et al.
Pubblicazione: (2023)
Towards Long-horizon Embodied Agents with Tool-Aligned Vision-Language-Action Models
di: Lei, Zixing, et al.
Pubblicazione: (2026)
di: Lei, Zixing, et al.
Pubblicazione: (2026)
TryOn-Adapter: Efficient Fine-Grained Clothing Identity Adaptation for High-Fidelity Virtual Try-On
di: Xing, Jiazheng, et al.
Pubblicazione: (2024)
di: Xing, Jiazheng, et al.
Pubblicazione: (2024)
FineCog-Nav: Integrating Fine-grained Cognitive Modules for Zero-shot Multimodal UAV Navigation
di: Shao, Dian, et al.
Pubblicazione: (2026)
di: Shao, Dian, et al.
Pubblicazione: (2026)
RoboAgent: Chaining Basic Capabilities for Embodied Task Planning
di: Xu, Peiran, et al.
Pubblicazione: (2026)
di: Xu, Peiran, et al.
Pubblicazione: (2026)
UAV-ON: A Benchmark for Open-World Object Goal Navigation with Aerial Agents
di: Xiao, Jianqiang, et al.
Pubblicazione: (2025)
di: Xiao, Jianqiang, et al.
Pubblicazione: (2025)
MemoryVLA: Perceptual-Cognitive Memory in Vision-Language-Action Models for Robotic Manipulation
di: Shi, Hao, et al.
Pubblicazione: (2025)
di: Shi, Hao, et al.
Pubblicazione: (2025)
UAV-Track VLA: Embodied Aerial Tracking via Vision-Language-Action Models
di: Zhang, Qiyao, et al.
Pubblicazione: (2026)
di: Zhang, Qiyao, et al.
Pubblicazione: (2026)
Embodied Agents for Efficient Exploration and Smart Scene Description
di: Bigazzi, Roberto, et al.
Pubblicazione: (2023)
di: Bigazzi, Roberto, et al.
Pubblicazione: (2023)
RoboSafe: Safeguarding Embodied Agents via Executable Safety Logic
di: Wang, Le, et al.
Pubblicazione: (2025)
di: Wang, Le, et al.
Pubblicazione: (2025)
World Action Models: The Next Frontier in Embodied AI
di: Wang, Siyin, et al.
Pubblicazione: (2026)
di: Wang, Siyin, et al.
Pubblicazione: (2026)
Beyond Binary Success: A Diagnostic Meta-Evaluation Framework for Fine-Grained Manipulation
di: Xu, He-Yang, et al.
Pubblicazione: (2026)
di: Xu, He-Yang, et al.
Pubblicazione: (2026)
Expand Your SCOPE: Semantic Cognition over Potential-Based Exploration for Embodied Visual Navigation
di: Wang, Ningnan, et al.
Pubblicazione: (2025)
di: Wang, Ningnan, et al.
Pubblicazione: (2025)
An Anatomy of Vision-Language-Action Models: From Modules to Milestones and Challenges
di: Xu, Chao, et al.
Pubblicazione: (2025)
di: Xu, Chao, et al.
Pubblicazione: (2025)
Arcadia: Toward a Full-Lifecycle Framework for Embodied Lifelong Learning
di: Gao, Minghe, et al.
Pubblicazione: (2025)
di: Gao, Minghe, et al.
Pubblicazione: (2025)
Beyond Talking -- Generating Holistic 3D Human Dyadic Motion for Communication
di: Sun, Mingze, et al.
Pubblicazione: (2024)
di: Sun, Mingze, et al.
Pubblicazione: (2024)
Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain
di: Luo, Yulin, et al.
Pubblicazione: (2025)
di: Luo, Yulin, et al.
Pubblicazione: (2025)
From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding
di: Halacheva, Anna-Maria, et al.
Pubblicazione: (2025)
di: Halacheva, Anna-Maria, et al.
Pubblicazione: (2025)
EmbodiedGen: Towards a Generative 3D World Engine for Embodied Intelligence
di: Wang, Xinjie, et al.
Pubblicazione: (2025)
di: Wang, Xinjie, et al.
Pubblicazione: (2025)
Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks
di: Zhang, Jiazhao, et al.
Pubblicazione: (2024)
di: Zhang, Jiazhao, et al.
Pubblicazione: (2024)
SKIP: Sparse Keyframe Interpolation Paradigm for Efficient Embodied World Models
di: He, Ziheng, et al.
Pubblicazione: (2026)
di: He, Ziheng, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Embodied Navigation with Auxiliary Task of Action Description Prediction
di: Kondoh, Haru, et al.
Pubblicazione: (2025) -
Robo-Cortex: A Self-Evolving Embodied Agent via Dual-Grain Cognitive Memory and Autonomous Knowledge Induction
di: Chan, Nga Teng, et al.
Pubblicazione: (2026) -
RoboView-Bias: Benchmarking Visual Bias in Embodied Agents for Robotic Manipulation
di: Liu, Enguang, et al.
Pubblicazione: (2025) -
Fine-Grained Action Segmentation for Renorrhaphy in Robot-Assisted Partial Nephrectomy
di: Dai, Jiaheng, et al.
Pubblicazione: (2026) -
The Yes-Man Syndrome: Benchmarking Abstention in Embodied Robotic Agents
di: Yeke, Doguhan, et al.
Pubblicazione: (2026)