OmniEVA: Embodied Versatile Planner via Task-Adaptive 3D-Grounded and Embodiment-aware Reasoning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Liu, Yuecheng, Chi, Dafeng, Wu, Shiguang, Zhang, Zhanguang, Zhuang, Yuzheng, Yang, Bowen, Zhu, He, Zhang, Lingfeng, Xie, Pengwei, Bravo, David Gamaliel Arcos, Zhang, Yingxue, Hao, Jianye, Quan, Xingyue |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
EVLP:Learning Unified Embodied Vision-Language Planner with Reinforced Supervised Fine-Tuning
von: Cai, Xinyan, et al.
Veröffentlicht: (2025)
von: Cai, Xinyan, et al.
Veröffentlicht: (2025)
ET-Plan-Bench: Embodied Task-level Planning Benchmark Towards Spatial-Temporal Cognition with Foundation Models
von: Zhang, Lingfeng, et al.
Veröffentlicht: (2024)
von: Zhang, Lingfeng, et al.
Veröffentlicht: (2024)
SpatialCoT: Advancing Spatial Reasoning through Coordinate Alignment and Chain-of-Thought for Embodied Task Planning
von: Liu, Yuecheng, et al.
Veröffentlicht: (2025)
von: Liu, Yuecheng, et al.
Veröffentlicht: (2025)
Mem2Ego: Empowering Vision-Language Models with Global-to-Ego Memory for Long-Horizon Embodied Navigation
von: Zhang, Lingfeng, et al.
Veröffentlicht: (2025)
von: Zhang, Lingfeng, et al.
Veröffentlicht: (2025)
Astra: Efficient Transformer Architecture and Contrastive Dynamics Learning for Embodied Instruction Following
von: Ma, Yueen, et al.
Veröffentlicht: (2024)
von: Ma, Yueen, et al.
Veröffentlicht: (2024)
AutoLayout: Closed-Loop Layout Synthesis via Slow-Fast Collaborative Reasoning
von: Chen, Weixing, et al.
Veröffentlicht: (2025)
von: Chen, Weixing, et al.
Veröffentlicht: (2025)
Self-CriTeach: LLM Self-Teaching and Self-Critiquing for Improving Robotic Planning via Automated Domain Generation
von: Huang, Jinbang, et al.
Veröffentlicht: (2025)
von: Huang, Jinbang, et al.
Veröffentlicht: (2025)
Embodied Arena: A Comprehensive, Unified, and Evolving Evaluation Platform for Embodied AI
von: Ni, Fei, et al.
Veröffentlicht: (2025)
von: Ni, Fei, et al.
Veröffentlicht: (2025)
One Demo Is All It Takes: Planning Domain Derivation with LLMs from A Single Demonstration
von: Huang, Jinbang, et al.
Veröffentlicht: (2025)
von: Huang, Jinbang, et al.
Veröffentlicht: (2025)
More than A Point: Capturing Uncertainty with Adaptive Affordance Heatmaps for Spatial Grounding in Robotic Tasks
von: Shao, Xinyu, et al.
Veröffentlicht: (2025)
von: Shao, Xinyu, et al.
Veröffentlicht: (2025)
A Survey on Vision-Language-Action Models for Embodied AI
von: Ma, Yueen, et al.
Veröffentlicht: (2024)
von: Ma, Yueen, et al.
Veröffentlicht: (2024)
H-WM: Robotic Task and Motion Planning Guided by Hierarchical World Model
von: Huang, Jinbang, et al.
Veröffentlicht: (2026)
von: Huang, Jinbang, et al.
Veröffentlicht: (2026)
Do World Action Models Generalize Better than VLAs? A Robustness Study
von: Zhang, Zhanguang, et al.
Veröffentlicht: (2026)
von: Zhang, Zhanguang, et al.
Veröffentlicht: (2026)
HardCore Generation: Generating Hard UNSAT Problems for Data Augmentation
von: Cotnareanu, Joseph, et al.
Veröffentlicht: (2024)
von: Cotnareanu, Joseph, et al.
Veröffentlicht: (2024)
The Graph's Apprentice: Teaching an LLM Low Level Knowledge for Circuit Quality Estimation
von: Moravej, Reza, et al.
Veröffentlicht: (2024)
von: Moravej, Reza, et al.
Veröffentlicht: (2024)
3D-MoE: A Mixture-of-Experts Multi-modal LLM for 3D Vision and Pose Diffusion via Rectified Flow
von: Ma, Yueen, et al.
Veröffentlicht: (2025)
von: Ma, Yueen, et al.
Veröffentlicht: (2025)
E2ESlack: An End-to-End Graph-Based Framework for Pre-Routing Slack Prediction
von: Bodhe, Saurabh, et al.
Veröffentlicht: (2025)
von: Bodhe, Saurabh, et al.
Veröffentlicht: (2025)
Learnable Behavior Control: Breaking Atari Human World Records via Sample-Efficient Behavior Selection
von: Fan, Jiajun, et al.
Veröffentlicht: (2023)
von: Fan, Jiajun, et al.
Veröffentlicht: (2023)
EVA: An Embodied World Model for Future Video Anticipation
von: Chi, Xiaowei, et al.
Veröffentlicht: (2024)
von: Chi, Xiaowei, et al.
Veröffentlicht: (2024)
GraSS: Combining Graph Neural Networks with Expert Knowledge for SAT Solver Selection
von: Zhang, Zhanguang, et al.
Veröffentlicht: (2024)
von: Zhang, Zhanguang, et al.
Veröffentlicht: (2024)
RoboOS: A Hierarchical Embodied Framework for Cross-Embodiment and Multi-Agent Collaboration
von: Tan, Huajie, et al.
Veröffentlicht: (2025)
von: Tan, Huajie, et al.
Veröffentlicht: (2025)
VOLTA: Improving Generative Diversity by Variational Mutual Information Maximizing Autoencoder
von: Ma, Yueen, et al.
Veröffentlicht: (2023)
von: Ma, Yueen, et al.
Veröffentlicht: (2023)
Hindsight Planner: A Closed-Loop Few-Shot Planner for Embodied Instruction Following
von: Yang, Yuxiao, et al.
Veröffentlicht: (2024)
von: Yang, Yuxiao, et al.
Veröffentlicht: (2024)
Evolution-aware VAriance (EVA) Coreset Selection for Medical Image Classification
von: Hong, Yuxin, et al.
Veröffentlicht: (2024)
von: Hong, Yuxin, et al.
Veröffentlicht: (2024)
SCALE: Self-Correcting Visual Navigation for Mobile Robots via Anti-Novelty Estimation
von: Chen, Chang, et al.
Veröffentlicht: (2024)
von: Chen, Chang, et al.
Veröffentlicht: (2024)
EVA: Editing for Versatile Alignment against Jailbreaks
von: Wang, Yi, et al.
Veröffentlicht: (2026)
von: Wang, Yi, et al.
Veröffentlicht: (2026)
Omni-Thinker: Scaling Multi-Task RL in LLMs with Hybrid Reward and Task Scheduling
von: Li, Derek, et al.
Veröffentlicht: (2025)
von: Li, Derek, et al.
Veröffentlicht: (2025)
Text‐to‐3D City: Plan‐then‐Execute Urban Generation With LLM Planners and Procedural Synthesis
von: Xiaohang Dong, et al.
Veröffentlicht: (2026)
von: Xiaohang Dong, et al.
Veröffentlicht: (2026)
Omni-3DEdit: Generalized Versatile 3D Editing in One-Pass
von: Liyi, Chen, et al.
Veröffentlicht: (2026)
von: Liyi, Chen, et al.
Veröffentlicht: (2026)
DAP: A Discrete-token Autoregressive Planner for Autonomous Driving
von: Ye, Bowen, et al.
Veröffentlicht: (2025)
von: Ye, Bowen, et al.
Veröffentlicht: (2025)
When Engineering Outruns Intelligence: Rethinking Instruction-Guided Navigation
von: Aghaei, Matin, et al.
Veröffentlicht: (2025)
von: Aghaei, Matin, et al.
Veröffentlicht: (2025)
$\mathcal{P}^3$: Toward Versatile Embodied Agents
von: Zhou, Shengli, et al.
Veröffentlicht: (2025)
von: Zhou, Shengli, et al.
Veröffentlicht: (2025)
Uncertainty-Aware Gaussian Map for Vision-Language Navigation
von: Gao, Jianzhe, et al.
Veröffentlicht: (2026)
von: Gao, Jianzhe, et al.
Veröffentlicht: (2026)
OmniGuard: Hybrid Manipulation Localization via Augmented Versatile Deep Image Watermarking
von: Zhang, Xuanyu, et al.
Veröffentlicht: (2024)
von: Zhang, Xuanyu, et al.
Veröffentlicht: (2024)
CUTE-Planner: Confidence-aware Uneven Terrain Exploration Planner
von: Park, Miryeong, et al.
Veröffentlicht: (2025)
von: Park, Miryeong, et al.
Veröffentlicht: (2025)
Task-Agnostic Pre-training and Task-Guided Fine-tuning for Versatile Diffusion Planner
von: Fan, Chenyou, et al.
Veröffentlicht: (2024)
von: Fan, Chenyou, et al.
Veröffentlicht: (2024)
EVA-CLIP-18B: Scaling CLIP to 18 Billion Parameters
von: Sun, Quan, et al.
Veröffentlicht: (2024)
von: Sun, Quan, et al.
Veröffentlicht: (2024)
Socratic Planner: Self-QA-Based Zero-Shot Planning for Embodied Instruction Following
von: Shin, Suyeon, et al.
Veröffentlicht: (2024)
von: Shin, Suyeon, et al.
Veröffentlicht: (2024)
OmniHumanoid: Streaming Cross-Embodiment Video Generation with Paired-Free Adaptation
von: Song, Yiren, et al.
Veröffentlicht: (2026)
von: Song, Yiren, et al.
Veröffentlicht: (2026)
OmniSAT: Compact Action Token, Faster Auto Regression
von: Lyu, Huaihai, et al.
Veröffentlicht: (2025)
von: Lyu, Huaihai, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
EVLP:Learning Unified Embodied Vision-Language Planner with Reinforced Supervised Fine-Tuning
von: Cai, Xinyan, et al.
Veröffentlicht: (2025) -
ET-Plan-Bench: Embodied Task-level Planning Benchmark Towards Spatial-Temporal Cognition with Foundation Models
von: Zhang, Lingfeng, et al.
Veröffentlicht: (2024) -
SpatialCoT: Advancing Spatial Reasoning through Coordinate Alignment and Chain-of-Thought for Embodied Task Planning
von: Liu, Yuecheng, et al.
Veröffentlicht: (2025) -
Mem2Ego: Empowering Vision-Language Models with Global-to-Ego Memory for Long-Horizon Embodied Navigation
von: Zhang, Lingfeng, et al.
Veröffentlicht: (2025) -
Astra: Efficient Transformer Architecture and Contrastive Dynamics Learning for Embodied Instruction Following
von: Ma, Yueen, et al.
Veröffentlicht: (2024)