Grounded World Model for Semantically Generalizable Planning
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Quanyi, Feng, Lan, Zhang, Haonan, Li, Wuyang, Wang, Letian, Alahi, Alexandre, Soh, Harold |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
RAP: 3D Rasterization Augmented End-to-End Planning
por: Feng, Lan, et al.
Publicado: (2025)
por: Feng, Lan, et al.
Publicado: (2025)
Action Hallucination in Generative Vision-Language-Action Models
por: Soh, Harold, et al.
Publicado: (2026)
por: Soh, Harold, et al.
Publicado: (2026)
GeNIE: A Generalizable Navigation System for In-the-Wild Environments
por: Wang, Jiaming, et al.
Publicado: (2025)
por: Wang, Jiaming, et al.
Publicado: (2025)
Demonstrating the Octopi-1.5 Visual-Tactile-Language Model
por: Yu, Samson, et al.
Publicado: (2025)
por: Yu, Samson, et al.
Publicado: (2025)
GenNBV: Generalizable Next-Best-View Policy for Active 3D Reconstruction
por: Chen, Xiao, et al.
Publicado: (2024)
por: Chen, Xiao, et al.
Publicado: (2024)
OpenNav: Open-World Navigation with Multimodal Large Language Models
por: Yuan, Mingfeng, et al.
Publicado: (2025)
por: Yuan, Mingfeng, et al.
Publicado: (2025)
Grounding Language Models with Semantic Digital Twins for Robotic Planning
por: Naeem, Mehreen, et al.
Publicado: (2025)
por: Naeem, Mehreen, et al.
Publicado: (2025)
GBPP: Grasp-Aware Base Placement Prediction for Robots via Two-Stage Learning
por: Chen, Jizhuo, et al.
Publicado: (2025)
por: Chen, Jizhuo, et al.
Publicado: (2025)
DriveDreamer-Policy: A Geometry-Grounded World-Action Model for Unified Generation and Planning
por: Zhou, Yang, et al.
Publicado: (2026)
por: Zhou, Yang, et al.
Publicado: (2026)
DyWA: Dynamics-adaptive World Action Model for Generalizable Non-prehensile Manipulation
por: Lyu, Jiangran, et al.
Publicado: (2025)
por: Lyu, Jiangran, et al.
Publicado: (2025)
SocRATES: Towards Automated Scenario-based Testing of Social Navigation Algorithms
por: Marpally, Shashank Rao, et al.
Publicado: (2024)
por: Marpally, Shashank Rao, et al.
Publicado: (2024)
GLEAM: Learning Generalizable Exploration Policy for Active Mapping in Complex 3D Indoor Scenes
por: Chen, Xiao, et al.
Publicado: (2025)
por: Chen, Xiao, et al.
Publicado: (2025)
SKIL: Semantic Keypoint Imitation Learning for Generalizable Data-efficient Manipulation
por: Wang, Shengjie, et al.
Publicado: (2025)
por: Wang, Shengjie, et al.
Publicado: (2025)
CHD: Coupled Hierarchical Diffusion for Long-Horizon Tasks
por: Hao, Ce, et al.
Publicado: (2025)
por: Hao, Ce, et al.
Publicado: (2025)
Fly0: Decoupling Semantic Grounding from Geometric Planning for Zero-Shot Aerial Navigation
por: Xu, Zhenxing, et al.
Publicado: (2026)
por: Xu, Zhenxing, et al.
Publicado: (2026)
Guided Streaming Stochastic Interpolant Policy
por: Jiang, Puming, et al.
Publicado: (2026)
por: Jiang, Puming, et al.
Publicado: (2026)
Diffusion Meets Options: Hierarchical Generative Skill Composition for Temporally-Extended Tasks
por: Feng, Zeyu, et al.
Publicado: (2024)
por: Feng, Zeyu, et al.
Publicado: (2024)
Hierarchical Language Models for Semantic Navigation and Manipulation in an Aerial-Ground Robotic System
por: Liu, Haokun, et al.
Publicado: (2025)
por: Liu, Haokun, et al.
Publicado: (2025)
AdaWM: Adaptive World Model based Planning for Autonomous Driving
por: Wang, Hang, et al.
Publicado: (2025)
por: Wang, Hang, et al.
Publicado: (2025)
Prismatic World Model: Learning Compositional Dynamics for Planning in Hybrid Systems
por: Li, Mingwei, et al.
Publicado: (2025)
por: Li, Mingwei, et al.
Publicado: (2025)
On The Planning Abilities of OpenAI's o1 Models: Feasibility, Optimality, and Generalizability
por: Wang, Kevin, et al.
Publicado: (2024)
por: Wang, Kevin, et al.
Publicado: (2024)
From Real World to Logic and Back: Learning Generalizable Relational Concepts For Long Horizon Robot Planning
por: Shah, Naman, et al.
Publicado: (2024)
por: Shah, Naman, et al.
Publicado: (2024)
Learning from Active Human Involvement through Proxy Value Propagation
por: Peng, Zhenghao, et al.
Publicado: (2025)
por: Peng, Zhenghao, et al.
Publicado: (2025)
Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation
por: Chen, Shizhe, et al.
Publicado: (2025)
por: Chen, Shizhe, et al.
Publicado: (2025)
Helvipad: A Real-World Dataset for Omnidirectional Stereo Depth Estimation
por: Zayene, Mehdi, et al.
Publicado: (2024)
por: Zayene, Mehdi, et al.
Publicado: (2024)
Forecast-PEFT: Parameter-Efficient Fine-Tuning for Pre-trained Motion Forecasting Models
por: Wang, Jifeng, et al.
Publicado: (2024)
por: Wang, Jifeng, et al.
Publicado: (2024)
Drift-Resistant Navigation World Model with Anchored Epipolar Guidance
por: Luan, Po-Chien, et al.
Publicado: (2026)
por: Luan, Po-Chien, et al.
Publicado: (2026)
A Multi-Loss Strategy for Vehicle Trajectory Prediction: Combining Off-Road, Diversity, and Directional Consistency Losses
por: Rahimi, Ahmad, et al.
Publicado: (2024)
por: Rahimi, Ahmad, et al.
Publicado: (2024)
Scalable Task Planning via Large Language Models and Structured World Representations
por: Pérez-Dattari, Rodrigo, et al.
Publicado: (2024)
por: Pérez-Dattari, Rodrigo, et al.
Publicado: (2024)
Rectified Schrödinger Bridge Matching for Few-Step Visual Navigation
por: Luan, Wuyang, et al.
Publicado: (2026)
por: Luan, Wuyang, et al.
Publicado: (2026)
Learning the Generalizable Manipulation Skills on Soft-body Tasks via Guided Self-attention Behavior Cloning Policy
por: Li, Xuetao, et al.
Publicado: (2024)
por: Li, Xuetao, et al.
Publicado: (2024)
NOD-TAMP: Generalizable Long-Horizon Planning with Neural Object Descriptors
por: Cheng, Shuo, et al.
Publicado: (2023)
por: Cheng, Shuo, et al.
Publicado: (2023)
VGGT-DP: Generalizable Robot Control via Vision Foundation Models
por: Ge, Shijia, et al.
Publicado: (2025)
por: Ge, Shijia, et al.
Publicado: (2025)
Semantic World Models
por: Berg, Jacob, et al.
Publicado: (2025)
por: Berg, Jacob, et al.
Publicado: (2025)
DoReMi: Grounding Language Model by Detecting and Recovering from Plan-Execution Misalignment
por: Guo, Yanjiang, et al.
Publicado: (2023)
por: Guo, Yanjiang, et al.
Publicado: (2023)
DKPROMPT: Domain Knowledge Prompting Vision-Language Models for Open-World Planning
por: Zhang, Xiaohan, et al.
Publicado: (2024)
por: Zhang, Xiaohan, et al.
Publicado: (2024)
DrivingGen: A Comprehensive Benchmark for Generative Video World Models in Autonomous Driving
por: Zhou, Yang, et al.
Publicado: (2026)
por: Zhou, Yang, et al.
Publicado: (2026)
EasyInsert: A Data-Efficient and Generalizable Insertion Policy
por: Li, Guanghe, et al.
Publicado: (2025)
por: Li, Guanghe, et al.
Publicado: (2025)
VLM-DEWM: Dynamic External World Model for Verifiable and Resilient Vision-Language Planning in Manufacturing
por: Tang, Guoqin, et al.
Publicado: (2026)
por: Tang, Guoqin, et al.
Publicado: (2026)
VLA Models Are More Generalizable Than You Think: Revisiting Physical and Spatial Modeling
por: Li, Weiqi, et al.
Publicado: (2025)
por: Li, Weiqi, et al.
Publicado: (2025)
Ejemplares similares
-
RAP: 3D Rasterization Augmented End-to-End Planning
por: Feng, Lan, et al.
Publicado: (2025) -
Action Hallucination in Generative Vision-Language-Action Models
por: Soh, Harold, et al.
Publicado: (2026) -
GeNIE: A Generalizable Navigation System for In-the-Wild Environments
por: Wang, Jiaming, et al.
Publicado: (2025) -
Demonstrating the Octopi-1.5 Visual-Tactile-Language Model
por: Yu, Samson, et al.
Publicado: (2025) -
GenNBV: Generalizable Next-Best-View Policy for Active 3D Reconstruction
por: Chen, Xiao, et al.
Publicado: (2024)