From Grounding to Manipulation: Case Studies of Foundation Model Integration in Embodied Robotic Systems
Fuente:
arXiv
Guardado en:
| Autores principales: | Sui, Xiuchao, Tian, Daiying, Sun, Qi, Chen, Ruirui, Choi, Dongkyu, Kwok, Kenneth, Poria, Soujanya |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Can-Do! A Dataset and Neuro-Symbolic Grounded Framework for Embodied Planning with Large Multimodal Models
por: Chia, Yew Ken, et al.
Publicado: (2024)
por: Chia, Yew Ken, et al.
Publicado: (2024)
Emma-X: An Embodied Multimodal Action Model with Grounded Chain of Thought and Look-ahead Spatial Reasoning
por: Sun, Qi, et al.
Publicado: (2024)
por: Sun, Qi, et al.
Publicado: (2024)
Explicit World Models for Reliable Human-Robot Collaboration
por: Kwok, Kenneth, et al.
Publicado: (2026)
por: Kwok, Kenneth, et al.
Publicado: (2026)
Embodied Robot Manipulation in the Era of Foundation Models: Planning and Learning Perspectives
por: Bai, Shuanghao, et al.
Publicado: (2025)
por: Bai, Shuanghao, et al.
Publicado: (2025)
NORA: A Small Open-Sourced Generalist Vision Language Action Model for Embodied Tasks
por: Hung, Chia-Yu, et al.
Publicado: (2025)
por: Hung, Chia-Yu, et al.
Publicado: (2025)
10 Open Challenges Steering the Future of Vision-Language-Action Models
por: Poria, Soujanya, et al.
Publicado: (2025)
por: Poria, Soujanya, et al.
Publicado: (2025)
The Developments and Challenges towards Dexterous and Embodied Robotic Manipulation: A Survey
por: Li, Gaofeng, et al.
Publicado: (2025)
por: Li, Gaofeng, et al.
Publicado: (2025)
Embodied Navigation Foundation Model
por: Zhang, Jiazhao, et al.
Publicado: (2025)
por: Zhang, Jiazhao, et al.
Publicado: (2025)
Empowering Embodied Manipulation: A Bimanual-Mobile Robot Manipulation Dataset for Household Tasks
por: Zhang, Tianle, et al.
Publicado: (2024)
por: Zhang, Tianle, et al.
Publicado: (2024)
Transforming Monolithic Foundation Models into Embodied Multi-Agent Architectures for Human-Robot Collaboration
por: Sun, Nan, et al.
Publicado: (2025)
por: Sun, Nan, et al.
Publicado: (2025)
LAGEA: Language Guided Embodied Agents for Robotic Manipulation
por: Chowdhury, Abdul Monaf, et al.
Publicado: (2025)
por: Chowdhury, Abdul Monaf, et al.
Publicado: (2025)
SAM2Act: Integrating Visual Foundation Model with A Memory Architecture for Robotic Manipulation
por: Fang, Haoquan, et al.
Publicado: (2025)
por: Fang, Haoquan, et al.
Publicado: (2025)
Homotopic Path Set Planning for Robot Manipulation and Navigation
por: Huang, Jing, et al.
Publicado: (2024)
por: Huang, Jing, et al.
Publicado: (2024)
A Survey on Robotics with Foundation Models: toward Embodied AI
por: Xu, Zhiyuan, et al.
Publicado: (2024)
por: Xu, Zhiyuan, et al.
Publicado: (2024)
EO-1: An Open Unified Embodied Foundation Model for General Robot Control
por: Qu, Delin, et al.
Publicado: (2025)
por: Qu, Delin, et al.
Publicado: (2025)
ManipulationNet: An Infrastructure for Benchmarking Real-World Robot Manipulation with Physical Skill Challenges and Embodied Multimodal Reasoning
por: Chen, Yiting, et al.
Publicado: (2026)
por: Chen, Yiting, et al.
Publicado: (2026)
What Foundation Models can Bring for Robot Learning in Manipulation : A Survey
por: Li, Dingzhe, et al.
Publicado: (2024)
por: Li, Dingzhe, et al.
Publicado: (2024)
Embodied Red Teaming for Auditing Robotic Foundation Models
por: Karnik, Sathwik, et al.
Publicado: (2024)
por: Karnik, Sathwik, et al.
Publicado: (2024)
Learning Instruction-Guided Manipulation Affordance via Large Models for Embodied Robotic Tasks
por: Li, Dayou, et al.
Publicado: (2024)
por: Li, Dayou, et al.
Publicado: (2024)
Transferring Foundation Models for Generalizable Robotic Manipulation
por: Yang, Jiange, et al.
Publicado: (2023)
por: Yang, Jiange, et al.
Publicado: (2023)
Hierarchical Language Models for Semantic Navigation and Manipulation in an Aerial-Ground Robotic System
por: Liu, Haokun, et al.
Publicado: (2025)
por: Liu, Haokun, et al.
Publicado: (2025)
Embodied-R1: Reinforced Embodied Reasoning for General Robotic Manipulation
por: Yuan, Yifu, et al.
Publicado: (2025)
por: Yuan, Yifu, et al.
Publicado: (2025)
Reinforced Embodied Planning with Verifiable Reward for Real-World Robotic Manipulation
por: Bo, Zitong, et al.
Publicado: (2025)
por: Bo, Zitong, et al.
Publicado: (2025)
Embodied Human Simulation for Quantitative Design and Analysis of Interactive Robotics
por: Zuo, Chenhui, et al.
Publicado: (2026)
por: Zuo, Chenhui, et al.
Publicado: (2026)
EmbodiedCoder: Parameterized Embodied Mobile Manipulation via Modern Coding Model
por: Lin, Zefu, et al.
Publicado: (2025)
por: Lin, Zefu, et al.
Publicado: (2025)
HiVLA: A Visual-Grounded-Centric Hierarchical Embodied Manipulation System
por: Yang, Tianshuo, et al.
Publicado: (2026)
por: Yang, Tianshuo, et al.
Publicado: (2026)
Language-Grounded Decoupled Action Representation for Robotic Manipulation
por: Weng, Wuding, et al.
Publicado: (2026)
por: Weng, Wuding, et al.
Publicado: (2026)
FOUNDER: Grounding Foundation Models in World Models for Open-Ended Embodied Decision Making
por: Wang, Yucen, et al.
Publicado: (2025)
por: Wang, Yucen, et al.
Publicado: (2025)
Closed Loop Interactive Embodied Reasoning for Robot Manipulation
por: Nazarczuk, Michal, et al.
Publicado: (2024)
por: Nazarczuk, Michal, et al.
Publicado: (2024)
Multi-Group Equivariant Augmentation for Reinforcement Learning in Robot Manipulation
por: Lin, Hongbin, et al.
Publicado: (2025)
por: Lin, Hongbin, et al.
Publicado: (2025)
RynnBrain: Open Embodied Foundation Models
por: Dang, Ronghao, et al.
Publicado: (2026)
por: Dang, Ronghao, et al.
Publicado: (2026)
An Atomic Skill Library Construction Method for Data-Efficient Embodied Manipulation
por: Li, Dongjiang, et al.
Publicado: (2025)
por: Li, Dongjiang, et al.
Publicado: (2025)
LocoVLM: Grounding Vision and Language for Adapting Versatile Legged Locomotion Policies
por: Nahrendra, I Made Aswin, et al.
Publicado: (2026)
por: Nahrendra, I Made Aswin, et al.
Publicado: (2026)
Intent at a Glance: Gaze-Guided Robotic Manipulation via Foundation Models
por: Tay, Tracey Yee Hsin, et al.
Publicado: (2026)
por: Tay, Tracey Yee Hsin, et al.
Publicado: (2026)
EHC-MM: Embodied Holistic Control for Mobile Manipulation
por: Wang, Jiawen, et al.
Publicado: (2024)
por: Wang, Jiawen, et al.
Publicado: (2024)
Towards Embodied Cognition in Robots via Spatially Grounded Synthetic Worlds
por: Currie, Joel, et al.
Publicado: (2025)
por: Currie, Joel, et al.
Publicado: (2025)
Instruction-Augmented Long-Horizon Planning: Embedding Grounding Mechanisms in Embodied Mobile Manipulation
por: Wang, Fangyuan, et al.
Publicado: (2025)
por: Wang, Fangyuan, et al.
Publicado: (2025)
SAM-E: Leveraging Visual Foundation Model with Sequence Imitation for Embodied Manipulation
por: Zhang, Junjie, et al.
Publicado: (2024)
por: Zhang, Junjie, et al.
Publicado: (2024)
Self-Improving Embodied Foundation Models
por: Ghasemipour, Seyed Kamyar Seyed, et al.
Publicado: (2025)
por: Ghasemipour, Seyed Kamyar Seyed, et al.
Publicado: (2025)
Embodied Learning of Reward for Musculoskeletal Control with Vision Language Models
por: Soedarmadji, Saraswati, et al.
Publicado: (2025)
por: Soedarmadji, Saraswati, et al.
Publicado: (2025)
Ejemplares similares
-
Can-Do! A Dataset and Neuro-Symbolic Grounded Framework for Embodied Planning with Large Multimodal Models
por: Chia, Yew Ken, et al.
Publicado: (2024) -
Emma-X: An Embodied Multimodal Action Model with Grounded Chain of Thought and Look-ahead Spatial Reasoning
por: Sun, Qi, et al.
Publicado: (2024) -
Explicit World Models for Reliable Human-Robot Collaboration
por: Kwok, Kenneth, et al.
Publicado: (2026) -
Embodied Robot Manipulation in the Era of Foundation Models: Planning and Learning Perspectives
por: Bai, Shuanghao, et al.
Publicado: (2025) -
NORA: A Small Open-Sourced Generalist Vision Language Action Model for Embodied Tasks
por: Hung, Chia-Yu, et al.
Publicado: (2025)