MOKA: Open-World Robotic Manipulation through Mark-Based Visual Prompting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Fangchen, Fang, Kuan, Abbeel, Pieter, Levine, Sergey |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Video2Policy: Scaling up Manipulation Tasks in Simulation through Internet Videos
par: Ye, Weirui, et autres
Publié: (2025)
par: Ye, Weirui, et autres
Publié: (2025)
KALIE: Fine-Tuning Vision-Language Models for Open-World Manipulation without Robot Data
par: Tang, Grace, et autres
Publié: (2024)
par: Tang, Grace, et autres
Publié: (2024)
Body Transformer: Leveraging Robot Embodiment for Policy Learning
par: Sferrazza, Carmelo, et autres
Publié: (2024)
par: Sferrazza, Carmelo, et autres
Publié: (2024)
Beyond Sight: Finetuning Generalist Robot Policies with Heterogeneous Sensors via Language Grounding
par: Jones, Joshua, et autres
Publié: (2025)
par: Jones, Joshua, et autres
Publié: (2025)
FMB: a Functional Manipulation Benchmark for Generalizable Robotic Learning
par: Luo, Jianlan, et autres
Publié: (2024)
par: Luo, Jianlan, et autres
Publié: (2024)
AutoEval: Autonomous Evaluation of Generalist Robot Manipulation Policies in the Real World
par: Zhou, Zhiyuan, et autres
Publié: (2025)
par: Zhou, Zhiyuan, et autres
Publié: (2025)
KUDA: Keypoints to Unify Dynamics Learning and Visual Prompting for Open-Vocabulary Robotic Manipulation
par: Liu, Zixian, et autres
Publié: (2025)
par: Liu, Zixian, et autres
Publié: (2025)
Precise and Dexterous Robotic Manipulation via Human-in-the-Loop Reinforcement Learning
par: Luo, Jianlan, et autres
Publié: (2024)
par: Luo, Jianlan, et autres
Publié: (2024)
From LLMs to Actions: Latent Codes as Bridges in Hierarchical Robot Control
par: Shentu, Yide, et autres
Publié: (2024)
par: Shentu, Yide, et autres
Publié: (2024)
Reinforcement Learning for Versatile, Dynamic, and Robust Bipedal Locomotion Control
par: Li, Zhongyu, et autres
Publié: (2024)
par: Li, Zhongyu, et autres
Publié: (2024)
SAGA: Open-World Mobile Manipulation via Structured Affordance Grounding
par: Fang, Kuan, et autres
Publié: (2025)
par: Fang, Kuan, et autres
Publié: (2025)
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Reinforcement Learning
par: Seo, Younggyo, et autres
Publié: (2024)
par: Seo, Younggyo, et autres
Publié: (2024)
EgoZero: Robot Learning from Smart Glasses
par: Liu, Vincent, et autres
Publié: (2025)
par: Liu, Vincent, et autres
Publié: (2025)
Multi-Stage Cable Routing through Hierarchical Imitation Learning
par: Luo, Jianlan, et autres
Publié: (2023)
par: Luo, Jianlan, et autres
Publié: (2023)
Visual Prompting for Robotic Manipulation with Annotation-Guided Pick-and-Place Using ACT
par: Muttaqien, Muhammad A., et autres
Publié: (2025)
par: Muttaqien, Muhammad A., et autres
Publié: (2025)
Offline Imitation Learning Through Graph Search and Retrieval
par: Yin, Zhao-Heng, et autres
Publié: (2024)
par: Yin, Zhao-Heng, et autres
Publié: (2024)
HumanoidBench: Simulated Humanoid Benchmark for Whole-Body Locomotion and Manipulation
par: Sferrazza, Carmelo, et autres
Publié: (2024)
par: Sferrazza, Carmelo, et autres
Publié: (2024)
ViTaMIn: Learning Contact-Rich Tasks Through Robot-Free Visuo-Tactile Manipulation Interface
par: Liu, Fangchen, et autres
Publié: (2025)
par: Liu, Fangchen, et autres
Publié: (2025)
EMMA: Generalizing Real-World Robot Manipulation via Generative Visual Transfer
par: Dong, Zhehao, et autres
Publié: (2025)
par: Dong, Zhehao, et autres
Publié: (2025)
Mastering Robot Manipulation with Multimodal Prompts through Pretraining and Multi-task Fine-tuning
par: Li, Jiachen, et autres
Publié: (2023)
par: Li, Jiachen, et autres
Publié: (2023)
DreamSmooth: Improving Model-based Reinforcement Learning via Reward Smoothing
par: Lee, Vint, et autres
Publié: (2023)
par: Lee, Vint, et autres
Publié: (2023)
ManipDreamer: Boosting Robotic Manipulation World Model with Action Tree and Visual Guidance
par: Li, Ying, et autres
Publié: (2025)
par: Li, Ying, et autres
Publié: (2025)
Cliqueformer: Model-Based Optimization with Structured Transformers
par: Kuba, Jakub Grudzien, et autres
Publié: (2024)
par: Kuba, Jakub Grudzien, et autres
Publié: (2024)
Reflective Planning: Vision-Language Models for Multi-Stage Long-Horizon Robotic Manipulation
par: Feng, Yunhai, et autres
Publié: (2025)
par: Feng, Yunhai, et autres
Publié: (2025)
MaxInfoRL: Boosting exploration in reinforcement learning through information gain maximization
par: Sukhija, Bhavya, et autres
Publié: (2024)
par: Sukhija, Bhavya, et autres
Publié: (2024)
Affordance-Guided Reinforcement Learning via Visual Prompting
par: Lee, Olivia Y., et autres
Publié: (2024)
par: Lee, Olivia Y., et autres
Publié: (2024)
Hierarchical Audio-Visual-Proprioceptive Fusion for Precise Robotic Manipulation
par: Li, Siyuan, et autres
Publié: (2026)
par: Li, Siyuan, et autres
Publié: (2026)
Ctrl-World: A Controllable Generative World Model for Robot Manipulation
par: Guo, Yanjiang, et autres
Publié: (2025)
par: Guo, Yanjiang, et autres
Publié: (2025)
Efficient Sensorimotor Learning for Open-world Robot Manipulation
par: Zhu, Yifeng
Publié: (2025)
par: Zhu, Yifeng
Publié: (2025)
World4RL: Diffusion World Models for Policy Refinement with Reinforcement Learning for Robotic Manipulation
par: Jiang, Zhennan, et autres
Publié: (2025)
par: Jiang, Zhennan, et autres
Publié: (2025)
HAMSTER: Hierarchical Action Models For Open-World Robot Manipulation
par: Li, Yi, et autres
Publié: (2025)
par: Li, Yi, et autres
Publié: (2025)
Robust Finetuning of Vision-Language-Action Robot Policies via Parameter Merging
par: Yadav, Yajat, et autres
Publié: (2025)
par: Yadav, Yajat, et autres
Publié: (2025)
Flow Policy Gradients for Robot Control
par: Yi, Brent, et autres
Publié: (2026)
par: Yi, Brent, et autres
Publié: (2026)
Humanoid World Models: Open World Foundation Models for Humanoid Robotics
par: Ali, Muhammad Qasim, et autres
Publié: (2025)
par: Ali, Muhammad Qasim, et autres
Publié: (2025)
RoboWM-Bench: A Benchmark for Evaluating World Models in Robotic Manipulation
par: Jiang, Feng, et autres
Publié: (2026)
par: Jiang, Feng, et autres
Publié: (2026)
Object-centric 3D Motion Field for Robot Learning from Human Videos
par: Yin, Zhao-Heng, et autres
Publié: (2025)
par: Yin, Zhao-Heng, et autres
Publié: (2025)
Multi-Task Interactive Robot Fleet Learning with Visual World Models
par: Liu, Huihan, et autres
Publié: (2024)
par: Liu, Huihan, et autres
Publié: (2024)
Creating and Repairing Robot Programs in Open-World Domains
par: Schlesinger, Claire, et autres
Publié: (2024)
par: Schlesinger, Claire, et autres
Publié: (2024)
Contextual Safety Reasoning and Grounding for Open-World Robots
par: Ravichandran, Zachary, et autres
Publié: (2026)
par: Ravichandran, Zachary, et autres
Publié: (2026)
Robot Task Planning and Situation Handling in Open Worlds
par: Ding, Yan, et autres
Publié: (2022)
par: Ding, Yan, et autres
Publié: (2022)
Documents similaires
-
Video2Policy: Scaling up Manipulation Tasks in Simulation through Internet Videos
par: Ye, Weirui, et autres
Publié: (2025) -
KALIE: Fine-Tuning Vision-Language Models for Open-World Manipulation without Robot Data
par: Tang, Grace, et autres
Publié: (2024) -
Body Transformer: Leveraging Robot Embodiment for Policy Learning
par: Sferrazza, Carmelo, et autres
Publié: (2024) -
Beyond Sight: Finetuning Generalist Robot Policies with Heterogeneous Sensors via Language Grounding
par: Jones, Joshua, et autres
Publié: (2025) -
FMB: a Functional Manipulation Benchmark for Generalizable Robotic Learning
par: Luo, Jianlan, et autres
Publié: (2024)