From Pixels to Predicates: Learning Symbolic World Models via Pretrained Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Athalye, Ashay, Kumar, Nishanth, Silver, Tom, Liang, Yichao, Wang, Jiuguang, Lozano-Pérez, Tomás, Kaelbling, Leslie Pack |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Predicate Invention for Bilevel Planning
par: Silver, Tom, et autres
Publié: (2022)
par: Silver, Tom, et autres
Publié: (2022)
Open-World Task and Motion Planning via Vision-Language Model Generated Constraints
par: Kumar, Nishanth, et autres
Publié: (2024)
par: Kumar, Nishanth, et autres
Publié: (2024)
VisualPredicator: Learning Abstract World Models with Neuro-Symbolic Predicates for Robot Planning
par: Liang, Yichao, et autres
Publié: (2024)
par: Liang, Yichao, et autres
Publié: (2024)
Guiding Long-Horizon Task and Motion Planning with Vision Language Models
par: Yang, Zhutian, et autres
Publié: (2024)
par: Yang, Zhutian, et autres
Publié: (2024)
Trust the PRoC3S: Solving Long-Horizon Robotics Problems with LLMs and Constraint Satisfaction
par: Curtis, Aidan, et autres
Publié: (2024)
par: Curtis, Aidan, et autres
Publié: (2024)
Rational Inverse Reasoning
par: Zandonati, Ben, et autres
Publié: (2025)
par: Zandonati, Ben, et autres
Publié: (2025)
Learning to Bridge the Gap: Efficient Novelty Recovery with Planning and Reinforcement Learning
par: Li, Alicia, et autres
Publié: (2024)
par: Li, Alicia, et autres
Publié: (2024)
Practice Makes Perfect: Planning to Learn Skill Parameter Policies
par: Kumar, Nishanth, et autres
Publié: (2024)
par: Kumar, Nishanth, et autres
Publié: (2024)
SceneComplete: Open-World 3D Scene Completion in Cluttered Real World Environments for Robot Manipulation
par: Agarwal, Aditya, et autres
Publié: (2024)
par: Agarwal, Aditya, et autres
Publié: (2024)
Embodied Uncertainty-Aware Object Segmentation
par: Fang, Xiaolin, et autres
Publié: (2024)
par: Fang, Xiaolin, et autres
Publié: (2024)
Seeing is Believing: Belief-Space Planning with Foundation Models as Uncertainty Estimators
par: Zhao, Linfeng, et autres
Publié: (2025)
par: Zhao, Linfeng, et autres
Publié: (2025)
Guided Exploration for Efficient Relational Model Learning
par: Feng, Annie, et autres
Publié: (2025)
par: Feng, Annie, et autres
Publié: (2025)
Differentiable GPU-Parallelized Task and Motion Planning
par: Shen, William, et autres
Publié: (2024)
par: Shen, William, et autres
Publié: (2024)
Which Reconstruction Model Should a Robot Use? Routing Image-to-3D Models for Cost-Aware Robotic Manipulation
par: Anand, Akash, et autres
Publié: (2026)
par: Anand, Akash, et autres
Publié: (2026)
"Set It Up!": Functional Object Arrangement with Compositional Generative Models
par: Xu, Yiqing, et autres
Publié: (2024)
par: Xu, Yiqing, et autres
Publié: (2024)
Towards Practical Finite Sample Bounds for Motion Planning in TAMP
par: Shaw, Seiji, et autres
Publié: (2024)
par: Shaw, Seiji, et autres
Publié: (2024)
Combining Planning and Diffusion for Mobility with Unknown Dynamics
par: Ravan, Yajvan, et autres
Publié: (2024)
par: Ravan, Yajvan, et autres
Publié: (2024)
Bi-Level Belief Space Search for Compliant Part Mating Under Uncertainty
par: Chintalapudi, Sahit, et autres
Publié: (2024)
par: Chintalapudi, Sahit, et autres
Publié: (2024)
"Set It Up": Functional Object Arrangement with Compositional Generative Models (Journal Version)
par: Xu, Yiqing, et autres
Publié: (2025)
par: Xu, Yiqing, et autres
Publié: (2025)
TiPToP: A Modular Open-Vocabulary Planning System for Robotic Manipulation
par: Shen, William, et autres
Publié: (2026)
par: Shen, William, et autres
Publié: (2026)
One-Shot Manipulation Strategy Learning by Making Contact Analogies
par: Liu, Yuyao, et autres
Publié: (2024)
par: Liu, Yuyao, et autres
Publié: (2024)
DiMSam: Diffusion Models as Samplers for Task and Motion Planning under Partial Observability
par: Fang, Xiaolin, et autres
Publié: (2023)
par: Fang, Xiaolin, et autres
Publié: (2023)
Streaming Flow Policy: Simplifying diffusion/flow-matching policies by treating action trajectories as flow trajectories
par: Jiang, Sunshine, et autres
Publié: (2025)
par: Jiang, Sunshine, et autres
Publié: (2025)
Partially Observable Task and Motion Planning with Uncertainty and Risk Awareness
par: Curtis, Aidan, et autres
Publié: (2024)
par: Curtis, Aidan, et autres
Publié: (2024)
Keypoint Abstraction using Large Models for Object-Relative Imitation Learning
par: Fang, Xiaolin, et autres
Publié: (2024)
par: Fang, Xiaolin, et autres
Publié: (2024)
ExoPredicator: Learning Abstract Models of Dynamic Worlds for Robot Planning
par: Liang, Yichao, et autres
Publié: (2025)
par: Liang, Yichao, et autres
Publié: (2025)
Compositional Generative Modeling: A Single Model is Not All You Need
par: Du, Yilun, et autres
Publié: (2024)
par: Du, Yilun, et autres
Publié: (2024)
Unifying Deep Predicate Invention with Pre-trained Foundation Models
par: Wang, Qianwei, et autres
Publié: (2025)
par: Wang, Qianwei, et autres
Publié: (2025)
GCS*: Forward Heuristic Search on Implicit Graphs of Convex Sets
par: Chia, Shao Yuan Chew, et autres
Publié: (2024)
par: Chia, Shao Yuan Chew, et autres
Publié: (2024)
Distilled Feature Fields Enable Few-Shot Language-Guided Manipulation
par: Shen, William, et autres
Publié: (2023)
par: Shen, William, et autres
Publié: (2023)
Symbolic Manipulation Planning with Discovered Object and Relational Predicates
par: Ahmetoglu, Alper, et autres
Publié: (2024)
par: Ahmetoglu, Alper, et autres
Publié: (2024)
What Planning Problems Can A Relational Neural Network Solve?
par: Mao, Jiayuan, et autres
Publié: (2023)
par: Mao, Jiayuan, et autres
Publié: (2023)
PixelVLA: Advancing Pixel-level Understanding in Vision-Language-Action Model
par: Liang, Wenqi, et autres
Publié: (2025)
par: Liang, Wenqi, et autres
Publié: (2025)
KinDER: A Physical Reasoning Benchmark for Robot Learning and Planning
par: Huang, Yixuan, et autres
Publié: (2026)
par: Huang, Yixuan, et autres
Publié: (2026)
Flow-based Domain Randomization for Learning and Sequencing Robotic Skills
par: Curtis, Aidan, et autres
Publié: (2025)
par: Curtis, Aidan, et autres
Publié: (2025)
AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation
par: Duan, Jiafei, et autres
Publié: (2024)
par: Duan, Jiafei, et autres
Publié: (2024)
Space Filling Curves for Coverage Path Planning with Online Obstacle Avoidance
par: Wakode, Ashay, et autres
Publié: (2022)
par: Wakode, Ashay, et autres
Publié: (2022)
Online Obstacle evasion with Space-Filling Curves
par: Wakode, Ashay, et autres
Publié: (2023)
par: Wakode, Ashay, et autres
Publié: (2023)
NS-VLA: Towards Neuro-Symbolic Vision-Language-Action Models
par: Zhu, Ziyue, et autres
Publié: (2026)
par: Zhu, Ziyue, et autres
Publié: (2026)
LLM-Guided Probabilistic Program Induction for POMDP Model Estimation
par: Curtis, Aidan, et autres
Publié: (2025)
par: Curtis, Aidan, et autres
Publié: (2025)
Documents similaires
-
Predicate Invention for Bilevel Planning
par: Silver, Tom, et autres
Publié: (2022) -
Open-World Task and Motion Planning via Vision-Language Model Generated Constraints
par: Kumar, Nishanth, et autres
Publié: (2024) -
VisualPredicator: Learning Abstract World Models with Neuro-Symbolic Predicates for Robot Planning
par: Liang, Yichao, et autres
Publié: (2024) -
Guiding Long-Horizon Task and Motion Planning with Vision Language Models
par: Yang, Zhutian, et autres
Publié: (2024) -
Trust the PRoC3S: Solving Long-Horizon Robotics Problems with LLMs and Constraint Satisfaction
par: Curtis, Aidan, et autres
Publié: (2024)