Composing Pre-Trained Object-Centric Representations for Robotics From "What" and "Where" Foundation Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shi, Junyao, Qian, Jianing, Ma, Yecheng Jason, Jayaraman, Dinesh |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Recasting Generic Pretrained Vision Transformers As Object-Centric Scene Encoders For Manipulation Policies
par: Qian, Jianing, et autres
Publié: (2024)
par: Qian, Jianing, et autres
Publié: (2024)
ZeroMimic: Distilling Robotic Manipulation Skills from Web Videos
par: Shi, Junyao, et autres
Publié: (2025)
par: Shi, Junyao, et autres
Publié: (2025)
Tether: Autonomous Functional Play with Correspondence-Driven Trajectory Warping
par: Liang, William, et autres
Publié: (2026)
par: Liang, William, et autres
Publié: (2026)
Can Transformers Capture Spatial Relations between Objects?
par: Wen, Chuan, et autres
Publié: (2024)
par: Wen, Chuan, et autres
Publié: (2024)
Disentangled Object-Centric Image Representation for Robotic Manipulation
par: Emukpere, David, et autres
Publié: (2025)
par: Emukpere, David, et autres
Publié: (2025)
A Data-Centric Revisit of Pre-Trained Vision Models for Robot Learning
par: Wen, Xin, et autres
Publié: (2025)
par: Wen, Xin, et autres
Publié: (2025)
What Is The Best 3D Scene Representation for Robotics? From Geometric to Foundation Models
par: Deng, Tianchen, et autres
Publié: (2025)
par: Deng, Tianchen, et autres
Publié: (2025)
Object-Centric Action-Enhanced Representations for Robot Visuo-Motor Policy Learning
par: Giannakakis, Nikos, et autres
Publié: (2025)
par: Giannakakis, Nikos, et autres
Publié: (2025)
Articulate-Anything: Automatic Modeling of Articulated Objects via a Vision-Language Foundation Model
par: Le, Long, et autres
Publié: (2024)
par: Le, Long, et autres
Publié: (2024)
Object-Centric Instruction Augmentation for Robotic Manipulation
par: Wen, Junjie, et autres
Publié: (2024)
par: Wen, Junjie, et autres
Publié: (2024)
Robots Pre-train Robots: Manipulation-Centric Robotic Representation from Large-Scale Robot Datasets
par: Jiang, Guangqi, et autres
Publié: (2024)
par: Jiang, Guangqi, et autres
Publié: (2024)
LOC-ZSON: Language-driven Object-Centric Zero-Shot Object Retrieval and Navigation
par: Guan, Tianrui, et autres
Publié: (2024)
par: Guan, Tianrui, et autres
Publié: (2024)
Zero-shot Object-Centric Instruction Following: Integrating Foundation Models with Traditional Navigation
par: Raychaudhuri, Sonia, et autres
Publié: (2024)
par: Raychaudhuri, Sonia, et autres
Publié: (2024)
Rethinking Progression of Memory State in Robotic Manipulation: An Object-Centric Perspective
par: Chung, Nhat, et autres
Publié: (2025)
par: Chung, Nhat, et autres
Publié: (2025)
Pre-Trained Masked Image Model for Mobile Robot Navigation
par: Sharma, Vishnu Dutt, et autres
Publié: (2023)
par: Sharma, Vishnu Dutt, et autres
Publié: (2023)
VANP: Learning Where to See for Navigation with Self-Supervised Vision-Action Pre-Training
par: Nazeri, Mohammad, et autres
Publié: (2024)
par: Nazeri, Mohammad, et autres
Publié: (2024)
HRP: Human Affordances for Robotic Pre-Training
par: Srirama, Mohan Kumar, et autres
Publié: (2024)
par: Srirama, Mohan Kumar, et autres
Publié: (2024)
JODA: Composable Joint Dynamics for Articulated Objects
par: Gao, Tianhong, et autres
Publié: (2026)
par: Gao, Tianhong, et autres
Publié: (2026)
RH20T-P: A Primitive-Level Robotic Dataset Towards Composable Generalization Agents
par: Chen, Zeren, et autres
Publié: (2024)
par: Chen, Zeren, et autres
Publié: (2024)
SlotVLA: Towards Modeling of Object-Relation Representations in Robotic Manipulation
par: Hanyu, Taisei, et autres
Publié: (2025)
par: Hanyu, Taisei, et autres
Publié: (2025)
OCRA: Object-Centric Learning with 3D and Tactile Priors for Human-to-Robot Action Transfer
par: Wang, Kuanning, et autres
Publié: (2026)
par: Wang, Kuanning, et autres
Publié: (2026)
RepSAM: Bridging Foundation Models to Robotic Vision via Representation-Guided Adaptation
par: Chu, Wenhui
Publié: (2026)
par: Chu, Wenhui
Publié: (2026)
DeFM: Learning Foundation Representations from Depth for Robotics
par: Patel, Manthan, et autres
Publié: (2026)
par: Patel, Manthan, et autres
Publié: (2026)
ZISVFM: Zero-Shot Object Instance Segmentation in Indoor Robotic Environments with Vision Foundation Models
par: Zhang, Ying, et autres
Publié: (2025)
par: Zhang, Ying, et autres
Publié: (2025)
CarFormer: Self-Driving with Learned Object-Centric Representations
par: Hamdan, Shadi, et autres
Publié: (2024)
par: Hamdan, Shadi, et autres
Publié: (2024)
What Matters in Building Vision-Language-Action Models for Generalist Robots
par: Li, Xinghang, et autres
Publié: (2024)
par: Li, Xinghang, et autres
Publié: (2024)
Continuous Object State Recognition for Cooking Robots Using Pre-Trained Vision-Language Models and Black-box Optimization
par: Kawaharazuka, Kento, et autres
Publié: (2024)
par: Kawaharazuka, Kento, et autres
Publié: (2024)
Generalized Robot 3D Vision-Language Model with Fast Rendering and Pre-Training Vision-Language Alignment
par: Liu, Kangcheng, et autres
Publié: (2023)
par: Liu, Kangcheng, et autres
Publié: (2023)
3D Feature Distillation with Object-Centric Priors
par: Tziafas, Georgios, et autres
Publié: (2024)
par: Tziafas, Georgios, et autres
Publié: (2024)
Mitigating the Human-Robot Domain Discrepancy in Visual Pre-training for Robotic Manipulation
par: Zhou, Jiaming, et autres
Publié: (2024)
par: Zhou, Jiaming, et autres
Publié: (2024)
From Seeing to Experiencing: Scaling Navigation Foundation Models with Reinforcement Learning
par: He, Honglin, et autres
Publié: (2025)
par: He, Honglin, et autres
Publié: (2025)
Fiducial Exoskeletons: Image-Centric Robot State Estimation
par: Smith, Cameron, et autres
Publié: (2026)
par: Smith, Cameron, et autres
Publié: (2026)
TAG: Target-Agnostic Guidance for Stable Object-Centric Inference in Vision-Language-Action Models
par: Zhou, Jiaying, et autres
Publié: (2026)
par: Zhou, Jiaying, et autres
Publié: (2026)
FindAnything: Open-Vocabulary and Object-Centric Mapping for Robot Exploration in Any Environment
par: Laina, Sebastián Barbas, et autres
Publié: (2025)
par: Laina, Sebastián Barbas, et autres
Publié: (2025)
Object-Centric World Model for Language-Guided Manipulation
par: Jeong, Youngjoon, et autres
Publié: (2025)
par: Jeong, Youngjoon, et autres
Publié: (2025)
FoundPose: Unseen Object Pose Estimation with Foundation Features
par: Örnek, Evin Pınar, et autres
Publié: (2023)
par: Örnek, Evin Pınar, et autres
Publié: (2023)
rt-RISeg: Real-Time Model-Free Robot Interactive Segmentation for Active Instance-Level Object Understanding
par: Qian, Howard H., et autres
Publié: (2025)
par: Qian, Howard H., et autres
Publié: (2025)
FuncGrasp: Learning Object-Centric Neural Grasp Functions from Single Annotated Example Object
par: Chen, Hanzhi, et autres
Publié: (2024)
par: Chen, Hanzhi, et autres
Publié: (2024)
A Survey of Embodied Learning for Object-Centric Robotic Manipulation
par: Zheng, Ying, et autres
Publié: (2024)
par: Zheng, Ying, et autres
Publié: (2024)
Personalized Embodied Navigation for Portable Object Finding
par: Dorbala, Vishnu Sashank, et autres
Publié: (2024)
par: Dorbala, Vishnu Sashank, et autres
Publié: (2024)
Documents similaires
-
Recasting Generic Pretrained Vision Transformers As Object-Centric Scene Encoders For Manipulation Policies
par: Qian, Jianing, et autres
Publié: (2024) -
ZeroMimic: Distilling Robotic Manipulation Skills from Web Videos
par: Shi, Junyao, et autres
Publié: (2025) -
Tether: Autonomous Functional Play with Correspondence-Driven Trajectory Warping
par: Liang, William, et autres
Publié: (2026) -
Can Transformers Capture Spatial Relations between Objects?
par: Wen, Chuan, et autres
Publié: (2024) -
Disentangled Object-Centric Image Representation for Robotic Manipulation
par: Emukpere, David, et autres
Publié: (2025)