Enregistré dans:
| Auteurs principaux: | Li, Chengshu, Liang, Jacky, Zeng, Andy, Chen, Xinyun, Hausman, Karol, Sadigh, Dorsa, Levine, Sergey, Fei-Fei, Li, Xia, Fei, Ichter, Brian |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2312.04474 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SpatialVLM: Endowing Vision-Language Models with Spatial Reasoning Capabilities
par: Chen, Boyuan, et autres
Publié: (2024)
par: Chen, Boyuan, et autres
Publié: (2024)
Physically Grounded Vision-Language Models for Robotic Manipulation
par: Gao, Jensen, et autres
Publié: (2023)
par: Gao, Jensen, et autres
Publié: (2023)
PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs
par: Nasiriany, Soroush, et autres
Publié: (2024)
par: Nasiriany, Soroush, et autres
Publié: (2024)
GenCHiP: Generating Robot Policy Code for High-Precision and Contact-Rich Manipulation Tasks
par: Burns, Kaylee, et autres
Publié: (2024)
par: Burns, Kaylee, et autres
Publié: (2024)
Generative Expressive Robot Behaviors using Large Language Models
par: Mahadevan, Karthik, et autres
Publié: (2024)
par: Mahadevan, Karthik, et autres
Publié: (2024)
Distilling and Retrieving Generalizable Knowledge for Robot Manipulation via Language Corrections
par: Zha, Lihan, et autres
Publié: (2023)
par: Zha, Lihan, et autres
Publié: (2023)
AutoRT: Embodied Foundation Models for Large Scale Orchestration of Robotic Agents
par: Ahn, Michael, et autres
Publié: (2024)
par: Ahn, Michael, et autres
Publié: (2024)
Bridging Perception and Action: Spatially-Grounded Mid-Level Representations for Robot Generalization
par: Yang, Jonathan, et autres
Publié: (2025)
par: Yang, Jonathan, et autres
Publié: (2025)
Chain-of-Modality: Learning Manipulation Programs from Multimodal Human Videos with Vision-Language-Models
par: Wang, Chen, et autres
Publié: (2025)
par: Wang, Chen, et autres
Publié: (2025)
Vocal Sandbox: Continual Learning and Adaptation for Situated Human-Robot Collaboration
par: Grannen, Jennifer, et autres
Publié: (2024)
par: Grannen, Jennifer, et autres
Publié: (2024)
ProVox: Personalization and Proactive Planning for Situated Human-Robot Collaboration
par: Grannen, Jennifer, et autres
Publié: (2025)
par: Grannen, Jennifer, et autres
Publié: (2025)
Grounding Robot Generalization in Training Data via Retrieval-Augmented VLMs
par: Gao, Jensen, et autres
Publié: (2026)
par: Gao, Jensen, et autres
Publié: (2026)
How to Train Your Robots? The Impact of Demonstration Modality on Imitation Learning
par: Li, Haozhuo, et autres
Publié: (2025)
par: Li, Haozhuo, et autres
Publié: (2025)
Efficiently Generating Expressive Quadruped Behaviors via Language-Guided Preference Learning
par: Clark, Jaden, et autres
Publié: (2025)
par: Clark, Jaden, et autres
Publié: (2025)
Action-Free Reasoning for Policy Generalization
par: Clark, Jaden, et autres
Publié: (2025)
par: Clark, Jaden, et autres
Publié: (2025)
HandelBot: Real-World Piano Playing via Fast Adaptation of Dexterous Robot Policies
par: Xie, Amber, et autres
Publié: (2026)
par: Xie, Amber, et autres
Publié: (2026)
CoNVOI: Context-aware Navigation using Vision Language Models in Outdoor and Indoor Environments
par: Sathyamoorthy, Adarsh Jagan, et autres
Publié: (2024)
par: Sathyamoorthy, Adarsh Jagan, et autres
Publié: (2024)
Precise Robot Command Understanding Using Grammar-Constrained Large Language Models
par: Huo, Xinyun, et autres
Publié: (2026)
par: Huo, Xinyun, et autres
Publié: (2026)
RT-Sketch: Goal-Conditioned Imitation Learning from Hand-Drawn Sketches
par: Sundaresan, Priya, et autres
Publié: (2024)
par: Sundaresan, Priya, et autres
Publié: (2024)
Robo-Instruct: Simulator-Augmented Instruction Alignment For Finetuning Code LLMs
par: Hu, Zichao, et autres
Publié: (2024)
par: Hu, Zichao, et autres
Publié: (2024)
Batch Active Learning of Reward Functions from Human Preferences
par: Bıyık, Erdem, et autres
Publié: (2024)
par: Bıyık, Erdem, et autres
Publié: (2024)
Unified Video Action Model
par: Li, Shuang, et autres
Publié: (2025)
par: Li, Shuang, et autres
Publié: (2025)
SteerVLA: Steering Vision-Language-Action Models in Long-Tail Driving Scenarios
par: Gao, Tian, et autres
Publié: (2026)
par: Gao, Tian, et autres
Publié: (2026)
Joint Action Language Modelling for Transparent Policy Execution
par: Wulff, Theodor, et autres
Publié: (2025)
par: Wulff, Theodor, et autres
Publié: (2025)
Data Analogies Enable Efficient Cross-Embodiment Transfer
par: Yang, Jonathan, et autres
Publié: (2026)
par: Yang, Jonathan, et autres
Publié: (2026)
Toward Grounded Commonsense Reasoning
par: Kwon, Minae, et autres
Publié: (2023)
par: Kwon, Minae, et autres
Publié: (2023)
FAST: Efficient Action Tokenization for Vision-Language-Action Models
par: Pertsch, Karl, et autres
Publié: (2025)
par: Pertsch, Karl, et autres
Publié: (2025)
Pushing the Limits of Cross-Embodiment Learning for Manipulation and Navigation
par: Yang, Jonathan, et autres
Publié: (2024)
par: Yang, Jonathan, et autres
Publié: (2024)
Will People Enjoy a Robot Trainer? A Case Study with Snoopie the Pacerbot
par: Du, Maximilian, et autres
Publié: (2026)
par: Du, Maximilian, et autres
Publié: (2026)
Invariance Co-training for Robot Visual Generalization
par: Yang, Jonathan, et autres
Publié: (2025)
par: Yang, Jonathan, et autres
Publié: (2025)
Language Guided Skill Discovery
par: Rho, Seungeun, et autres
Publié: (2024)
par: Rho, Seungeun, et autres
Publié: (2024)
Towards No-Code Programming of Cobots: Experiments with Code Synthesis by Large Code Models for Conversational Programming
par: Kranti, Chalamalasetti, et autres
Publié: (2024)
par: Kranti, Chalamalasetti, et autres
Publié: (2024)
Vision Language Models are In-Context Value Learners
par: Ma, Yecheng Jason, et autres
Publié: (2024)
par: Ma, Yecheng Jason, et autres
Publié: (2024)
Latent Diffusion Planning for Imitation Learning
par: Xie, Amber, et autres
Publié: (2025)
par: Xie, Amber, et autres
Publié: (2025)
Data Retrieval with Importance Weights for Few-Shot Imitation Learning
par: Xie, Amber, et autres
Publié: (2025)
par: Xie, Amber, et autres
Publié: (2025)
What Matters for Batch Online Reinforcement Learning in Robotics?
par: Dong, Perry, et autres
Publié: (2025)
par: Dong, Perry, et autres
Publié: (2025)
AgentThink: A Unified Framework for Tool-Augmented Chain-of-Thought Reasoning in Vision-Language Models for Autonomous Driving
par: Qian, Kangan, et autres
Publié: (2025)
par: Qian, Kangan, et autres
Publié: (2025)
UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation
par: Tang, Yihe, et autres
Publié: (2025)
par: Tang, Yihe, et autres
Publié: (2025)
EXPO-FT: Sample-Efficient Reinforcement Learning Finetuning for Vision-Language-Action Models
par: Dong, Perry, et autres
Publié: (2026)
par: Dong, Perry, et autres
Publié: (2026)
IPPON: Common Sense Guided Informative Path Planning for Object Goal Navigation
par: Qu, Kaixian, et autres
Publié: (2024)
par: Qu, Kaixian, et autres
Publié: (2024)
Documents similaires
-
SpatialVLM: Endowing Vision-Language Models with Spatial Reasoning Capabilities
par: Chen, Boyuan, et autres
Publié: (2024) -
Physically Grounded Vision-Language Models for Robotic Manipulation
par: Gao, Jensen, et autres
Publié: (2023) -
PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs
par: Nasiriany, Soroush, et autres
Publié: (2024) -
GenCHiP: Generating Robot Policy Code for High-Precision and Contact-Rich Manipulation Tasks
par: Burns, Kaylee, et autres
Publié: (2024) -
Generative Expressive Robot Behaviors using Large Language Models
par: Mahadevan, Karthik, et autres
Publié: (2024)