CLIP-RT: Learning Language-Conditioned Robotic Policies from Natural Language Supervision
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kang, Gi-Cheon, Kim, Junghyun, Shim, Kyuhwan, Lee, Jun Ki, Zhang, Byoung-Tak |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PROGrasp: Pragmatic Human-Robot Communication for Object Grasping
par: Kang, Gi-Cheon, et autres
Publié: (2023)
par: Kang, Gi-Cheon, et autres
Publié: (2023)
PGA: Personalizing Grasping Agents with Single Human-Robot Interaction
par: Kim, Junghyun, et autres
Publié: (2023)
par: Kim, Junghyun, et autres
Publié: (2023)
ESPADA: Execution Speedup via Semantics Aware Demonstration Data Downsampling for Imitation Learning
par: Kim, Byung-ju, et autres
Publié: (2025)
par: Kim, Byung-ju, et autres
Publié: (2025)
Socratic Planner: Self-QA-Based Zero-Shot Planning for Embodied Instruction Following
par: Shin, Suyeon, et autres
Publié: (2024)
par: Shin, Suyeon, et autres
Publié: (2024)
Multi-Object RANSAC: Efficient Plane Clustering Method in a Clutter
par: Lim, Seunghyeon, et autres
Publié: (2024)
par: Lim, Seunghyeon, et autres
Publié: (2024)
Zero-Shot Vision-and-Language Navigation with Collision Mitigation in Continuous Environment
par: Jeong, Seongjun, et autres
Publié: (2024)
par: Jeong, Seongjun, et autres
Publié: (2024)
Continual Vision-and-Language Navigation
par: Jeong, Seongjun, et autres
Publié: (2024)
par: Jeong, Seongjun, et autres
Publié: (2024)
Multimodal Anomaly Detection based on Deep Auto-Encoder for Object Slip Perception of Mobile Manipulation Robots
par: Yoo, Youngjae, et autres
Publié: (2024)
par: Yoo, Youngjae, et autres
Publié: (2024)
Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision
par: Adami, Alessandro, et autres
Publié: (2026)
par: Adami, Alessandro, et autres
Publié: (2026)
RT-Grasp: Reasoning Tuning Robotic Grasping via Multi-modal Large Language Model
par: Xu, Jinxuan, et autres
Publié: (2024)
par: Xu, Jinxuan, et autres
Publié: (2024)
HAPFI: History-Aware Planning based on Fused Information
par: Jeon, Sujin, et autres
Publié: (2024)
par: Jeon, Sujin, et autres
Publié: (2024)
Adaptive Capacity Allocation for Vision Language Action Fine-tuning
par: Kim, Donghoon, et autres
Publié: (2026)
par: Kim, Donghoon, et autres
Publié: (2026)
Habilis-$β$: A Fast-Motion and Long-Lasting On-Device Vision-Language-Action Model
par: Robotics, Tommoro, et autres
Publié: (2026)
par: Robotics, Tommoro, et autres
Publié: (2026)
Language-Conditioned Representations and Mixture-of-Experts Policy for Robust Multi-Task Robotic Manipulation
par: Zhang, Xiucheng, et autres
Publié: (2025)
par: Zhang, Xiucheng, et autres
Publié: (2025)
Lifelong Language-Conditioned Robotic Manipulation Learning
par: Wang, Xudong, et autres
Publié: (2026)
par: Wang, Xudong, et autres
Publié: (2026)
Open X-Embodiment: Robotic Learning Datasets and RT-X Models
par: Embodiment Collaboration, et autres
Publié: (2023)
par: Embodiment Collaboration, et autres
Publié: (2023)
CLASS: Contrastive Learning via Action Sequence Supervision for Robot Manipulation
par: Lee, Sung-Wook, et autres
Publié: (2025)
par: Lee, Sung-Wook, et autres
Publié: (2025)
RT-Sketch: Goal-Conditioned Imitation Learning from Hand-Drawn Sketches
par: Sundaresan, Priya, et autres
Publié: (2024)
par: Sundaresan, Priya, et autres
Publié: (2024)
How to Instruct Your Robot: Dense Language Annotations Power Robot Policy Learning
par: Kim, Bosung, et autres
Publié: (2026)
par: Kim, Bosung, et autres
Publié: (2026)
Uncertainty-Aware Deployment of Pre-trained Language-Conditioned Imitation Learning Policies
par: Wu, Bo, et autres
Publié: (2024)
par: Wu, Bo, et autres
Publié: (2024)
Gaze2Act: Gaze-Conditioned Vision-Language-Action Policies for Interactive Robot Manipulation
par: Zuo, Kuangji, et autres
Publié: (2026)
par: Zuo, Kuangji, et autres
Publié: (2026)
Learning Quadrupedal Locomotion for a Heavy Hydraulic Robot Using an Actuator Model
par: Lee, Minho, et autres
Publié: (2026)
par: Lee, Minho, et autres
Publié: (2026)
RT-H: Action Hierarchies Using Language
par: Belkhale, Suneel, et autres
Publié: (2024)
par: Belkhale, Suneel, et autres
Publié: (2024)
Voronoi-based Second-order Descriptor with Whitened Metric in LiDAR Place Recognition
par: Kim, Jaein, et autres
Publié: (2026)
par: Kim, Jaein, et autres
Publié: (2026)
LAMP: Implicit Language Map for Robot Navigation
par: Lee, Sibaek, et autres
Publié: (2026)
par: Lee, Sibaek, et autres
Publié: (2026)
Bridging Language and Action: A Survey of Language-Conditioned Robot Manipulation
par: Yao, Xiangtong, et autres
Publié: (2023)
par: Yao, Xiangtong, et autres
Publié: (2023)
Towards Natural Language Environment: Understanding Seamless Natural-Language-Based Human-Multi-Robot Interactions
par: Liu, Ziyi, et autres
Publié: (2026)
par: Liu, Ziyi, et autres
Publié: (2026)
CLIP-Fields: Weakly Supervised Semantic Fields for Robotic Memory
par: Shafiullah, Nur Muhammad Mahi, et autres
Publié: (2022)
par: Shafiullah, Nur Muhammad Mahi, et autres
Publié: (2022)
Iterative On-Policy Refinement of Hierarchical Diffusion Policies for Language-Conditioned Manipulation
par: Grislain, Clemence, et autres
Publié: (2026)
par: Grislain, Clemence, et autres
Publié: (2026)
Learning Robotic Manipulation Policies from Point Clouds with Conditional Flow Matching
par: Chisari, Eugenio, et autres
Publié: (2024)
par: Chisari, Eugenio, et autres
Publié: (2024)
From Words to Safety: Language-Conditioned Safety Filtering for Robot Navigation
par: Feng, Zeyuan, et autres
Publié: (2025)
par: Feng, Zeyuan, et autres
Publié: (2025)
LeLaN: Learning A Language-Conditioned Navigation Policy from In-the-Wild Videos
par: Hirose, Noriaki, et autres
Publié: (2024)
par: Hirose, Noriaki, et autres
Publié: (2024)
ARO: Large Language Model Supervised Robotics Text2Skill Autonomous Learning
par: Chen, Yiwen, et autres
Publié: (2024)
par: Chen, Yiwen, et autres
Publié: (2024)
Vision-Language-Policy Model for Dynamic Robot Task Planning
par: Wang, Jin, et autres
Publié: (2025)
par: Wang, Jin, et autres
Publié: (2025)
EndoForce: Development of an Intuitive Axial Force Measurement Device for Endoscopic Robotic Systems
par: Kim, Hansoul, et autres
Publié: (2025)
par: Kim, Hansoul, et autres
Publié: (2025)
LEGO-SLAM: Language-Embedded Gaussian Optimization SLAM
par: Lee, Sibaek, et autres
Publié: (2025)
par: Lee, Sibaek, et autres
Publié: (2025)
Dynamic Policy Learning for Legged Robot with Simplified Model Pretraining and Model Homotopy Transfer
par: Kang, Dongyun, et autres
Publié: (2025)
par: Kang, Dongyun, et autres
Publié: (2025)
Learning a High-quality Robotic Wiping Policy Using Systematic Reward Analysis and Visual-Language Model Based Curriculum
par: Liu, Yihong, et autres
Publié: (2025)
par: Liu, Yihong, et autres
Publié: (2025)
Updating Robot Safety Representations Online from Natural Language Feedback
par: Santos, Leonardo, et autres
Publié: (2024)
par: Santos, Leonardo, et autres
Publié: (2024)
Diff-DAgger: Uncertainty Estimation with Diffusion Policy for Robotic Manipulation
par: Lee, Sung-Wook, et autres
Publié: (2024)
par: Lee, Sung-Wook, et autres
Publié: (2024)
Documents similaires
-
PROGrasp: Pragmatic Human-Robot Communication for Object Grasping
par: Kang, Gi-Cheon, et autres
Publié: (2023) -
PGA: Personalizing Grasping Agents with Single Human-Robot Interaction
par: Kim, Junghyun, et autres
Publié: (2023) -
ESPADA: Execution Speedup via Semantics Aware Demonstration Data Downsampling for Imitation Learning
par: Kim, Byung-ju, et autres
Publié: (2025) -
Socratic Planner: Self-QA-Based Zero-Shot Planning for Embodied Instruction Following
par: Shin, Suyeon, et autres
Publié: (2024) -
Multi-Object RANSAC: Efficient Plane Clustering Method in a Clutter
par: Lim, Seunghyeon, et autres
Publié: (2024)