Octopi: Object Property Reasoning with Large Tactile-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Samson, Lin, Kelvin, Xiao, Anxing, Duan, Jiafei, Soh, Harold |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Demonstrating the Octopi-1.5 Visual-Tactile-Language Model
par: Yu, Samson, et autres
Publié: (2025)
par: Yu, Samson, et autres
Publié: (2025)
CHD: Coupled Hierarchical Diffusion for Long-Horizon Tasks
par: Hao, Ce, et autres
Publié: (2025)
par: Hao, Ce, et autres
Publié: (2025)
GRaCE: Balancing Multiple Criteria to Achieve Stable, Collision-Free, and Functional Grasps
par: Taunyazov, Tasbolat, et autres
Publié: (2023)
par: Taunyazov, Tasbolat, et autres
Publié: (2023)
LLM-State: Open World State Representation for Long-horizon Task Planning with Large Language Model
par: Chen, Siwei, et autres
Publié: (2023)
par: Chen, Siwei, et autres
Publié: (2023)
DISCO: Language-Guided Manipulation with Diffusion Policies and Constrained Inpainting
par: Hao, Ce, et autres
Publié: (2024)
par: Hao, Ce, et autres
Publié: (2024)
VLA-Touch: Enhancing Vision-Language-Action Models with Dual-Level Tactile Feedback
par: Bi, Jianxin, et autres
Publié: (2025)
par: Bi, Jianxin, et autres
Publié: (2025)
Large Language Models as Zero-Shot Human Models for Human-Robot Interaction
par: Zhang, Bowen, et autres
Publié: (2023)
par: Zhang, Bowen, et autres
Publié: (2023)
Action Hallucination in Generative Vision-Language-Action Models
par: Soh, Harold, et autres
Publié: (2026)
par: Soh, Harold, et autres
Publié: (2026)
FailSafe: Reasoning and Recovery from Failures in Vision-Language-Action Models
par: Lin, Zijun, et autres
Publié: (2025)
par: Lin, Zijun, et autres
Publié: (2025)
NUSense: Robust Soft Optical Tactile Sensor
par: Yergibay, Madina, et autres
Publié: (2024)
par: Yergibay, Madina, et autres
Publié: (2024)
Guided Streaming Stochastic Interpolant Policy
par: Jiang, Puming, et autres
Publié: (2026)
par: Jiang, Puming, et autres
Publié: (2026)
Embodied Tactile Perception of Soft Objects Properties
par: Dutta, Anirvan, et autres
Publié: (2025)
par: Dutta, Anirvan, et autres
Publié: (2025)
Don't Start from Scratch: Behavioral Refinement via Interpolant-based Policy Diffusion
par: Chen, Kaiqi, et autres
Publié: (2024)
par: Chen, Kaiqi, et autres
Publié: (2024)
Robotic Perception with a Large Tactile-Vision-Language Model for Physical Property Inference
par: Guo, Zexiang, et autres
Publié: (2025)
par: Guo, Zexiang, et autres
Publié: (2025)
Imitation Learning with Limited Actions via Diffusion Planners and Deep Koopman Controllers
par: Bi, Jianxin, et autres
Publié: (2024)
par: Bi, Jianxin, et autres
Publié: (2024)
GSON: A Group-based Social Navigation Framework with Large Multimodal Model
par: Luo, Shangyi, et autres
Publié: (2024)
par: Luo, Shangyi, et autres
Publié: (2024)
Visibility-Aware Mobile Grasping in Dynamic Environments
par: Hu, Tianrun, et autres
Publié: (2026)
par: Hu, Tianrun, et autres
Publié: (2026)
Visuo-Tactile Zero-Shot Object Recognition with Vision-Language Model
par: Ueda, Shiori, et autres
Publié: (2024)
par: Ueda, Shiori, et autres
Publié: (2024)
Recurrent-Depth VLA: Implicit Test-Time Compute Scaling of Vision-Language-Action Models via Latent Iterative Reasoning
par: Tur, Yalcin, et autres
Publié: (2026)
par: Tur, Yalcin, et autres
Publié: (2026)
Predictive Visuo-Tactile Interactive Perception Framework for Object Properties Inference
par: Dutta, Anirvan, et autres
Publié: (2024)
par: Dutta, Anirvan, et autres
Publié: (2024)
AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation
par: Duan, Jiafei, et autres
Publié: (2024)
par: Duan, Jiafei, et autres
Publié: (2024)
CANINE: Coaching Visually Impaired Users for Interactive Navigation with a Robot Guide Dog
par: Yu, Cunjun, et autres
Publié: (2026)
par: Yu, Cunjun, et autres
Publié: (2026)
Zero-shot Object Navigation with Vision-Language Models Reasoning
par: Wen, Congcong, et autres
Publié: (2024)
par: Wen, Congcong, et autres
Publié: (2024)
From Obstacles to Etiquette: Robot Social Navigation with VLM-Informed Path Selection
par: Fang, Zilin, et autres
Publié: (2026)
par: Fang, Zilin, et autres
Publié: (2026)
Tactile-VLA: Unlocking Vision-Language-Action Model's Physical Knowledge for Tactile Generalization
par: Huang, Jialei, et autres
Publié: (2025)
par: Huang, Jialei, et autres
Publié: (2025)
Robot Operation of Home Appliances by Reading User Manuals
par: Zhang, Jian, et autres
Publié: (2025)
par: Zhang, Jian, et autres
Publié: (2025)
Abstracting Robot Manipulation Skills via Mixture-of-Experts Diffusion Policies
par: Hao, Ce, et autres
Publié: (2026)
par: Hao, Ce, et autres
Publié: (2026)
Training-free Task-oriented Grasp Generation
par: Wang, Jiaming, et autres
Publié: (2025)
par: Wang, Jiaming, et autres
Publié: (2025)
UniT: Data Efficient Tactile Representation with Generalization to Unseen Objects
par: Xu, Zhengtong, et autres
Publié: (2024)
par: Xu, Zhengtong, et autres
Publié: (2024)
VLS: Steering Pretrained Robot Policies via Vision-Language Models
par: Liu, Shuo, et autres
Publié: (2026)
par: Liu, Shuo, et autres
Publié: (2026)
Visuo-Tactile Keypoint Correspondences for Object Manipulation
par: Kim, Jeong-Jung, et autres
Publié: (2024)
par: Kim, Jeong-Jung, et autres
Publié: (2024)
OmniVTLA: Vision-Tactile-Language-Action Model with Semantic-Aligned Tactile Sensing
par: Cheng, Zhengxue, et autres
Publié: (2025)
par: Cheng, Zhengxue, et autres
Publié: (2025)
TaF-VLA: Tactile-Force Alignment in Vision-Language-Action Models for Force-aware Manipulation
par: Huang, Yuzhe, et autres
Publié: (2026)
par: Huang, Yuzhe, et autres
Publié: (2026)
SocRATES: Towards Automated Scenario-based Testing of Social Navigation Algorithms
par: Marpally, Shashank Rao, et autres
Publié: (2024)
par: Marpally, Shashank Rao, et autres
Publié: (2024)
Test-Time Adaptation for Tactile-Vision-Language Models
par: Ye, Chuyang, et autres
Publié: (2026)
par: Ye, Chuyang, et autres
Publié: (2026)
Measuring Object Rotation via Visuo-Tactile Segmentation
par: Castaño, Julio, et autres
Publié: (2024)
par: Castaño, Julio, et autres
Publié: (2024)
Tactile Probabilistic Contact Dynamics Estimation of Unknown Objects
par: Kim, Jinhoo, et autres
Publié: (2024)
par: Kim, Jinhoo, et autres
Publié: (2024)
VisuoTactile 6D Pose Estimation of an In-Hand Object using Vision and Tactile Sensor Data
par: Dikhale, Snehal s., et autres
Publié: (2026)
par: Dikhale, Snehal s., et autres
Publié: (2026)
TacO: Benchmarking Tactile Sensors for Object Manipulation
par: Zorin, Anya, et autres
Publié: (2026)
par: Zorin, Anya, et autres
Publié: (2026)
FOTS: A Fast Optical Tactile Simulator for Sim2Real Learning of Tactile-motor Robot Manipulation Skills
par: Zhao, Yongqiang, et autres
Publié: (2024)
par: Zhao, Yongqiang, et autres
Publié: (2024)
Documents similaires
-
Demonstrating the Octopi-1.5 Visual-Tactile-Language Model
par: Yu, Samson, et autres
Publié: (2025) -
CHD: Coupled Hierarchical Diffusion for Long-Horizon Tasks
par: Hao, Ce, et autres
Publié: (2025) -
GRaCE: Balancing Multiple Criteria to Achieve Stable, Collision-Free, and Functional Grasps
par: Taunyazov, Tasbolat, et autres
Publié: (2023) -
LLM-State: Open World State Representation for Long-horizon Task Planning with Large Language Model
par: Chen, Siwei, et autres
Publié: (2023) -
DISCO: Language-Guided Manipulation with Diffusion Policies and Constrained Inpainting
par: Hao, Ce, et autres
Publié: (2024)