TLA: Tactile-Language-Action Model for Contact-Rich Manipulation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hao, Peng, Zhang, Chaofan, Li, Dingzhe, Cao, Xiaoge, Hao, Xiaoshuai, Cui, Shaowei, Wang, Shuo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation
par: Zhang, Chaofan, et autres
Publié: (2025)
par: Zhang, Chaofan, et autres
Publié: (2025)
FD-VLA: Force-Distilled Vision-Language-Action Model for Contact-Rich Manipulation
par: Zhao, Ruiteng, et autres
Publié: (2026)
par: Zhao, Ruiteng, et autres
Publié: (2026)
CLTP: Contrastive Language-Tactile Pre-training for 3D Contact Geometry Understanding
par: Ma, Wenxuan, et autres
Publié: (2025)
par: Ma, Wenxuan, et autres
Publié: (2025)
Learning to Feel the Future: DreamTacVLA for Contact-Rich Manipulation
par: Ye, Guo, et autres
Publié: (2025)
par: Ye, Guo, et autres
Publié: (2025)
DriveWorld-VLA: Unified Latent-Space World Modeling with Vision-Language-Action for Autonomous Driving
par: jia, Feiyang, et autres
Publié: (2026)
par: jia, Feiyang, et autres
Publié: (2026)
MemoryVLA: Perceptual-Cognitive Memory in Vision-Language-Action Models for Robotic Manipulation
par: Shi, Hao, et autres
Publié: (2025)
par: Shi, Hao, et autres
Publié: (2025)
VTAO-BiManip: Masked Visual-Tactile-Action Pre-training with Object Understanding for Bimanual Dexterous Manipulation
par: Sun, Zhengnan, et autres
Publié: (2025)
par: Sun, Zhengnan, et autres
Publié: (2025)
InstructVLA: Vision-Language-Action Instruction Tuning from Understanding to Manipulation
par: Yang, Shuai, et autres
Publié: (2025)
par: Yang, Shuai, et autres
Publié: (2025)
CronusVLA: Towards Efficient and Robust Manipulation via Multi-Frame Vision-Language-Action Modeling
par: Li, Hao, et autres
Publié: (2025)
par: Li, Hao, et autres
Publié: (2025)
MAP-VLA: Memory-Augmented Prompting for Vision-Language-Action Model in Robotic Manipulation
par: Li, Runhao, et autres
Publié: (2025)
par: Li, Runhao, et autres
Publié: (2025)
Planning-Guided Diffusion Policy Learning for Generalizable Contact-Rich Bimanual Manipulation
par: Li, Xuanlin, et autres
Publié: (2024)
par: Li, Xuanlin, et autres
Publié: (2024)
General Covariant Action Modeling: Constructing Generalized Manifolds via Spatio-Temporal Decoupling
par: Lyu, Huaihai, et autres
Publié: (2026)
par: Lyu, Huaihai, et autres
Publié: (2026)
PEAfowl: Perception-Enhanced Multi-View Vision-Language-Action for Bimanual Manipulation
par: Fan, Qingyu, et autres
Publié: (2026)
par: Fan, Qingyu, et autres
Publié: (2026)
Tactile Modality Fusion for Vision-Language-Action Models
par: Morissette, Charlotte, et autres
Publié: (2026)
par: Morissette, Charlotte, et autres
Publié: (2026)
AnyTouch 2: General Optical Tactile Representation Learning For Dynamic Tactile Perception
par: Feng, Ruoxuan, et autres
Publié: (2026)
par: Feng, Ruoxuan, et autres
Publié: (2026)
Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey
par: Shao, Rui, et autres
Publié: (2025)
par: Shao, Rui, et autres
Publié: (2025)
BitVLA: 1-bit Vision-Language-Action Models for Robotics Manipulation
par: Wang, Hongyu, et autres
Publié: (2025)
par: Wang, Hongyu, et autres
Publié: (2025)
GeneralVLA: Generalizable Vision-Language-Action Models with Knowledge-Guided Trajectory Planning
par: Ma, Guoqing, et autres
Publié: (2026)
par: Ma, Guoqing, et autres
Publié: (2026)
Simultaneous Tactile-Visual Perception for Learning Multimodal Robot Manipulation
par: Li, Yuyang, et autres
Publié: (2025)
par: Li, Yuyang, et autres
Publié: (2025)
ForceVLA: Enhancing VLA Models with a Force-aware MoE for Contact-rich Manipulation
par: Yu, Jiawen, et autres
Publié: (2025)
par: Yu, Jiawen, et autres
Publié: (2025)
TinyVLA: Towards Fast, Data-Efficient Vision-Language-Action Models for Robotic Manipulation
par: Wen, Junjie, et autres
Publié: (2024)
par: Wen, Junjie, et autres
Publié: (2024)
Unified Vision-Language-Action Model
par: Wang, Yuqi, et autres
Publié: (2025)
par: Wang, Yuqi, et autres
Publié: (2025)
SaPaVe: Towards Active Perception and Manipulation in Vision-Language-Action Models for Robotics
par: Liu, Mengzhen, et autres
Publié: (2026)
par: Liu, Mengzhen, et autres
Publié: (2026)
FeelAnyForce: Estimating Contact Force Feedback from Tactile Sensation for Vision-Based Tactile Sensors
par: Shahidzadeh, Amir-Hossein, et autres
Publié: (2024)
par: Shahidzadeh, Amir-Hossein, et autres
Publié: (2024)
Observe Then Act: Asynchronous Active Vision-Action Model for Robotic Manipulation
par: Wang, Guokang, et autres
Publié: (2024)
par: Wang, Guokang, et autres
Publié: (2024)
VQ-VLA: Improving Vision-Language-Action Models via Scaling Vector-Quantized Action Tokenizers
par: Wang, Yating, et autres
Publié: (2025)
par: Wang, Yating, et autres
Publié: (2025)
RoboBrain: A Unified Brain Model for Robotic Manipulation from Abstract to Concrete
par: Ji, Yuheng, et autres
Publié: (2025)
par: Ji, Yuheng, et autres
Publié: (2025)
See, Plan, Rewind: Progress-Aware Vision-Language-Action Models for Robust Robotic Manipulation
par: Dai, Tingjun, et autres
Publié: (2026)
par: Dai, Tingjun, et autres
Publié: (2026)
Vision Language Action Models in Robotic Manipulation: A Systematic Review
par: Din, Muhayy Ud, et autres
Publié: (2025)
par: Din, Muhayy Ud, et autres
Publié: (2025)
From Imagined Futures to Executable Actions: Mixture of Latent Actions for Robot Manipulation
par: Li, Yajie, et autres
Publié: (2026)
par: Li, Yajie, et autres
Publié: (2026)
FG-CLTP: Fine-Grained Contrastive Language Tactile Pretraining for Robotic Manipulation
par: Ma, Wenxuan, et autres
Publié: (2026)
par: Ma, Wenxuan, et autres
Publié: (2026)
Grounding Actions in Camera Space: Observation-Centric Vision-Language-Action Policy
par: Zhang, Tianyi, et autres
Publié: (2025)
par: Zhang, Tianyi, et autres
Publié: (2025)
DexSkin: High-Coverage Conformable Robotic Skin for Learning Contact-Rich Manipulation
par: Wistreich, Suzannah, et autres
Publié: (2025)
par: Wistreich, Suzannah, et autres
Publié: (2025)
IRL-VLA: Training an Vision-Language-Action Policy via Reward World Model
par: Jiang, Anqing, et autres
Publié: (2025)
par: Jiang, Anqing, et autres
Publié: (2025)
F1: A Vision-Language-Action Model Bridging Understanding and Generation to Actions
par: Lv, Qi, et autres
Publié: (2025)
par: Lv, Qi, et autres
Publié: (2025)
Beyond Binary Success: A Diagnostic Meta-Evaluation Framework for Fine-Grained Manipulation
par: Xu, He-Yang, et autres
Publié: (2026)
par: Xu, He-Yang, et autres
Publié: (2026)
DynamicVLA: A Vision-Language-Action Model for Dynamic Object Manipulation
par: Xie, Haozhe, et autres
Publié: (2026)
par: Xie, Haozhe, et autres
Publié: (2026)
Hearing Touch: Audio-Visual Pretraining for Contact-Rich Manipulation
par: Mejia, Jared, et autres
Publié: (2024)
par: Mejia, Jared, et autres
Publié: (2024)
Ensuring Force Safety in Vision-Guided Robotic Manipulation via Implicit Tactile Calibration
par: Wei, Lai, et autres
Publié: (2024)
par: Wei, Lai, et autres
Publié: (2024)
Global Prior Meets Local Consistency: Dual-Memory Augmented Vision-Language-Action Model for Efficient Robotic Manipulation
par: Li, Zaijing, et autres
Publié: (2026)
par: Li, Zaijing, et autres
Publié: (2026)
Documents similaires
-
VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation
par: Zhang, Chaofan, et autres
Publié: (2025) -
FD-VLA: Force-Distilled Vision-Language-Action Model for Contact-Rich Manipulation
par: Zhao, Ruiteng, et autres
Publié: (2026) -
CLTP: Contrastive Language-Tactile Pre-training for 3D Contact Geometry Understanding
par: Ma, Wenxuan, et autres
Publié: (2025) -
Learning to Feel the Future: DreamTacVLA for Contact-Rich Manipulation
par: Ye, Guo, et autres
Publié: (2025) -
DriveWorld-VLA: Unified Latent-Space World Modeling with Vision-Language-Action for Autonomous Driving
par: jia, Feiyang, et autres
Publié: (2026)