TMR-VLA:Vision-Language-Action Model for Magnetic Motion Control of Tri-leg Silicone-based Soft Robot
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tang, Ruijie, Ng, Chi Kit, Wu, Kaixuan, Bai, Long, Wang, Guankun, Huang, Yiming, Wang, Yupeng, Ren, Hongliang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EndoVLA: Dual-Phase Vision-Language-Action Model for Autonomous Tracking in Endoscopy
par: Ng, Chi Kit, et autres
Publié: (2025)
par: Ng, Chi Kit, et autres
Publié: (2025)
How can reasoning capability empower the AI copilot robot in endoscopic surgery
par: Wang, Guankun, et autres
Publié: (2026)
par: Wang, Guankun, et autres
Publié: (2026)
Surgical-VQLA++: Adversarial Contrastive Learning for Calibrated Robust Visual Question-Localized Answering in Robotic Surgery
par: Bai, Long, et autres
Publié: (2024)
par: Bai, Long, et autres
Publié: (2024)
Jacobian Exploratory Dual-Phase Reinforcement Learning for Dynamic Endoluminal Navigation of Deformable Continuum Robots
par: Tian, Yu, et autres
Publié: (2025)
par: Tian, Yu, et autres
Publié: (2025)
GeoLanG: Geometry-Aware Language-Guided Grasping with Unified RGB-D Multimodal Learning
par: Tang, Rui, et autres
Publié: (2026)
par: Tang, Rui, et autres
Publié: (2026)
Leveling3D: Leveling Up 3D Reconstruction with Feed-Forward 3D Gaussian Splatting and Geometry-Aware Generation
par: Huang, Yiming, et autres
Publié: (2026)
par: Huang, Yiming, et autres
Publié: (2026)
Can DeepSeek Reason Like a Surgeon? An Empirical Evaluation for Vision-Language Understanding in Robotic-Assisted Surgery
par: Ma, Boyi, et autres
Publié: (2025)
par: Ma, Boyi, et autres
Publié: (2025)
EndoOOD: Uncertainty-aware Out-of-distribution Detection in Capsule Endoscopy Diagnosis
par: Tan, Qiaozhi, et autres
Publié: (2024)
par: Tan, Qiaozhi, et autres
Publié: (2024)
Web-based Augmented Reality with Auto-Scaling and Real-Time Head Tracking towards Markerless Neurointerventional Preoperative Planning and Training of Head-mounted Robotic Needle Insertion
par: Ho, Hon Lung, et autres
Publié: (2024)
par: Ho, Hon Lung, et autres
Publié: (2024)
CoPESD: A Multi-Level Surgical Motion Dataset for Training Large Vision-Language Models to Co-Pilot Endoscopic Submucosal Dissection
par: Wang, Guankun, et autres
Publié: (2024)
par: Wang, Guankun, et autres
Publié: (2024)
OSSAR: Towards Open-Set Surgical Activity Recognition in Robot-assisted Surgery
par: Bai, Long, et autres
Publié: (2024)
par: Bai, Long, et autres
Publié: (2024)
EndoARSS: Adapting Spatially-Aware Foundation Model for Efficient Activity Recognition and Semantic Segmentation in Endoscopic Surgery
par: Wang, Guankun, et autres
Publié: (2025)
par: Wang, Guankun, et autres
Publié: (2025)
EndoARSS: Adapting Spatially Aware Foundation Model for Efficient Activity Recognition and Semantic Segmentation in Endoscopic Surgery
par: Guankun Wang, et autres
Publié: (2025)
par: Guankun Wang, et autres
Publié: (2025)
Surgical-LVLM: Learning to Adapt Large Vision-Language Model for Grounded Visual Question Answering in Robotic Surgery
par: Wang, Guankun, et autres
Publié: (2024)
par: Wang, Guankun, et autres
Publié: (2024)
Contact-Aided Navigation of Flexible Robotic Endoscope Using Deep Reinforcement Learning in Dynamic Stomach
par: Ng, Chi Kit, et autres
Publié: (2025)
par: Ng, Chi Kit, et autres
Publié: (2025)
Adapting SAM for Surgical Instrument Tracking and Segmentation in Endoscopic Submucosal Dissection Videos
par: Yu, Jieming, et autres
Publié: (2024)
par: Yu, Jieming, et autres
Publié: (2024)
Geo-RepNet: Geometry-Aware Representation Learning for Surgical Phase Recognition in Endoscopic Submucosal Dissection
par: Tang, Rui, et autres
Publié: (2025)
par: Tang, Rui, et autres
Publié: (2025)
ETSM: Automating Dissection Trajectory Suggestion and Confidence Map-Based Safety Margin Prediction for Robot-assisted Endoscopic Submucosal Dissection
par: Xu, Mengya, et autres
Publié: (2024)
par: Xu, Mengya, et autres
Publié: (2024)
RoboNurse-VLA: Robotic Scrub Nurse System based on Vision-Language-Action Model
par: Li, Shunlei, et autres
Publié: (2024)
par: Li, Shunlei, et autres
Publié: (2024)
SurgTPGS: Semantic 3D Surgical Scene Understanding with Text Promptable Gaussian Splatting
par: Huang, Yiming, et autres
Publié: (2025)
par: Huang, Yiming, et autres
Publié: (2025)
QUAR-VLA: Vision-Language-Action Model for Quadruped Robots
par: Ding, Pengxiang, et autres
Publié: (2023)
par: Ding, Pengxiang, et autres
Publié: (2023)
BitVLA: 1-bit Vision-Language-Action Models for Robotics Manipulation
par: Wang, Hongyu, et autres
Publié: (2025)
par: Wang, Hongyu, et autres
Publié: (2025)
Latent Reasoning VLA: Latent Thinking and Prediction for Vision-Language-Action Models
par: Bai, Shuanghao, et autres
Publié: (2026)
par: Bai, Shuanghao, et autres
Publié: (2026)
FTI-TMR: A Fault Tolerance and Isolation Algorithm for Interconnected Multicore Systems
par: Hu, Yiming
Publié: (2025)
par: Hu, Yiming
Publié: (2025)
PDZSeg: Adapting the Foundation Model for Dissection Zone Segmentation with Visual Prompts in Robot-assisted Endoscopic Submucosal Dissection
par: Xu, Mengya, et autres
Publié: (2024)
par: Xu, Mengya, et autres
Publié: (2024)
A Review of 3D Reconstruction Techniques for Deformable Tissues in Robotic Surgery
par: Xu, Mengya, et autres
Publié: (2024)
par: Xu, Mengya, et autres
Publié: (2024)
TR2M: Transferring Monocular Relative Depth to Metric Depth with Language Descriptions and Dual-Level Scale-Oriented Contrast
par: Cui, Beilei, et autres
Publié: (2025)
par: Cui, Beilei, et autres
Publié: (2025)
X-VLA: Soft-Prompted Transformer as Scalable Cross-Embodiment Vision-Language-Action Model
par: Zheng, Jinliang, et autres
Publié: (2025)
par: Zheng, Jinliang, et autres
Publié: (2025)
TriVLA: A Triple-System-Based Unified Vision-Language-Action Model with Episodic World Modeling for General Robot Control
par: Liu, Zhenyang, et autres
Publié: (2025)
par: Liu, Zhenyang, et autres
Publié: (2025)
MAP-VLA: Memory-Augmented Prompting for Vision-Language-Action Model in Robotic Manipulation
par: Li, Runhao, et autres
Publié: (2025)
par: Li, Runhao, et autres
Publié: (2025)
Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation
par: Fan, Yiguo, et autres
Publié: (2025)
par: Fan, Yiguo, et autres
Publié: (2025)
Automatic Virtual‐to‐real Calibration and Dynamic Registration of Deformable Tissue for Endoscopic Submucosal Dissection
par: Yupeng Wang, et autres
Publié: (2025)
par: Yupeng Wang, et autres
Publié: (2025)
ReconVLA: Reconstructive Vision-Language-Action Model as Effective Robot Perceiver
par: Song, Wenxuan, et autres
Publié: (2025)
par: Song, Wenxuan, et autres
Publié: (2025)
Privacy-Preserving Synthetic Continual Semantic Segmentation for Robotic Surgery
par: Xu, Mengya, et autres
Publié: (2024)
par: Xu, Mengya, et autres
Publié: (2024)
HiF-VLA: Hindsight, Insight and Foresight through Motion Representation for Vision-Language-Action Models
par: Lin, Minghui, et autres
Publié: (2025)
par: Lin, Minghui, et autres
Publié: (2025)
ACoT-VLA: Action Chain-of-Thought for Vision-Language-Action Models
par: Zhong, Linqing, et autres
Publié: (2026)
par: Zhong, Linqing, et autres
Publié: (2026)
Green-VLA: Staged Vision-Language-Action Model for Generalist Robots
par: Apanasevich, I., et autres
Publié: (2026)
par: Apanasevich, I., et autres
Publié: (2026)
Three-dimensional Morphological Reconstruction of Millimeter-Scale Soft Continuum Robots based on Dual-Stereo-Vision
par: Ren, Tian-Ao, et autres
Publié: (2024)
par: Ren, Tian-Ao, et autres
Publié: (2024)
FlowVLA: Visual Chain of Thought-based Motion Reasoning for Vision-Language-Action Models
par: Zhong, Zhide, et autres
Publié: (2025)
par: Zhong, Zhide, et autres
Publié: (2025)
MemoryVLA: Perceptual-Cognitive Memory in Vision-Language-Action Models for Robotic Manipulation
par: Shi, Hao, et autres
Publié: (2025)
par: Shi, Hao, et autres
Publié: (2025)
Documents similaires
-
EndoVLA: Dual-Phase Vision-Language-Action Model for Autonomous Tracking in Endoscopy
par: Ng, Chi Kit, et autres
Publié: (2025) -
How can reasoning capability empower the AI copilot robot in endoscopic surgery
par: Wang, Guankun, et autres
Publié: (2026) -
Surgical-VQLA++: Adversarial Contrastive Learning for Calibrated Robust Visual Question-Localized Answering in Robotic Surgery
par: Bai, Long, et autres
Publié: (2024) -
Jacobian Exploratory Dual-Phase Reinforcement Learning for Dynamic Endoluminal Navigation of Deformable Continuum Robots
par: Tian, Yu, et autres
Publié: (2025) -
GeoLanG: Geometry-Aware Language-Guided Grasping with Unified RGB-D Multimodal Learning
par: Tang, Rui, et autres
Publié: (2026)