A Vision-Language-Action Model for Adaptive Ultrasound-Guided Needle Insertion and Needle Tracking
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Yuelin, Ding, Qingpeng, Tang, Longxiang, Fang, Chengyu, Cheng, Shing Shin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MambaXCTrack: Mamba-based Tracker with SSM Cross-correlation and Motion Prompt for Ultrasound Needle Tracking
par: Zhang, Yuelin, et autres
Publié: (2024)
par: Zhang, Yuelin, et autres
Publié: (2024)
MrTrack: Register Mamba for Needle Tracking with Rapid Reciprocating Motion during Ultrasound-Guided Aspiration Biopsy
par: Zhang, Yuelin, et autres
Publié: (2025)
par: Zhang, Yuelin, et autres
Publié: (2025)
Exploring the Adversarial Vulnerabilities of Vision-Language-Action Models in Robotics
par: Wang, Taowen, et autres
Publié: (2024)
par: Wang, Taowen, et autres
Publié: (2024)
V-VLAPS: Value-Guided Planning for Vision-Language-Action Models
par: Ren, Ke, et autres
Publié: (2026)
par: Ren, Ke, et autres
Publié: (2026)
Bring My Cup! Personalizing Vision-Language-Action Models with Visual Attentive Prompting
par: Lee, Sangoh, et autres
Publié: (2025)
par: Lee, Sangoh, et autres
Publié: (2025)
EndoVLA: Dual-Phase Vision-Language-Action Model for Autonomous Tracking in Endoscopy
par: Ng, Chi Kit, et autres
Publié: (2025)
par: Ng, Chi Kit, et autres
Publié: (2025)
MoRE: Unlocking Scalability in Reinforcement Learning for Quadruped Vision-Language-Action Models
par: Zhao, Han, et autres
Publié: (2025)
par: Zhao, Han, et autres
Publié: (2025)
ContextVLA: Vision-Language-Action Model with Amortized Multi-Frame Context
par: Jang, Huiwon, et autres
Publié: (2025)
par: Jang, Huiwon, et autres
Publié: (2025)
AsyncVLA: Asynchronous Flow Matching for Vision-Language-Action Models
par: Jiang, Yuhua, et autres
Publié: (2025)
par: Jiang, Yuhua, et autres
Publié: (2025)
Hierarchical Vision Language Action Model Using Success and Failure Demonstrations
par: Park, Jeongeun, et autres
Publié: (2025)
par: Park, Jeongeun, et autres
Publié: (2025)
ActionFlow: A Pipelined Action Acceleration for Vision Language Models on Edge
par: Dai, Yuntao, et autres
Publié: (2025)
par: Dai, Yuntao, et autres
Publié: (2025)
Adaptive Capacity Allocation for Vision Language Action Fine-tuning
par: Kim, Donghoon, et autres
Publié: (2026)
par: Kim, Donghoon, et autres
Publié: (2026)
Action Hallucination in Generative Vision-Language-Action Models
par: Soh, Harold, et autres
Publié: (2026)
par: Soh, Harold, et autres
Publié: (2026)
Survey of Vision-Language-Action Models for Embodied Manipulation
par: Li, Haoran, et autres
Publié: (2025)
par: Li, Haoran, et autres
Publié: (2025)
Beyond Needle(s) in the Embodied Haystack: Environment, Architecture, and Training Considerations for Long Context Reasoning
par: Kim, Bosung, et autres
Publié: (2025)
par: Kim, Bosung, et autres
Publié: (2025)
Verifier-free Test-Time Sampling for Vision Language Action Models
par: Jang, Suhyeok, et autres
Publié: (2025)
par: Jang, Suhyeok, et autres
Publié: (2025)
DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation
par: Su, Taiyi, et autres
Publié: (2026)
par: Su, Taiyi, et autres
Publié: (2026)
Experiences from Benchmarking Vision-Language-Action Models for Robotic Manipulation
par: Zhang, Yihao, et autres
Publié: (2025)
par: Zhang, Yihao, et autres
Publié: (2025)
AR-VLA: True Autoregressive Action Expert for Vision-Language-Action Models
par: Hu, Yutong, et autres
Publié: (2026)
par: Hu, Yutong, et autres
Publié: (2026)
Adversarial Attacks on Robotic Vision Language Action Models
par: Jones, Eliot Krzysztof, et autres
Publié: (2025)
par: Jones, Eliot Krzysztof, et autres
Publié: (2025)
Needle Biopsy And Fiber-Optic Compatible Robotic Insertion Platform
par: Wang, Fanxin, et autres
Publié: (2025)
par: Wang, Fanxin, et autres
Publié: (2025)
ALOE: Action-Level Off-Policy Evaluation for Vision-Language-Action Model Post-Training
par: Yang, Rushuai, et autres
Publié: (2026)
par: Yang, Rushuai, et autres
Publié: (2026)
Pure Vision Language Action (VLA) Models: A Comprehensive Survey
par: Zhang, Dapeng, et autres
Publié: (2025)
par: Zhang, Dapeng, et autres
Publié: (2025)
A Unified Framework for Microscopy Defocus Deblur with Multi-Pyramid Transformer and Contrastive Learning
par: Zhang, Yuelin, et autres
Publié: (2024)
par: Zhang, Yuelin, et autres
Publié: (2024)
A Vision-Language-Action-Critic Model for Robotic Real-World Reinforcement Learning
par: Zhai, Shaopeng, et autres
Publié: (2025)
par: Zhai, Shaopeng, et autres
Publié: (2025)
ReconVLA: An Uncertainty-Guided and Failure-Aware Vision-Language-Action Framework for Robotic Control
par: Chen, Lingling, et autres
Publié: (2026)
par: Chen, Lingling, et autres
Publié: (2026)
villa-X: Enhancing Latent Action Modeling in Vision-Language-Action Models
par: Chen, Xiaoyu, et autres
Publié: (2025)
par: Chen, Xiaoyu, et autres
Publié: (2025)
Developing Vision-Language-Action Model from Egocentric Videos
par: Yoshida, Tomoya, et autres
Publié: (2025)
par: Yoshida, Tomoya, et autres
Publié: (2025)
Emergence of Human to Robot Transfer in Vision-Language-Action Models
par: Kareer, Simar, et autres
Publié: (2025)
par: Kareer, Simar, et autres
Publié: (2025)
SAFE: Multitask Failure Detection for Vision-Language-Action Models
par: Gu, Qiao, et autres
Publié: (2025)
par: Gu, Qiao, et autres
Publié: (2025)
Continually Evolving Skill Knowledge in Vision Language Action Model
par: Wu, Yuxuan, et autres
Publié: (2025)
par: Wu, Yuxuan, et autres
Publié: (2025)
SCALE: Self-uncertainty Conditioned Adaptive Looking and Execution for Vision-Language-Action Models
par: Choi, Hyeonbeom, et autres
Publié: (2026)
par: Choi, Hyeonbeom, et autres
Publié: (2026)
SignVLA: A Gloss-Free Vision-Language-Action Framework for Real-Time Sign Language-Guided Robotic Manipulation
par: Tan, Xinyu, et autres
Publié: (2026)
par: Tan, Xinyu, et autres
Publié: (2026)
WMPO: World Model-based Policy Optimization for Vision-Language-Action Models
par: Zhu, Fangqi, et autres
Publié: (2025)
par: Zhu, Fangqi, et autres
Publié: (2025)
Eva-VLA: Evaluating Vision-Language-Action Models' Robustness Under Real-World Physical Variations
par: Liu, Hanqing, et autres
Publié: (2025)
par: Liu, Hanqing, et autres
Publié: (2025)
Towards Backdoor-Based Ownership Verification for Vision-Language-Action Models
par: Sun, Ming, et autres
Publié: (2026)
par: Sun, Ming, et autres
Publié: (2026)
10 Open Challenges Steering the Future of Vision-Language-Action Models
par: Poria, Soujanya, et autres
Publié: (2025)
par: Poria, Soujanya, et autres
Publié: (2025)
Do What? Teaching Vision-Language-Action Models to Reject the Impossible
par: Hsieh, Wen-Han, et autres
Publié: (2025)
par: Hsieh, Wen-Han, et autres
Publié: (2025)
When to Trust Imagination: Adaptive Action Execution for World Action Models
par: Wang, Rui, et autres
Publié: (2026)
par: Wang, Rui, et autres
Publié: (2026)
Action-aware Dynamic Pruning for Efficient Vision-Language-Action Manipulation
par: Pei, Xiaohuan, et autres
Publié: (2025)
par: Pei, Xiaohuan, et autres
Publié: (2025)
Documents similaires
-
MambaXCTrack: Mamba-based Tracker with SSM Cross-correlation and Motion Prompt for Ultrasound Needle Tracking
par: Zhang, Yuelin, et autres
Publié: (2024) -
MrTrack: Register Mamba for Needle Tracking with Rapid Reciprocating Motion during Ultrasound-Guided Aspiration Biopsy
par: Zhang, Yuelin, et autres
Publié: (2025) -
Exploring the Adversarial Vulnerabilities of Vision-Language-Action Models in Robotics
par: Wang, Taowen, et autres
Publié: (2024) -
V-VLAPS: Value-Guided Planning for Vision-Language-Action Models
par: Ren, Ke, et autres
Publié: (2026) -
Bring My Cup! Personalizing Vision-Language-Action Models with Visual Attentive Prompting
par: Lee, Sangoh, et autres
Publié: (2025)