RoboNurse-VLA: Robotic Scrub Nurse System based on Vision-Language-Action Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Shunlei, Wang, Jin, Dai, Rui, Ma, Wanyu, Ng, Wing Yin, Hu, Yingbai, Li, Zheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Graph-Fused Vision-Language-Action for Policy Reasoning in Multi-Arm Robotic Manipulation
di: Li, Shunlei, et al.
Pubblicazione: (2025)
di: Li, Shunlei, et al.
Pubblicazione: (2025)
Information-Theoretic Graph Fusion with Vision-Language-Action Model for Policy Reasoning and Dual Robotic Control
di: Li, Shunlei, et al.
Pubblicazione: (2025)
di: Li, Shunlei, et al.
Pubblicazione: (2025)
DAM-VLA: A Dynamic Action Model-Based Vision-Language-Action Framework for Robot Manipulation
di: Peng, Xiongfeng, et al.
Pubblicazione: (2026)
di: Peng, Xiongfeng, et al.
Pubblicazione: (2026)
MobileVLA-R1: Reinforcing Vision-Language-Action for Mobile Robots
di: Huang, Ting, et al.
Pubblicazione: (2025)
di: Huang, Ting, et al.
Pubblicazione: (2025)
TIC-VLA: A Think-in-Control Vision-Language-Action Model for Robot Navigation in Dynamic Environments
di: Huang, Zhiyu, et al.
Pubblicazione: (2026)
di: Huang, Zhiyu, et al.
Pubblicazione: (2026)
AIR-VLA: Vision-Language-Action Systems for Aerial Manipulation
di: Sun, Jianli, et al.
Pubblicazione: (2026)
di: Sun, Jianli, et al.
Pubblicazione: (2026)
RationalVLA: A Rational Vision-Language-Action Model with Dual System
di: Song, Wenxuan, et al.
Pubblicazione: (2025)
di: Song, Wenxuan, et al.
Pubblicazione: (2025)
DropVLA: An Action-Level Backdoor Attack on Vision-Language-Action Models
di: Xu, Zonghuan, et al.
Pubblicazione: (2025)
di: Xu, Zonghuan, et al.
Pubblicazione: (2025)
CrayonRobo: Object-Centric Prompt-Driven Vision-Language-Action Model for Robotic Manipulation
di: Li, Xiaoqi, et al.
Pubblicazione: (2025)
di: Li, Xiaoqi, et al.
Pubblicazione: (2025)
Green-VLA: Staged Vision-Language-Action Model for Generalist Robots
di: Apanasevich, I., et al.
Pubblicazione: (2026)
di: Apanasevich, I., et al.
Pubblicazione: (2026)
Bi-VLA: Vision-Language-Action Model-Based System for Bimanual Robotic Dexterous Manipulations
di: Gbagbe, Koffivi Fidèle, et al.
Pubblicazione: (2024)
di: Gbagbe, Koffivi Fidèle, et al.
Pubblicazione: (2024)
AC^2-VLA: Action-Context-Aware Adaptive Computation in Vision-Language-Action Models for Efficient Robotic Manipulation
di: Yu, Wenda, et al.
Pubblicazione: (2026)
di: Yu, Wenda, et al.
Pubblicazione: (2026)
FlowVLA: Visual Chain of Thought-based Motion Reasoning for Vision-Language-Action Models
di: Zhong, Zhide, et al.
Pubblicazione: (2025)
di: Zhong, Zhide, et al.
Pubblicazione: (2025)
Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation
di: Fan, Yiguo, et al.
Pubblicazione: (2025)
di: Fan, Yiguo, et al.
Pubblicazione: (2025)
StereoVLA: Enhancing Vision-Language-Action Models with Stereo Vision
di: Deng, Shengliang, et al.
Pubblicazione: (2025)
di: Deng, Shengliang, et al.
Pubblicazione: (2025)
Shake-VLA: Vision-Language-Action Model-Based System for Bimanual Robotic Manipulations and Liquid Mixing
di: Khan, Muhamamd Haris, et al.
Pubblicazione: (2025)
di: Khan, Muhamamd Haris, et al.
Pubblicazione: (2025)
Audio-VLA: Adding Contact Audio Perception to Vision-Language-Action Model for Robotic Manipulation
di: Wei, Xiangyi, et al.
Pubblicazione: (2025)
di: Wei, Xiangyi, et al.
Pubblicazione: (2025)
QUAR-VLA: Vision-Language-Action Model for Quadruped Robots
di: Ding, Pengxiang, et al.
Pubblicazione: (2023)
di: Ding, Pengxiang, et al.
Pubblicazione: (2023)
Pure Vision Language Action (VLA) Models: A Comprehensive Survey
di: Zhang, Dapeng, et al.
Pubblicazione: (2025)
di: Zhang, Dapeng, et al.
Pubblicazione: (2025)
NS-VLA: Towards Neuro-Symbolic Vision-Language-Action Models
di: Zhu, Ziyue, et al.
Pubblicazione: (2026)
di: Zhu, Ziyue, et al.
Pubblicazione: (2026)
TMR-VLA:Vision-Language-Action Model for Magnetic Motion Control of Tri-leg Silicone-based Soft Robot
di: Tang, Ruijie, et al.
Pubblicazione: (2026)
di: Tang, Ruijie, et al.
Pubblicazione: (2026)
RotVLA: Rotational Latent Action for Vision-Language-Action Model
di: Li, Qiwei, et al.
Pubblicazione: (2026)
di: Li, Qiwei, et al.
Pubblicazione: (2026)
SwitchVLA: Execution-Aware Task Switching for Vision-Language-Action Models
di: Li, Meng, et al.
Pubblicazione: (2025)
di: Li, Meng, et al.
Pubblicazione: (2025)
FutureVLA: Joint Visuomotor Prediction for Vision-Language-Action Model
di: Xu, Xiaoxu, et al.
Pubblicazione: (2026)
di: Xu, Xiaoxu, et al.
Pubblicazione: (2026)
HARP-VLA: Human-Robot Aligned Representation Learning for Vision-Language-Action Model
di: Zhu, Xiang, et al.
Pubblicazione: (2026)
di: Zhu, Xiang, et al.
Pubblicazione: (2026)
FedVLA: Federated Vision-Language-Action Learning with Dual Gating Mixture-of-Experts for Robotic Manipulation
di: Miao, Cui, et al.
Pubblicazione: (2025)
di: Miao, Cui, et al.
Pubblicazione: (2025)
ReconVLA: Reconstructive Vision-Language-Action Model as Effective Robot Perceiver
di: Song, Wenxuan, et al.
Pubblicazione: (2025)
di: Song, Wenxuan, et al.
Pubblicazione: (2025)
EndoVLA: Dual-Phase Vision-Language-Action Model for Autonomous Tracking in Endoscopy
di: Ng, Chi Kit, et al.
Pubblicazione: (2025)
di: Ng, Chi Kit, et al.
Pubblicazione: (2025)
TriVLA: A Triple-System-Based Unified Vision-Language-Action Model with Episodic World Modeling for General Robot Control
di: Liu, Zhenyang, et al.
Pubblicazione: (2025)
di: Liu, Zhenyang, et al.
Pubblicazione: (2025)
Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments
di: Wang, Qiuyue, et al.
Pubblicazione: (2026)
di: Wang, Qiuyue, et al.
Pubblicazione: (2026)
X-DiffVLA: X-Embodied Diffusion Action Heads for Vision-Language-Action Models
di: Li, Boyu, et al.
Pubblicazione: (2026)
di: Li, Boyu, et al.
Pubblicazione: (2026)
ST4VLA: Spatially Guided Training for Vision-Language-Action Models
di: Ye, Jinhui, et al.
Pubblicazione: (2026)
di: Ye, Jinhui, et al.
Pubblicazione: (2026)
PokeVLA: Empowering Pocket-Sized Vision-Language-Action Model with Comprehensive World Knowledge Guidance
di: Zheng, Yupeng, et al.
Pubblicazione: (2026)
di: Zheng, Yupeng, et al.
Pubblicazione: (2026)
AnchorVLA4D: an Anchor-Based Spatial-Temporal Vision-Language-Action Model for Robotic Manipulation
di: Zhu, Juan, et al.
Pubblicazione: (2026)
di: Zhu, Juan, et al.
Pubblicazione: (2026)
OmniVLA: An Omni-Modal Vision-Language-Action Model for Robot Navigation
di: Hirose, Noriaki, et al.
Pubblicazione: (2025)
di: Hirose, Noriaki, et al.
Pubblicazione: (2025)
SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics
di: Shukor, Mustafa, et al.
Pubblicazione: (2025)
di: Shukor, Mustafa, et al.
Pubblicazione: (2025)
PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models
di: Guo, Peizheng, et al.
Pubblicazione: (2026)
di: Guo, Peizheng, et al.
Pubblicazione: (2026)
CollabVLA: Self-Reflective Vision-Language-Action Model Dreaming Together with Human
di: Sun, Nan, et al.
Pubblicazione: (2025)
di: Sun, Nan, et al.
Pubblicazione: (2025)
ACoT-VLA: Action Chain-of-Thought for Vision-Language-Action Models
di: Zhong, Linqing, et al.
Pubblicazione: (2026)
di: Zhong, Linqing, et al.
Pubblicazione: (2026)
MAP-VLA: Memory-Augmented Prompting for Vision-Language-Action Model in Robotic Manipulation
di: Li, Runhao, et al.
Pubblicazione: (2025)
di: Li, Runhao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Graph-Fused Vision-Language-Action for Policy Reasoning in Multi-Arm Robotic Manipulation
di: Li, Shunlei, et al.
Pubblicazione: (2025) -
Information-Theoretic Graph Fusion with Vision-Language-Action Model for Policy Reasoning and Dual Robotic Control
di: Li, Shunlei, et al.
Pubblicazione: (2025) -
DAM-VLA: A Dynamic Action Model-Based Vision-Language-Action Framework for Robot Manipulation
di: Peng, Xiongfeng, et al.
Pubblicazione: (2026) -
MobileVLA-R1: Reinforcing Vision-Language-Action for Mobile Robots
di: Huang, Ting, et al.
Pubblicazione: (2025) -
TIC-VLA: A Think-in-Control Vision-Language-Action Model for Robot Navigation in Dynamic Environments
di: Huang, Zhiyu, et al.
Pubblicazione: (2026)