SwitchVLA: Execution-Aware Task Switching for Vision-Language-Action Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Meng, Zhao, Zhen, Che, Zhengping, Liao, Fei, Wu, Kun, Xu, Zhiyuan, Ren, Pei, Jin, Zhao, Liu, Ning, Tang, Jian |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
XR-1: Towards Versatile Vision-Language-Action Models via Learning Unified Vision-Motion Representations
por: Fan, Shichao, et al.
Publicado: (2025)
por: Fan, Shichao, et al.
Publicado: (2025)
RoboGene: Boosting VLA Pre-training via Diversity-Driven Agentic Framework for Real-World Task Generation
por: Zhang, Yixue, et al.
Publicado: (2026)
por: Zhang, Yixue, et al.
Publicado: (2026)
FreqPolicy: Efficient Flow-based Visuomotor Policy via Frequency Consistency
por: Su, Yifei, et al.
Publicado: (2025)
por: Su, Yifei, et al.
Publicado: (2025)
SeqVLA: Sequential Task Execution for Long-Horizon Manipulation with Completion-Aware Vision-Language-Action Model
por: Yang, Ran, et al.
Publicado: (2025)
por: Yang, Ran, et al.
Publicado: (2025)
Learning from Imperfect Demonstrations with Self-Supervision for Robotic Manipulation
por: Wu, Kun, et al.
Publicado: (2024)
por: Wu, Kun, et al.
Publicado: (2024)
TinyVLA: Towards Fast, Data-Efficient Vision-Language-Action Models for Robotic Manipulation
por: Wen, Junjie, et al.
Publicado: (2024)
por: Wen, Junjie, et al.
Publicado: (2024)
TacVLA: Contact-Aware Tactile Fusion for Robust Vision-Language-Action Manipulation
por: Zhang, Kaidi, et al.
Publicado: (2026)
por: Zhang, Kaidi, et al.
Publicado: (2026)
Efficient Training of Generalizable Visuomotor Policies via Control-Aware Augmentation
por: Zhao, Yinuo, et al.
Publicado: (2024)
por: Zhao, Yinuo, et al.
Publicado: (2024)
A Survey on Robotics with Foundation Models: toward Embodied AI
por: Xu, Zhiyuan, et al.
Publicado: (2024)
por: Xu, Zhiyuan, et al.
Publicado: (2024)
HACTS: a Human-As-Copilot Teleoperation System for Robot Learning
por: Xu, Zhiyuan, et al.
Publicado: (2025)
por: Xu, Zhiyuan, et al.
Publicado: (2025)
CRAFT: Adapting VLA Models to Contact-rich Manipulation via Force-aware Curriculum Fine-tuning
por: Zhang, Yike, et al.
Publicado: (2026)
por: Zhang, Yike, et al.
Publicado: (2026)
RoboAug: One Annotation to Hundreds of Scenes via Region-Contrastive Data Augmentation for Robotic Manipulation
por: Wang, Xinhua, et al.
Publicado: (2026)
por: Wang, Xinhua, et al.
Publicado: (2026)
NS-VLA: Towards Neuro-Symbolic Vision-Language-Action Models
por: Zhu, Ziyue, et al.
Publicado: (2026)
por: Zhu, Ziyue, et al.
Publicado: (2026)
GeoAware-VLA: Implicit Geometry Aware Vision-Language-Action Model
por: Abouzeid, Ali, et al.
Publicado: (2025)
por: Abouzeid, Ali, et al.
Publicado: (2025)
ACoT-VLA: Action Chain-of-Thought for Vision-Language-Action Models
por: Zhong, Linqing, et al.
Publicado: (2026)
por: Zhong, Linqing, et al.
Publicado: (2026)
STRONG-VLA: Decoupled Robustness Learning for Vision-Language-Action Models under Multimodal Perturbations
por: Xie, Yuhan, et al.
Publicado: (2026)
por: Xie, Yuhan, et al.
Publicado: (2026)
StereoVLA: Enhancing Vision-Language-Action Models with Stereo Vision
por: Deng, Shengliang, et al.
Publicado: (2025)
por: Deng, Shengliang, et al.
Publicado: (2025)
Discrete Policy: Learning Disentangled Action Space for Multi-Task Robotic Manipulation
por: Wu, Kun, et al.
Publicado: (2024)
por: Wu, Kun, et al.
Publicado: (2024)
EndoVLA: Dual-Phase Vision-Language-Action Model for Autonomous Tracking in Endoscopy
por: Ng, Chi Kit, et al.
Publicado: (2025)
por: Ng, Chi Kit, et al.
Publicado: (2025)
Real-world Reinforcement Learning from Suboptimal Interventions
por: Zhao, Yinuo, et al.
Publicado: (2025)
por: Zhao, Yinuo, et al.
Publicado: (2025)
CRL-VLA: Continual Vision-Language-Action Learning
por: Zeng, Qixin, et al.
Publicado: (2026)
por: Zeng, Qixin, et al.
Publicado: (2026)
VLA-Adapter: An Effective Paradigm for Tiny-Scale Vision-Language-Action Model
por: Wang, Yihao, et al.
Publicado: (2025)
por: Wang, Yihao, et al.
Publicado: (2025)
HAMLET: Switch your Vision-Language-Action Model into a History-Aware Policy
por: Koo, Myungkyu, et al.
Publicado: (2025)
por: Koo, Myungkyu, et al.
Publicado: (2025)
RobustVLA: Robustness-Aware Reinforcement Post-Training for Vision-Language-Action Models
por: Zhang, Hongyin, et al.
Publicado: (2025)
por: Zhang, Hongyin, et al.
Publicado: (2025)
RoboPARA: Dual-Arm Robot Planning with Parallel Allocation and Recomposition Across Tasks
por: Duan, Shiying, et al.
Publicado: (2025)
por: Duan, Shiying, et al.
Publicado: (2025)
PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models
por: Guo, Peizheng, et al.
Publicado: (2026)
por: Guo, Peizheng, et al.
Publicado: (2026)
ST4VLA: Spatially Guided Training for Vision-Language-Action Models
por: Ye, Jinhui, et al.
Publicado: (2026)
por: Ye, Jinhui, et al.
Publicado: (2026)
StreamingVLA: Streaming Vision-Language-Action Model with Action Flow Matching and Adaptive Early Observation
por: Shi, Yiran, et al.
Publicado: (2026)
por: Shi, Yiran, et al.
Publicado: (2026)
MoS-VLA: A Vision-Language-Action Model with One-Shot Skill Adaptation
por: Zhao, Ruihan, et al.
Publicado: (2025)
por: Zhao, Ruihan, et al.
Publicado: (2025)
GesVLA: Gesture-Aware Vision-Language-Action Model Embedded Representations
por: Guo, Wenxuan, et al.
Publicado: (2026)
por: Guo, Wenxuan, et al.
Publicado: (2026)
Long-Term Memory for VLA-based Agents in Open-World Task Execution
por: Huang, Xu, et al.
Publicado: (2026)
por: Huang, Xu, et al.
Publicado: (2026)
X-DiffVLA: X-Embodied Diffusion Action Heads for Vision-Language-Action Models
por: Li, Boyu, et al.
Publicado: (2026)
por: Li, Boyu, et al.
Publicado: (2026)
ChatVLA: Unified Multimodal Understanding and Robot Control with Vision-Language-Action Model
por: Zhou, Zhongyi, et al.
Publicado: (2025)
por: Zhou, Zhongyi, et al.
Publicado: (2025)
CEED-VLA: Consistency Vision-Language-Action Model with Early-Exit Decoding
por: Song, Wenxuan, et al.
Publicado: (2025)
por: Song, Wenxuan, et al.
Publicado: (2025)
RationalVLA: A Rational Vision-Language-Action Model with Dual System
por: Song, Wenxuan, et al.
Publicado: (2025)
por: Song, Wenxuan, et al.
Publicado: (2025)
StyleVLA: Driving Style-Aware Vision Language Action Model for Autonomous Driving
por: Gao, Yuan, et al.
Publicado: (2026)
por: Gao, Yuan, et al.
Publicado: (2026)
OneTwoVLA: A Unified Vision-Language-Action Model with Adaptive Reasoning
por: Lin, Fanqi, et al.
Publicado: (2025)
por: Lin, Fanqi, et al.
Publicado: (2025)
LLaDA-VLA: Vision Language Diffusion Action Models
por: Wen, Yuqing, et al.
Publicado: (2025)
por: Wen, Yuqing, et al.
Publicado: (2025)
LaST$_{0}$: Latent Spatio-Temporal Chain-of-Thought for Robotic Vision-Language-Action Model
por: Liu, Zhuoyang, et al.
Publicado: (2026)
por: Liu, Zhuoyang, et al.
Publicado: (2026)
DropVLA: An Action-Level Backdoor Attack on Vision-Language-Action Models
por: Xu, Zonghuan, et al.
Publicado: (2025)
por: Xu, Zonghuan, et al.
Publicado: (2025)
Ejemplares similares
-
XR-1: Towards Versatile Vision-Language-Action Models via Learning Unified Vision-Motion Representations
por: Fan, Shichao, et al.
Publicado: (2025) -
RoboGene: Boosting VLA Pre-training via Diversity-Driven Agentic Framework for Real-World Task Generation
por: Zhang, Yixue, et al.
Publicado: (2026) -
FreqPolicy: Efficient Flow-based Visuomotor Policy via Frequency Consistency
por: Su, Yifei, et al.
Publicado: (2025) -
SeqVLA: Sequential Task Execution for Long-Horizon Manipulation with Completion-Aware Vision-Language-Action Model
por: Yang, Ran, et al.
Publicado: (2025) -
Learning from Imperfect Demonstrations with Self-Supervision for Robotic Manipulation
por: Wu, Kun, et al.
Publicado: (2024)