DySL-VLA: Efficient Vision-Language-Action Model Inference via Dynamic-Static Layer-Skipping for Robot Manipulation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Zebin, Qi, Yijiahao, Xie, Tong, Yu, Bo, Liu, Shaoshan, Li, Meng |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MoLe-VLA: Dynamic Layer-skipping Vision Language Action Model via Mixture-of-Layers for Efficient Robot Manipulation
par: Zhang, Rongyu, et autres
Publié: (2025)
par: Zhang, Rongyu, et autres
Publié: (2025)
DAM-VLA: A Dynamic Action Model-Based Vision-Language-Action Framework for Robot Manipulation
par: Peng, Xiongfeng, et autres
Publié: (2026)
par: Peng, Xiongfeng, et autres
Publié: (2026)
KEEP: A KV-Cache-Centric Memory Management System for Efficient Embodied Planning
par: Yang, Zebin, et autres
Publié: (2026)
par: Yang, Zebin, et autres
Publié: (2026)
Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation
par: Fan, Yiguo, et autres
Publié: (2025)
par: Fan, Yiguo, et autres
Publié: (2025)
DynamicVLA: A Vision-Language-Action Model for Dynamic Object Manipulation
par: Xie, Haozhe, et autres
Publié: (2026)
par: Xie, Haozhe, et autres
Publié: (2026)
Audio-VLA: Adding Contact Audio Perception to Vision-Language-Action Model for Robotic Manipulation
par: Wei, Xiangyi, et autres
Publié: (2025)
par: Wei, Xiangyi, et autres
Publié: (2025)
DyQ-VLA: Temporal-Dynamic-Aware Quantization for Embodied Vision-Language-Action Models
par: Zheng, Zihao, et autres
Publié: (2026)
par: Zheng, Zihao, et autres
Publié: (2026)
AC^2-VLA: Action-Context-Aware Adaptive Computation in Vision-Language-Action Models for Efficient Robotic Manipulation
par: Yu, Wenda, et autres
Publié: (2026)
par: Yu, Wenda, et autres
Publié: (2026)
MemoryVLA: Perceptual-Cognitive Memory in Vision-Language-Action Models for Robotic Manipulation
par: Shi, Hao, et autres
Publié: (2025)
par: Shi, Hao, et autres
Publié: (2025)
TinyVLA: Towards Fast, Data-Efficient Vision-Language-Action Models for Robotic Manipulation
par: Wen, Junjie, et autres
Publié: (2024)
par: Wen, Junjie, et autres
Publié: (2024)
DyGRO-VLA: Cross-Task Scaling of Vision-Language-Action Models via Dynamic Grouped Residual Optimization
par: Lin, Sixu, et autres
Publié: (2026)
par: Lin, Sixu, et autres
Publié: (2026)
AIR-VLA: Vision-Language-Action Systems for Aerial Manipulation
par: Sun, Jianli, et autres
Publié: (2026)
par: Sun, Jianli, et autres
Publié: (2026)
Bi-VLA: Vision-Language-Action Model-Based System for Bimanual Robotic Dexterous Manipulations
par: Gbagbe, Koffivi Fidèle, et autres
Publié: (2024)
par: Gbagbe, Koffivi Fidèle, et autres
Publié: (2024)
HyperVLA: Efficient Inference in Vision-Language-Action Models via Hypernetworks
par: Xiong, Zheng, et autres
Publié: (2025)
par: Xiong, Zheng, et autres
Publié: (2025)
BitVLA: 1-bit Vision-Language-Action Models for Robotics Manipulation
par: Wang, Hongyu, et autres
Publié: (2025)
par: Wang, Hongyu, et autres
Publié: (2025)
HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing
par: Gubernatorov, Konstantin, et autres
Publié: (2026)
par: Gubernatorov, Konstantin, et autres
Publié: (2026)
EdgeVLA: Efficient Vision-Language-Action Models
par: Budzianowski, Paweł, et autres
Publié: (2025)
par: Budzianowski, Paweł, et autres
Publié: (2025)
SG-VLA: Learning Spatially-Grounded Vision-Language-Action Models for Mobile Manipulation
par: Tu, Ruisen, et autres
Publié: (2026)
par: Tu, Ruisen, et autres
Publié: (2026)
Shake-VLA: Vision-Language-Action Model-Based System for Bimanual Robotic Manipulations and Liquid Mixing
par: Khan, Muhamamd Haris, et autres
Publié: (2025)
par: Khan, Muhamamd Haris, et autres
Publié: (2025)
VLA-Cache: Efficient Vision-Language-Action Manipulation via Adaptive Token Caching
par: Xu, Siyu, et autres
Publié: (2025)
par: Xu, Siyu, et autres
Publié: (2025)
MAP-VLA: Memory-Augmented Prompting for Vision-Language-Action Model in Robotic Manipulation
par: Li, Runhao, et autres
Publié: (2025)
par: Li, Runhao, et autres
Publié: (2025)
EveryDayVLA: A Vision-Language-Action Model for Affordable Robotic Manipulation
par: Chopra, Samarth, et autres
Publié: (2025)
par: Chopra, Samarth, et autres
Publié: (2025)
SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics
par: Shukor, Mustafa, et autres
Publié: (2025)
par: Shukor, Mustafa, et autres
Publié: (2025)
BagelVLA: Enhancing Long-Horizon Manipulation via Interleaved Vision-Language-Action Generation
par: Hu, Yucheng, et autres
Publié: (2026)
par: Hu, Yucheng, et autres
Publié: (2026)
AnchorVLA4D: an Anchor-Based Spatial-Temporal Vision-Language-Action Model for Robotic Manipulation
par: Zhu, Juan, et autres
Publié: (2026)
par: Zhu, Juan, et autres
Publié: (2026)
ActiveVLA: Injecting Active Perception into Vision-Language-Action Models for Precise 3D Robotic Manipulation
par: Liu, Zhenyang, et autres
Publié: (2026)
par: Liu, Zhenyang, et autres
Publié: (2026)
EfficientNav: Towards On-Device Object-Goal Navigation with Navigation Map Caching and Retrieval
par: Yang, Zebin, et autres
Publié: (2025)
par: Yang, Zebin, et autres
Publié: (2025)
FedVLA: Federated Vision-Language-Action Learning with Dual Gating Mixture-of-Experts for Robotic Manipulation
par: Miao, Cui, et autres
Publié: (2025)
par: Miao, Cui, et autres
Publié: (2025)
CronusVLA: Towards Efficient and Robust Manipulation via Multi-Frame Vision-Language-Action Modeling
par: Li, Hao, et autres
Publié: (2025)
par: Li, Hao, et autres
Publié: (2025)
ElegantVLA: Learning When to Think for Efficient Vision-Language-Action Models
par: Li, Ye, et autres
Publié: (2026)
par: Li, Ye, et autres
Publié: (2026)
Green-VLA: Staged Vision-Language-Action Model for Generalist Robots
par: Apanasevich, I., et autres
Publié: (2026)
par: Apanasevich, I., et autres
Publié: (2026)
SimVLA: A Simple VLA Baseline for Robotic Manipulation
par: Luo, Yuankai, et autres
Publié: (2026)
par: Luo, Yuankai, et autres
Publié: (2026)
TacVLA: Contact-Aware Tactile Fusion for Robust Vision-Language-Action Manipulation
par: Zhang, Kaidi, et autres
Publié: (2026)
par: Zhang, Kaidi, et autres
Publié: (2026)
TIC-VLA: A Think-in-Control Vision-Language-Action Model for Robot Navigation in Dynamic Environments
par: Huang, Zhiyu, et autres
Publié: (2026)
par: Huang, Zhiyu, et autres
Publié: (2026)
TwinVLA: Data-Efficient Bimanual Manipulation with Twin Single-Arm Vision-Language-Action Models
par: Im, Hokyun, et autres
Publié: (2025)
par: Im, Hokyun, et autres
Publié: (2025)
Action-aware Dynamic Pruning for Efficient Vision-Language-Action Manipulation
par: Pei, Xiaohuan, et autres
Publié: (2025)
par: Pei, Xiaohuan, et autres
Publié: (2025)
InternVLA-A1: Unifying Understanding, Generation and Action for Robotic Manipulation
par: Cai, Junhao, et autres
Publié: (2026)
par: Cai, Junhao, et autres
Publié: (2026)
Experiences from Benchmarking Vision-Language-Action Models for Robotic Manipulation
par: Zhang, Yihao, et autres
Publié: (2025)
par: Zhang, Yihao, et autres
Publié: (2025)
$M^2$-VLA: Boosting Vision-Language Models for Generalizable Manipulation via Layer Mixture and Meta-Skills
par: Xiao, Siyao, et autres
Publié: (2026)
par: Xiao, Siyao, et autres
Publié: (2026)
QUAR-VLA: Vision-Language-Action Model for Quadruped Robots
par: Ding, Pengxiang, et autres
Publié: (2023)
par: Ding, Pengxiang, et autres
Publié: (2023)
Documents similaires
-
MoLe-VLA: Dynamic Layer-skipping Vision Language Action Model via Mixture-of-Layers for Efficient Robot Manipulation
par: Zhang, Rongyu, et autres
Publié: (2025) -
DAM-VLA: A Dynamic Action Model-Based Vision-Language-Action Framework for Robot Manipulation
par: Peng, Xiongfeng, et autres
Publié: (2026) -
KEEP: A KV-Cache-Centric Memory Management System for Efficient Embodied Planning
par: Yang, Zebin, et autres
Publié: (2026) -
Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation
par: Fan, Yiguo, et autres
Publié: (2025) -
DynamicVLA: A Vision-Language-Action Model for Dynamic Object Manipulation
par: Xie, Haozhe, et autres
Publié: (2026)