Atomic Action Slicing: Planner-Aligned Options for Generalist VLA Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tabakov, Stefan, Popov, Asen, Dimitrov, Dimitar, Kiyamousavi, S. Ensiye, Hristov, Vladimir, Kraychev, Boris |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Neural MP: A Generalist Neural Motion Planner
par: Dalal, Murtaza, et autres
Publié: (2024)
par: Dalal, Murtaza, et autres
Publié: (2024)
HiMoE-VLA: Hierarchical Mixture-of-Experts for Generalist Vision-Language-Action Policies
par: Du, Zhiying, et autres
Publié: (2025)
par: Du, Zhiying, et autres
Publié: (2025)
CRL-VLA: Continual Vision-Language-Action Learning
par: Zeng, Qixin, et autres
Publié: (2026)
par: Zeng, Qixin, et autres
Publié: (2026)
Don't Blind Your VLA: Aligning Visual Representations for OOD Generalization
par: Kachaev, Nikita, et autres
Publié: (2025)
par: Kachaev, Nikita, et autres
Publié: (2025)
Toward Generalist Neural Motion Planners for Robotic Manipulators: Challenges and Opportunities
par: Soleymanzadeh, Davood, et autres
Publié: (2026)
par: Soleymanzadeh, Davood, et autres
Publié: (2026)
UniVLA: Learning to Act Anywhere with Task-centric Latent Actions
par: Bu, Qingwen, et autres
Publié: (2025)
par: Bu, Qingwen, et autres
Publié: (2025)
AsyncVLA: Asynchronous Flow Matching for Vision-Language-Action Models
par: Jiang, Yuhua, et autres
Publié: (2025)
par: Jiang, Yuhua, et autres
Publié: (2025)
Agentic-VLA: Efficient Online Adaptation for Vision-Language-Action Models
par: Jin, Ruofan, et autres
Publié: (2026)
par: Jin, Ruofan, et autres
Publié: (2026)
HyperVLA: Efficient Inference in Vision-Language-Action Models via Hypernetworks
par: Xiong, Zheng, et autres
Publié: (2025)
par: Xiong, Zheng, et autres
Publié: (2025)
DeepThinkVLA: Enhancing Reasoning Capability of Vision-Language-Action Models
par: Yin, Cheng, et autres
Publié: (2025)
par: Yin, Cheng, et autres
Publié: (2025)
SmoothVLA: Aligning Vision-Language-Action Models with Physical Constraints via Intrinsic Smoothness Optimization
par: Li, Jiashun, et autres
Publié: (2026)
par: Li, Jiashun, et autres
Publié: (2026)
Latent Adaptive Planner for Dynamic Manipulation
par: Noh, Donghun, et autres
Publié: (2025)
par: Noh, Donghun, et autres
Publié: (2025)
TraceVLA: Visual Trace Prompting Enhances Spatial-Temporal Awareness for Generalist Robotic Policies
par: Zheng, Ruijie, et autres
Publié: (2024)
par: Zheng, Ruijie, et autres
Publié: (2024)
RoboAct-CLIP: Video-Driven Pre-training of Atomic Action Understanding for Robotics
par: Zhang, Zhiyuan, et autres
Publié: (2025)
par: Zhang, Zhiyuan, et autres
Publié: (2025)
A Taxonomy for Evaluating Generalist Robot Manipulation Policies
par: Gao, Jensen, et autres
Publié: (2025)
par: Gao, Jensen, et autres
Publié: (2025)
Hybrid Imitation-Learning Motion Planner for Urban Driving
par: Gariboldi, Cristian, et autres
Publié: (2024)
par: Gariboldi, Cristian, et autres
Publié: (2024)
HELP: Hierarchical Embodied Language Planner for Household Tasks
par: Korchemnyi, Alexandr V., et autres
Publié: (2025)
par: Korchemnyi, Alexandr V., et autres
Publié: (2025)
RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning
par: Xu, Charles, et autres
Publié: (2024)
par: Xu, Charles, et autres
Publié: (2024)
InternVLA-M1: A Spatially Guided Vision-Language-Action Framework for Generalist Robot Policy
par: Chen, Xinyi, et autres
Publié: (2025)
par: Chen, Xinyi, et autres
Publié: (2025)
Latent Embedding Adaptation for Human Preference Alignment in Diffusion Planners
par: Ng, Wen Zheng Terence, et autres
Publié: (2025)
par: Ng, Wen Zheng Terence, et autres
Publié: (2025)
An Online Spatial-Temporal Graph Trajectory Planner for Autonomous Vehicles
par: Samiuddin, Jilan, et autres
Publié: (2024)
par: Samiuddin, Jilan, et autres
Publié: (2024)
Navigation with QPHIL: Quantizing Planner for Hierarchical Implicit Q-Learning
par: Canesse, Alexi, et autres
Publié: (2024)
par: Canesse, Alexi, et autres
Publié: (2024)
Learning Autonomy: Off-Road Navigation Enhanced by Human Input
par: Nagariya, Akhil, et autres
Publié: (2025)
par: Nagariya, Akhil, et autres
Publié: (2025)
RoboCasa: Large-Scale Simulation of Everyday Tasks for Generalist Robots
par: Nasiriany, Soroush, et autres
Publié: (2024)
par: Nasiriany, Soroush, et autres
Publié: (2024)
AR-VLA: True Autoregressive Action Expert for Vision-Language-Action Models
par: Hu, Yutong, et autres
Publié: (2026)
par: Hu, Yutong, et autres
Publié: (2026)
WorldVLA: Towards Autoregressive Action World Model
par: Cen, Jun, et autres
Publié: (2025)
par: Cen, Jun, et autres
Publié: (2025)
MimicDreamer: Aligning Human and Robot Demonstrations for Scalable VLA Training
par: Li, Haoyun, et autres
Publié: (2025)
par: Li, Haoyun, et autres
Publié: (2025)
Embodiment-Aware Generalist Specialist Distillation for Unified Humanoid Whole-Body Control
par: Peng, Quanquan, et autres
Publié: (2026)
par: Peng, Quanquan, et autres
Publié: (2026)
GR00T N1: An Open Foundation Model for Generalist Humanoid Robots
par: NVIDIA, et autres
Publié: (2025)
par: NVIDIA, et autres
Publié: (2025)
SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning
par: Li, Haozhan, et autres
Publié: (2025)
par: Li, Haozhan, et autres
Publié: (2025)
AgentStore: Scalable Integration of Heterogeneous Agents As Specialized Generalist Computer Assistant
par: Jia, Chengyou, et autres
Publié: (2024)
par: Jia, Chengyou, et autres
Publié: (2024)
When Planners Meet Reality: How Learned, Reactive Traffic Agents Shift nuPlan Benchmarks
par: Hagedorn, Steffen, et autres
Publié: (2025)
par: Hagedorn, Steffen, et autres
Publié: (2025)
Improving the Generalization of Unseen Crowd Behaviors for Reinforcement Learning based Local Motion Planners
par: Ng, Wen Zheng Terence, et autres
Publié: (2024)
par: Ng, Wen Zheng Terence, et autres
Publié: (2024)
RoboCasa365: A Large-Scale Simulation Framework for Training and Benchmarking Generalist Robots
par: Nasiriany, Soroush, et autres
Publié: (2026)
par: Nasiriany, Soroush, et autres
Publié: (2026)
SIMA 2: A Generalist Embodied Agent for Virtual Worlds
par: SIMA team, et autres
Publié: (2025)
par: SIMA team, et autres
Publié: (2025)
Can Explicit Physical Feasibility Benefit VLA Learning? An Empirical Study
par: Wei, Yubai, et autres
Publié: (2026)
par: Wei, Yubai, et autres
Publié: (2026)
Enabling Option Learning in Sparse Rewards with Hindsight Experience Replay
par: Romio, Gabriel, et autres
Publié: (2026)
par: Romio, Gabriel, et autres
Publié: (2026)
SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model
par: Qu, Delin, et autres
Publié: (2025)
par: Qu, Delin, et autres
Publié: (2025)
Pure Vision Language Action (VLA) Models: A Comprehensive Survey
par: Zhang, Dapeng, et autres
Publié: (2025)
par: Zhang, Dapeng, et autres
Publié: (2025)
CoT-VLA: Visual Chain-of-Thought Reasoning for Vision-Language-Action Models
par: Zhao, Qingqing, et autres
Publié: (2025)
par: Zhao, Qingqing, et autres
Publié: (2025)
Documents similaires
-
Neural MP: A Generalist Neural Motion Planner
par: Dalal, Murtaza, et autres
Publié: (2024) -
HiMoE-VLA: Hierarchical Mixture-of-Experts for Generalist Vision-Language-Action Policies
par: Du, Zhiying, et autres
Publié: (2025) -
CRL-VLA: Continual Vision-Language-Action Learning
par: Zeng, Qixin, et autres
Publié: (2026) -
Don't Blind Your VLA: Aligning Visual Representations for OOD Generalization
par: Kachaev, Nikita, et autres
Publié: (2025) -
Toward Generalist Neural Motion Planners for Robotic Manipulators: Challenges and Opportunities
par: Soleymanzadeh, Davood, et autres
Publié: (2026)