World-Value-Action Model: Implicit Planning for Vision-Language-Action Systems
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Runze, Zhang, Hongyin, Jin, Junxi, Zeng, Qixin, Zhuang, Zifeng, Tang, Yiqi, Lyu, Shangke, Wang, Donglin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RobustVLA: Robustness-Aware Reinforcement Post-Training for Vision-Language-Action Models
par: Zhang, Hongyin, et autres
Publié: (2025)
par: Zhang, Hongyin, et autres
Publié: (2025)
CMR: Contractive Mapping Embeddings for Robust Humanoid Locomotion on Unstructured Terrains
par: Zeng, Qixin, et autres
Publié: (2026)
par: Zeng, Qixin, et autres
Publié: (2026)
CRL-VLA: Continual Vision-Language-Action Learning
par: Zeng, Qixin, et autres
Publié: (2026)
par: Zeng, Qixin, et autres
Publié: (2026)
TDMPBC: Self-Imitative Reinforcement Learning for Humanoid Robot Control
par: Zhuang, Zifeng, et autres
Publié: (2025)
par: Zhuang, Zifeng, et autres
Publié: (2025)
Efficient Online RL Fine Tuning with Offline Pre-trained Policy Only
par: Xiao, Wei, et autres
Publié: (2025)
par: Xiao, Wei, et autres
Publié: (2025)
Balancing Signal and Variance: Adaptive Offline RL Post-Training for VLA Flow Models
par: Zhang, Hongyin, et autres
Publié: (2025)
par: Zhang, Hongyin, et autres
Publié: (2025)
GEVRM: Goal-Expressive Video Generation Model For Robust Visual Manipulation
par: Zhang, Hongyin, et autres
Publié: (2025)
par: Zhang, Hongyin, et autres
Publié: (2025)
HiF-VLA: Hindsight, Insight and Foresight through Motion Representation for Vision-Language-Action Models
par: Lin, Minghui, et autres
Publié: (2025)
par: Lin, Minghui, et autres
Publié: (2025)
A Real-World Quadrupedal Locomotion Benchmark for Offline Reinforcement Learning
par: Zhang, Hongyin, et autres
Publié: (2023)
par: Zhang, Hongyin, et autres
Publié: (2023)
Information-Theoretic Constraints for Continual Vision-Language-Action Alignment
par: Zhao, Libang, et autres
Publié: (2026)
par: Zhao, Libang, et autres
Publié: (2026)
NFPO: Stabilized Policy Optimization of Normalizing Flow for Robotic Policy Learning
par: Shi, Diyuan, et autres
Publié: (2026)
par: Shi, Diyuan, et autres
Publié: (2026)
MMaDA-VLA: Large Diffusion Vision-Language-Action Model with Unified Multi-Modal Instruction and Generation
par: Liu, Yang, et autres
Publié: (2026)
par: Liu, Yang, et autres
Publié: (2026)
Unlock Reliable Skill Inference for Quadruped Adaptive Behavior by Skill Graph
par: Zhang, Hongyin, et autres
Publié: (2023)
par: Zhang, Hongyin, et autres
Publié: (2023)
VLA-RFT: Vision-Language-Action Reinforcement Fine-tuning with Verified Rewards in World Simulators
par: Li, Hengtao, et autres
Publié: (2025)
par: Li, Hengtao, et autres
Publié: (2025)
Reinforcement Fine-Tuning of Flow-Matching Policies for Vision-Language-Action Models
par: Lyu, Mingyang, et autres
Publié: (2025)
par: Lyu, Mingyang, et autres
Publié: (2025)
ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning
par: Zhang, Hongyin, et autres
Publié: (2025)
par: Zhang, Hongyin, et autres
Publié: (2025)
Discovering Self-Protective Falling Policy for Humanoid Robot via Deep Reinforcement Learning
par: Shi, Diyuan, et autres
Publié: (2025)
par: Shi, Diyuan, et autres
Publié: (2025)
Dynamic Adaptive Legged Locomotion Policy via Decoupling Reaction Force Control and Gait Control
par: Wang, Renjie, et autres
Publié: (2025)
par: Wang, Renjie, et autres
Publié: (2025)
FAST: Efficient Action Tokenization for Vision-Language-Action Models
par: Pertsch, Karl, et autres
Publié: (2025)
par: Pertsch, Karl, et autres
Publié: (2025)
Towards Practical World Model-based Reinforcement Learning for Vision-Language-Action Models
par: Zhang, Zhilong, et autres
Publié: (2026)
par: Zhang, Zhilong, et autres
Publié: (2026)
Agentic-VLA: Efficient Online Adaptation for Vision-Language-Action Models
par: Jin, Ruofan, et autres
Publié: (2026)
par: Jin, Ruofan, et autres
Publié: (2026)
villa-X: Enhancing Latent Action Modeling in Vision-Language-Action Models
par: Chen, Xiaoyu, et autres
Publié: (2025)
par: Chen, Xiaoyu, et autres
Publié: (2025)
$π_{0.5}$: a Vision-Language-Action Model with Open-World Generalization
par: Intelligence, Physical, et autres
Publié: (2025)
par: Intelligence, Physical, et autres
Publié: (2025)
Confidence Calibration in Vision-Language-Action Models
par: Zollo, Thomas P, et autres
Publié: (2025)
par: Zollo, Thomas P, et autres
Publié: (2025)
OpenVLA: An Open-Source Vision-Language-Action Model
par: Kim, Moo Jin, et autres
Publié: (2024)
par: Kim, Moo Jin, et autres
Publié: (2024)
V-VLAPS: Value-Guided Planning for Vision-Language-Action Models
par: Ren, Ke, et autres
Publié: (2026)
par: Ren, Ke, et autres
Publié: (2026)
MEM: Multi-Scale Embodied Memory for Vision Language Action Models
par: Torne, Marcel, et autres
Publié: (2026)
par: Torne, Marcel, et autres
Publié: (2026)
CLAP: Contrastive Latent Action Pretraining for Learning Vision-Language-Action Models from Human Videos
par: Zhang, Chubin, et autres
Publié: (2026)
par: Zhang, Chubin, et autres
Publié: (2026)
Robust Online Residual Refinement via Koopman-Guided Dynamics Modeling
par: Gong, Zhefei, et autres
Publié: (2025)
par: Gong, Zhefei, et autres
Publié: (2025)
A Survey on Efficient Vision-Language-Action Models
par: Yu, Zhaoshu, et autres
Publié: (2025)
par: Yu, Zhaoshu, et autres
Publié: (2025)
GeRM: A Generalist Robotic Model with Mixture-of-experts for Quadruped Robot
par: Song, Wenxuan, et autres
Publié: (2024)
par: Song, Wenxuan, et autres
Publié: (2024)
DeepThinkVLA: Enhancing Reasoning Capability of Vision-Language-Action Models
par: Yin, Cheng, et autres
Publié: (2025)
par: Yin, Cheng, et autres
Publié: (2025)
PointVLA: Injecting the 3D World into Vision-Language-Action Models
par: Li, Chengmeng, et autres
Publié: (2025)
par: Li, Chengmeng, et autres
Publié: (2025)
Simple Recipe Works: Vision-Language-Action Models are Natural Continual Learners with Reinforcement Learning
par: Hu, Jiaheng, et autres
Publié: (2026)
par: Hu, Jiaheng, et autres
Publié: (2026)
VLA^2: Empowering Vision-Language-Action Models with an Agentic Framework for Unseen Concept Manipulation
par: Zhao, Han, et autres
Publié: (2025)
par: Zhao, Han, et autres
Publié: (2025)
Reshaping Action Error Distributions for Reliable Vision-Language-Action Models
par: Bai, Shuanghao, et autres
Publié: (2026)
par: Bai, Shuanghao, et autres
Publié: (2026)
Sigma: The Key for Vision-Language-Action Models toward Telepathic Alignment
par: Wang, Libo
Publié: (2025)
par: Wang, Libo
Publié: (2025)
RL Token: Bootstrapping Online RL with Vision-Language-Action Models
par: Xu, Charles, et autres
Publié: (2026)
par: Xu, Charles, et autres
Publié: (2026)
RationalVLA: A Rational Vision-Language-Action Model with Dual System
par: Song, Wenxuan, et autres
Publié: (2025)
par: Song, Wenxuan, et autres
Publié: (2025)
VLAS: Vision-Language-Action Model With Speech Instructions For Customized Robot Manipulation
par: Zhao, Wei, et autres
Publié: (2025)
par: Zhao, Wei, et autres
Publié: (2025)
Documents similaires
-
RobustVLA: Robustness-Aware Reinforcement Post-Training for Vision-Language-Action Models
par: Zhang, Hongyin, et autres
Publié: (2025) -
CMR: Contractive Mapping Embeddings for Robust Humanoid Locomotion on Unstructured Terrains
par: Zeng, Qixin, et autres
Publié: (2026) -
CRL-VLA: Continual Vision-Language-Action Learning
par: Zeng, Qixin, et autres
Publié: (2026) -
TDMPBC: Self-Imitative Reinforcement Learning for Humanoid Robot Control
par: Zhuang, Zifeng, et autres
Publié: (2025) -
Efficient Online RL Fine Tuning with Offline Pre-trained Policy Only
par: Xiao, Wei, et autres
Publié: (2025)