Action Hallucination in Generative Vision-Language-Action Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Soh, Harold, Lim, Eugene |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AR-VLA: True Autoregressive Action Expert for Vision-Language-Action Models
por: Hu, Yutong, et al.
Publicado: (2026)
por: Hu, Yutong, et al.
Publicado: (2026)
ActionFlow: A Pipelined Action Acceleration for Vision Language Models on Edge
por: Dai, Yuntao, et al.
Publicado: (2025)
por: Dai, Yuntao, et al.
Publicado: (2025)
Demonstrating the Octopi-1.5 Visual-Tactile-Language Model
por: Yu, Samson, et al.
Publicado: (2025)
por: Yu, Samson, et al.
Publicado: (2025)
Don't Start from Scratch: Behavioral Refinement via Interpolant-based Policy Diffusion
por: Chen, Kaiqi, et al.
Publicado: (2024)
por: Chen, Kaiqi, et al.
Publicado: (2024)
Action-aware Dynamic Pruning for Efficient Vision-Language-Action Manipulation
por: Pei, Xiaohuan, et al.
Publicado: (2025)
por: Pei, Xiaohuan, et al.
Publicado: (2025)
Adversarial Attacks on Robotic Vision Language Action Models
por: Jones, Eliot Krzysztof, et al.
Publicado: (2025)
por: Jones, Eliot Krzysztof, et al.
Publicado: (2025)
Survey of Vision-Language-Action Models for Embodied Manipulation
por: Li, Haoran, et al.
Publicado: (2025)
por: Li, Haoran, et al.
Publicado: (2025)
ALOE: Action-Level Off-Policy Evaluation for Vision-Language-Action Model Post-Training
por: Yang, Rushuai, et al.
Publicado: (2026)
por: Yang, Rushuai, et al.
Publicado: (2026)
villa-X: Enhancing Latent Action Modeling in Vision-Language-Action Models
por: Chen, Xiaoyu, et al.
Publicado: (2025)
por: Chen, Xiaoyu, et al.
Publicado: (2025)
KineVLA: Towards Kinematics-Aware Vision-Language-Action Models with Bi-Level Action Decomposition
por: Han, Gaoge, et al.
Publicado: (2026)
por: Han, Gaoge, et al.
Publicado: (2026)
Exploring the Adversarial Vulnerabilities of Vision-Language-Action Models in Robotics
por: Wang, Taowen, et al.
Publicado: (2024)
por: Wang, Taowen, et al.
Publicado: (2024)
Developing Vision-Language-Action Model from Egocentric Videos
por: Yoshida, Tomoya, et al.
Publicado: (2025)
por: Yoshida, Tomoya, et al.
Publicado: (2025)
Emergence of Human to Robot Transfer in Vision-Language-Action Models
por: Kareer, Simar, et al.
Publicado: (2025)
por: Kareer, Simar, et al.
Publicado: (2025)
SAFE: Multitask Failure Detection for Vision-Language-Action Models
por: Gu, Qiao, et al.
Publicado: (2025)
por: Gu, Qiao, et al.
Publicado: (2025)
Continually Evolving Skill Knowledge in Vision Language Action Model
por: Wu, Yuxuan, et al.
Publicado: (2025)
por: Wu, Yuxuan, et al.
Publicado: (2025)
Expertise need not monopolize: Action-Specialized Mixture of Experts for Vision-Language-Action Learning
por: Shen, Weijie, et al.
Publicado: (2025)
por: Shen, Weijie, et al.
Publicado: (2025)
DropVLA: An Action-Level Backdoor Attack on Vision-Language-Action Models
por: Xu, Zonghuan, et al.
Publicado: (2025)
por: Xu, Zonghuan, et al.
Publicado: (2025)
Grounding Sim-to-Real Generalization in Dexterous Manipulation: An Empirical Study with Vision-Language-Action Models
por: Jin, Ruixing, et al.
Publicado: (2026)
por: Jin, Ruixing, et al.
Publicado: (2026)
NORA-1.5: A Vision-Language-Action Model Trained using World Model- and Action-based Preference Rewards
por: Hung, Chia-Yu, et al.
Publicado: (2025)
por: Hung, Chia-Yu, et al.
Publicado: (2025)
V-VLAPS: Value-Guided Planning for Vision-Language-Action Models
por: Ren, Ke, et al.
Publicado: (2026)
por: Ren, Ke, et al.
Publicado: (2026)
Towards Backdoor-Based Ownership Verification for Vision-Language-Action Models
por: Sun, Ming, et al.
Publicado: (2026)
por: Sun, Ming, et al.
Publicado: (2026)
Experiences from Benchmarking Vision-Language-Action Models for Robotic Manipulation
por: Zhang, Yihao, et al.
Publicado: (2025)
por: Zhang, Yihao, et al.
Publicado: (2025)
Hierarchical Vision Language Action Model Using Success and Failure Demonstrations
por: Park, Jeongeun, et al.
Publicado: (2025)
por: Park, Jeongeun, et al.
Publicado: (2025)
10 Open Challenges Steering the Future of Vision-Language-Action Models
por: Poria, Soujanya, et al.
Publicado: (2025)
por: Poria, Soujanya, et al.
Publicado: (2025)
Pure Vision Language Action (VLA) Models: A Comprehensive Survey
por: Zhang, Dapeng, et al.
Publicado: (2025)
por: Zhang, Dapeng, et al.
Publicado: (2025)
Do What? Teaching Vision-Language-Action Models to Reject the Impossible
por: Hsieh, Wen-Han, et al.
Publicado: (2025)
por: Hsieh, Wen-Han, et al.
Publicado: (2025)
WMPO: World Model-based Policy Optimization for Vision-Language-Action Models
por: Zhu, Fangqi, et al.
Publicado: (2025)
por: Zhu, Fangqi, et al.
Publicado: (2025)
RLRC: Reinforcement Learning-based Recovery for Compressed Vision-Language-Action Models
por: Chen, Yuxuan, et al.
Publicado: (2025)
por: Chen, Yuxuan, et al.
Publicado: (2025)
Improving Pre-Trained Vision-Language-Action Policies with Model-Based Search
por: Neary, Cyrus, et al.
Publicado: (2025)
por: Neary, Cyrus, et al.
Publicado: (2025)
RICL: Adding In-Context Adaptability to Pre-Trained Vision-Language-Action Models
por: Sridhar, Kaustubh, et al.
Publicado: (2025)
por: Sridhar, Kaustubh, et al.
Publicado: (2025)
ContextVLA: Vision-Language-Action Model with Amortized Multi-Frame Context
por: Jang, Huiwon, et al.
Publicado: (2025)
por: Jang, Huiwon, et al.
Publicado: (2025)
SilentDrift: Exploiting Action Chunking for Stealthy Backdoor Attacks on Vision-Language-Action Models
por: Xu, Bingxin, et al.
Publicado: (2026)
por: Xu, Bingxin, et al.
Publicado: (2026)
Continuous Reasoning for Vision-Language-Action
por: Wu, Yueh-Hua, et al.
Publicado: (2026)
por: Wu, Yueh-Hua, et al.
Publicado: (2026)
ALAM: Algebraically Consistent Latent Action Model for Vision-Language-Action Models
por: Tang, Zuojin, et al.
Publicado: (2026)
por: Tang, Zuojin, et al.
Publicado: (2026)
Adaptive Capacity Allocation for Vision Language Action Fine-tuning
por: Kim, Donghoon, et al.
Publicado: (2026)
por: Kim, Donghoon, et al.
Publicado: (2026)
Event-Grounded Sparse Autoencoders for Vision-Language-Action Policies
por: Jin, Xinchen, et al.
Publicado: (2026)
por: Jin, Xinchen, et al.
Publicado: (2026)
Mean-Flow based One-Step Vision-Language-Action
por: Chen, Yang, et al.
Publicado: (2026)
por: Chen, Yang, et al.
Publicado: (2026)
EXPO-FT: Sample-Efficient Reinforcement Learning Finetuning for Vision-Language-Action Models
por: Dong, Perry, et al.
Publicado: (2026)
por: Dong, Perry, et al.
Publicado: (2026)
RePO-VLA: Recovery-Driven Policy Optimization for Vision-Language-Action Models
por: Liufu, Weijia, et al.
Publicado: (2026)
por: Liufu, Weijia, et al.
Publicado: (2026)
Characterizing Vision-Language-Action Models across XPUs: Constraints and Acceleration for On-Robot Deployment
por: Zhou, Kaijun, et al.
Publicado: (2026)
por: Zhou, Kaijun, et al.
Publicado: (2026)
Ejemplares similares
-
AR-VLA: True Autoregressive Action Expert for Vision-Language-Action Models
por: Hu, Yutong, et al.
Publicado: (2026) -
ActionFlow: A Pipelined Action Acceleration for Vision Language Models on Edge
por: Dai, Yuntao, et al.
Publicado: (2025) -
Demonstrating the Octopi-1.5 Visual-Tactile-Language Model
por: Yu, Samson, et al.
Publicado: (2025) -
Don't Start from Scratch: Behavioral Refinement via Interpolant-based Policy Diffusion
por: Chen, Kaiqi, et al.
Publicado: (2024) -
Action-aware Dynamic Pruning for Efficient Vision-Language-Action Manipulation
por: Pei, Xiaohuan, et al.
Publicado: (2025)