Eva-VLA: Evaluating Vision-Language-Action Models' Robustness Under Real-World Physical Variations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Hanqing, Ruan, Shouwei, Long, Jiahuan, Wu, Junqi, Hou, Jiacheng, Tang, Huili, Jiang, Tingsong, Zhou, Weien, Yao, Wen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
JailWAM: Jailbreaking World Action Models in Robot Control
par: Liu, Hanqing, et autres
Publié: (2026)
par: Liu, Hanqing, et autres
Publié: (2026)
VLA-REPLICA: A Low-Cost, Reproducible Benchmark for Real-World Evaluation of Vision-Language-Action Models
par: Huang, Alex S., et autres
Publié: (2026)
par: Huang, Alex S., et autres
Publié: (2026)
Thermally Activated Dual-Modal Adversarial Clothing against AI Surveillance Systems
par: Long, Jiahuan, et autres
Publié: (2025)
par: Long, Jiahuan, et autres
Publié: (2025)
RotVLA: Rotational Latent Action for Vision-Language-Action Model
par: Li, Qiwei, et autres
Publié: (2026)
par: Li, Qiwei, et autres
Publié: (2026)
RoVLA: Multi-Consistency Constraints for Robust Vision-Language-Action Models
par: Luo, Jingzhou, et autres
Publié: (2026)
par: Luo, Jingzhou, et autres
Publié: (2026)
RynnVLA-002: A Unified Vision-Language-Action and World Model
par: Cen, Jun, et autres
Publié: (2025)
par: Cen, Jun, et autres
Publié: (2025)
HeteroMorpheus: Universal Control Based on Morphological Heterogeneity Modeling
par: Hao, YiFan, et autres
Publié: (2024)
par: Hao, YiFan, et autres
Publié: (2024)
ACoT-VLA: Action Chain-of-Thought for Vision-Language-Action Models
par: Zhong, Linqing, et autres
Publié: (2026)
par: Zhong, Linqing, et autres
Publié: (2026)
StableVLA: Towards Robust Vision-Language-Action Models without Extra Data
par: Fu, Yiyang, et autres
Publié: (2026)
par: Fu, Yiyang, et autres
Publié: (2026)
OneTwoVLA: A Unified Vision-Language-Action Model with Adaptive Reasoning
par: Lin, Fanqi, et autres
Publié: (2025)
par: Lin, Fanqi, et autres
Publié: (2025)
CronusVLA: Towards Efficient and Robust Manipulation via Multi-Frame Vision-Language-Action Modeling
par: Li, Hao, et autres
Publié: (2025)
par: Li, Hao, et autres
Publié: (2025)
DriveWorld-VLA: Unified Latent-Space World Modeling with Vision-Language-Action for Autonomous Driving
par: jia, Feiyang, et autres
Publié: (2026)
par: jia, Feiyang, et autres
Publié: (2026)
PointVLA: Injecting the 3D World into Vision-Language-Action Models
par: Li, Chengmeng, et autres
Publié: (2025)
par: Li, Chengmeng, et autres
Publié: (2025)
VLA-Adapter: An Effective Paradigm for Tiny-Scale Vision-Language-Action Model
par: Wang, Yihao, et autres
Publié: (2025)
par: Wang, Yihao, et autres
Publié: (2025)
RobustVLA: Robustness-Aware Reinforcement Post-Training for Vision-Language-Action Models
par: Zhang, Hongyin, et autres
Publié: (2025)
par: Zhang, Hongyin, et autres
Publié: (2025)
TacVLA: Contact-Aware Tactile Fusion for Robust Vision-Language-Action Manipulation
par: Zhang, Kaidi, et autres
Publié: (2026)
par: Zhang, Kaidi, et autres
Publié: (2026)
InstructVLA: Vision-Language-Action Instruction Tuning from Understanding to Manipulation
par: Yang, Shuai, et autres
Publié: (2025)
par: Yang, Shuai, et autres
Publié: (2025)
WorldVLA: Towards Autoregressive Action World Model
par: Cen, Jun, et autres
Publié: (2025)
par: Cen, Jun, et autres
Publié: (2025)
AR-VLA: True Autoregressive Action Expert for Vision-Language-Action Models
par: Hu, Yutong, et autres
Publié: (2026)
par: Hu, Yutong, et autres
Publié: (2026)
STRONG-VLA: Decoupled Robustness Learning for Vision-Language-Action Models under Multimodal Perturbations
par: Xie, Yuhan, et autres
Publié: (2026)
par: Xie, Yuhan, et autres
Publié: (2026)
StereoVLA: Enhancing Vision-Language-Action Models with Stereo Vision
par: Deng, Shengliang, et autres
Publié: (2025)
par: Deng, Shengliang, et autres
Publié: (2025)
TacEva: A Performance Evaluation Framework For Vision-Based Tactile Sensors
par: Cong, Qingzheng, et autres
Publié: (2025)
par: Cong, Qingzheng, et autres
Publié: (2025)
PokeVLA: Empowering Pocket-Sized Vision-Language-Action Model with Comprehensive World Knowledge Guidance
par: Zheng, Yupeng, et autres
Publié: (2026)
par: Zheng, Yupeng, et autres
Publié: (2026)
SwitchVLA: Execution-Aware Task Switching for Vision-Language-Action Models
par: Li, Meng, et autres
Publié: (2025)
par: Li, Meng, et autres
Publié: (2025)
CoA-VLA: Improving Vision-Language-Action Models via Visual-Textual Chain-of-Affordance
par: Li, Jinming, et autres
Publié: (2024)
par: Li, Jinming, et autres
Publié: (2024)
VLA-JEPA: Enhancing Vision-Language-Action Model with Latent World Model
par: Sun, Jingwen, et autres
Publié: (2026)
par: Sun, Jingwen, et autres
Publié: (2026)
AnyCamVLA: Zero-Shot Camera Adaptation for Viewpoint Robust Vision-Language-Action Models
par: Heo, Hyeongjun, et autres
Publié: (2026)
par: Heo, Hyeongjun, et autres
Publié: (2026)
LLaDA-VLA: Vision Language Diffusion Action Models
par: Wen, Yuqing, et autres
Publié: (2025)
par: Wen, Yuqing, et autres
Publié: (2025)
AIR-VLA: Vision-Language-Action Systems for Aerial Manipulation
par: Sun, Jianli, et autres
Publié: (2026)
par: Sun, Jianli, et autres
Publié: (2026)
AdvDreamer Unveils: Are Vision-Language Models Truly Ready for Real-World 3D Variations?
par: Ruan, Shouwei, et autres
Publié: (2024)
par: Ruan, Shouwei, et autres
Publié: (2024)
IRL-VLA: Training an Vision-Language-Action Policy via Reward World Model
par: Jiang, Anqing, et autres
Publié: (2025)
par: Jiang, Anqing, et autres
Publié: (2025)
RationalVLA: A Rational Vision-Language-Action Model with Dual System
par: Song, Wenxuan, et autres
Publié: (2025)
par: Song, Wenxuan, et autres
Publié: (2025)
Evaluating and Improving the Robustness of LiDAR Odometry and Localization Under Real-World Corruptions
par: Yang, Bo, et autres
Publié: (2024)
par: Yang, Bo, et autres
Publié: (2024)
EdgeVLA: Efficient Vision-Language-Action Models
par: Budzianowski, Paweł, et autres
Publié: (2025)
par: Budzianowski, Paweł, et autres
Publié: (2025)
SABER: A Scalable Action-Based Embodied Dataset for Real-World VLA Adaptation
par: Menga, Narsimha, et autres
Publié: (2026)
par: Menga, Narsimha, et autres
Publié: (2026)
DreamVLA: A Vision-Language-Action Model Dreamed with Comprehensive World Knowledge
par: Zhang, Wenyao, et autres
Publié: (2025)
par: Zhang, Wenyao, et autres
Publié: (2025)
PriorVLA: Prior-Preserving Adaptation for Vision-Language-Action Models
par: Guo, Xinyu, et autres
Publié: (2026)
par: Guo, Xinyu, et autres
Publié: (2026)
FocusVLA: Focused Visual Utilization for Vision-Language-Action Models
par: Zhang, Yichi, et autres
Publié: (2026)
par: Zhang, Yichi, et autres
Publié: (2026)
VP-VLA: Visual Prompting as an Interface for Vision-Language-Action Models
par: Wang, Zixuan, et autres
Publié: (2026)
par: Wang, Zixuan, et autres
Publié: (2026)
RedVLA: Physical Red Teaming for Vision-Language-Action Models
par: Zhang, Yuhao, et autres
Publié: (2026)
par: Zhang, Yuhao, et autres
Publié: (2026)
Documents similaires
-
JailWAM: Jailbreaking World Action Models in Robot Control
par: Liu, Hanqing, et autres
Publié: (2026) -
VLA-REPLICA: A Low-Cost, Reproducible Benchmark for Real-World Evaluation of Vision-Language-Action Models
par: Huang, Alex S., et autres
Publié: (2026) -
Thermally Activated Dual-Modal Adversarial Clothing against AI Surveillance Systems
par: Long, Jiahuan, et autres
Publié: (2025) -
RotVLA: Rotational Latent Action for Vision-Language-Action Model
par: Li, Qiwei, et autres
Publié: (2026) -
RoVLA: Multi-Consistency Constraints for Robust Vision-Language-Action Models
par: Luo, Jingzhou, et autres
Publié: (2026)