Any3D-VLA: Enhancing VLA Robustness via Diverse Point Clouds
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Fan, Xianzhe, Deng, Shengliang, Wu, Xiaoyang, Lu, Yuxiang, Li, Zhuoling, Yan, Mi, Zhang, Yujia, Zhang, Zhizheng, Wang, He, Zhao, Hengshuang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
StereoVLA: Enhancing Vision-Language-Action Models with Stereo Vision
par: Deng, Shengliang, et autres
Publié: (2025)
par: Deng, Shengliang, et autres
Publié: (2025)
DreamAvoid: Critical-Phase Test-Time Dreaming to Avoid Failures in VLA Policies
par: Fan, Xianzhe, et autres
Publié: (2026)
par: Fan, Xianzhe, et autres
Publié: (2026)
GraspVLA: a Grasping Foundation Model Pre-trained on Billion-scale Synthetic Action Data
par: Deng, Shengliang, et autres
Publié: (2025)
par: Deng, Shengliang, et autres
Publié: (2025)
TrackVLA++: Unleashing Reasoning and Memory Capabilities in VLA Models for Embodied Visual Tracking
par: Liu, Jiahang, et autres
Publié: (2025)
par: Liu, Jiahang, et autres
Publié: (2025)
MM-Nav: Multi-View VLA Model for Robust Visual Navigation via Multi-Expert Learning
par: Xu, Tianyu, et autres
Publié: (2025)
par: Xu, Tianyu, et autres
Publié: (2025)
TrackVLA: Embodied Visual Tracking in the Wild
par: Wang, Shaoan, et autres
Publié: (2025)
par: Wang, Shaoan, et autres
Publié: (2025)
VLA Knows Its Limits
par: Wang, Haoxuan, et autres
Publié: (2026)
par: Wang, Haoxuan, et autres
Publié: (2026)
AsyncVLA: An Asynchronous VLA for Fast and Robust Navigation on the Edge
par: Hirose, Noriaki, et autres
Publié: (2026)
par: Hirose, Noriaki, et autres
Publié: (2026)
Sim-to-Real Dynamic Object Manipulation on Conveyor Systems via Optimization Path Shaping
par: Li, Zhuoling, et autres
Publié: (2025)
par: Li, Zhuoling, et autres
Publié: (2025)
DreamVLA: A Vision-Language-Action Model Dreamed with Comprehensive World Knowledge
par: Zhang, Wenyao, et autres
Publié: (2025)
par: Zhang, Wenyao, et autres
Publié: (2025)
UrbanVLA: A Vision-Language-Action Model for Urban Micromobility
par: Li, Anqi, et autres
Publié: (2025)
par: Li, Anqi, et autres
Publié: (2025)
VLA-GSE: Boosting Parameter-Efficient Fine-Tuning in VLA with Generalized and Specialized Experts
par: Jiang, Yuhua, et autres
Publié: (2026)
par: Jiang, Yuhua, et autres
Publié: (2026)
BlockVLA: Accelerating Autoregressive VLA via Block Diffusion Finetuning
par: Wang, Ruiheng, et autres
Publié: (2026)
par: Wang, Ruiheng, et autres
Publié: (2026)
AnyCamVLA: Zero-Shot Camera Adaptation for Viewpoint Robust Vision-Language-Action Models
par: Heo, Hyeongjun, et autres
Publié: (2026)
par: Heo, Hyeongjun, et autres
Publié: (2026)
ForceVLA: Enhancing VLA Models with a Force-aware MoE for Contact-rich Manipulation
par: Yu, Jiawen, et autres
Publié: (2025)
par: Yu, Jiawen, et autres
Publié: (2025)
Interleave-VLA: Enhancing Robot Manipulation with Interleaved Image-Text Instructions
par: Fan, Cunxin, et autres
Publié: (2025)
par: Fan, Cunxin, et autres
Publié: (2025)
Sci-VLA: Agentic VLA Inference Plugin for Long-Horizon Tasks in Scientific Experiments
par: Pang, Yiwen, et autres
Publié: (2026)
par: Pang, Yiwen, et autres
Publié: (2026)
EchoVLA: Synergistic Declarative Memory for VLA-Driven Mobile Manipulation
par: Lin, Min, et autres
Publié: (2025)
par: Lin, Min, et autres
Publié: (2025)
How Fast Can I Run My VLA? Demystifying VLA Inference Performance with VLA-Perf
par: Jiang, Wenqi, et autres
Publié: (2026)
par: Jiang, Wenqi, et autres
Publié: (2026)
What to Ignore, What to React: Visually Robust RL Fine-Tuning of VLA Models
par: Peng, Yuanfang, et autres
Publié: (2026)
par: Peng, Yuanfang, et autres
Publié: (2026)
VIP: Vision Instructed Pre-training for Robotic Manipulation
par: Li, Zhuoling, et autres
Publié: (2024)
par: Li, Zhuoling, et autres
Publié: (2024)
DiG-Flow: Discrepancy-Guided Flow Matching for Robust VLA Models
par: Zhang, Wanpeng, et autres
Publié: (2025)
par: Zhang, Wanpeng, et autres
Publié: (2025)
DroneVLA: VLA based Aerial Manipulation
par: Mehboob, Fawad, et autres
Publié: (2026)
par: Mehboob, Fawad, et autres
Publié: (2026)
VacuumVLA: Boosting VLA Capabilities via a Unified Suction and Gripping Tool for Complex Robotic Manipulation
par: Zhou, Hui, et autres
Publié: (2025)
par: Zhou, Hui, et autres
Publié: (2025)
MindVLA-U1: VLA Beats VA with Unified Streaming Architecture for Autonomous Driving
par: Huang, Yuzhou, et autres
Publié: (2026)
par: Huang, Yuzhou, et autres
Publié: (2026)
ManualVLA: A Unified VLA Model for Chain-of-Thought Manual Generation and Robotic Manipulation
par: Gu, Chenyang, et autres
Publié: (2025)
par: Gu, Chenyang, et autres
Publié: (2025)
From Knowing to Doing Precisely: A General Self-Correction and Termination Framework for VLA models
par: Zhang, Wentao, et autres
Publié: (2026)
par: Zhang, Wentao, et autres
Publié: (2026)
SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning
par: Li, Haozhan, et autres
Publié: (2025)
par: Li, Haozhan, et autres
Publié: (2025)
JEPA-VLA: Video Predictive Embedding is Needed for VLA Models
par: Miao, Shangchen, et autres
Publié: (2026)
par: Miao, Shangchen, et autres
Publié: (2026)
STRONG-VLA: Decoupled Robustness Learning for Vision-Language-Action Models under Multimodal Perturbations
par: Xie, Yuhan, et autres
Publié: (2026)
par: Xie, Yuhan, et autres
Publié: (2026)
Sentinel-VLA: A Metacognitive VLA Model with Active Status Monitoring for Dynamic Reasoning and Error Recovery
par: Li, Wenhao, et autres
Publié: (2026)
par: Li, Wenhao, et autres
Publié: (2026)
Utonia: Toward One Encoder for All Point Clouds
par: Zhang, Yujia, et autres
Publié: (2026)
par: Zhang, Yujia, et autres
Publié: (2026)
Fast-dVLA: Accelerating Discrete Diffusion VLA to Real-Time Performance
par: Song, Wenxuan, et autres
Publié: (2026)
par: Song, Wenxuan, et autres
Publié: (2026)
AT-VLA: Adaptive Tactile Injection for Enhanced Feedback Reaction in Vision-Language-Action Models
par: Li, Xiaoqi, et autres
Publié: (2026)
par: Li, Xiaoqi, et autres
Publié: (2026)
Unified Noise Steering for Efficient Human-Guided VLA Adaptation
par: Lu, Junjie, et autres
Publié: (2026)
par: Lu, Junjie, et autres
Publié: (2026)
RobustVLA: Robustness-Aware Reinforcement Post-Training for Vision-Language-Action Models
par: Zhang, Hongyin, et autres
Publié: (2025)
par: Zhang, Hongyin, et autres
Publié: (2025)
Phantom Menace: Exploring and Enhancing the Robustness of VLA Models Against Physical Sensor Attacks
par: Lu, Xuancun, et autres
Publié: (2025)
par: Lu, Xuancun, et autres
Publié: (2025)
A Pragmatic VLA Foundation Model
par: Wu, Wei, et autres
Publié: (2026)
par: Wu, Wei, et autres
Publié: (2026)
SimVLA: A Simple VLA Baseline for Robotic Manipulation
par: Luo, Yuankai, et autres
Publié: (2026)
par: Luo, Yuankai, et autres
Publié: (2026)
TacVLA: Contact-Aware Tactile Fusion for Robust Vision-Language-Action Manipulation
par: Zhang, Kaidi, et autres
Publié: (2026)
par: Zhang, Kaidi, et autres
Publié: (2026)
Documents similaires
-
StereoVLA: Enhancing Vision-Language-Action Models with Stereo Vision
par: Deng, Shengliang, et autres
Publié: (2025) -
DreamAvoid: Critical-Phase Test-Time Dreaming to Avoid Failures in VLA Policies
par: Fan, Xianzhe, et autres
Publié: (2026) -
GraspVLA: a Grasping Foundation Model Pre-trained on Billion-scale Synthetic Action Data
par: Deng, Shengliang, et autres
Publié: (2025) -
TrackVLA++: Unleashing Reasoning and Memory Capabilities in VLA Models for Embodied Visual Tracking
par: Liu, Jiahang, et autres
Publié: (2025) -
MM-Nav: Multi-View VLA Model for Robust Visual Navigation via Multi-Expert Learning
par: Xu, Tianyu, et autres
Publié: (2025)