VLAMotor: Test-Guided Enhancement of Vision-Language-Action Models via Agent-BasedData Synthesis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liao, Zeqin, Ren, Peifan, Gao, Zixu, Gong, Hongyu, Hu, Lianyu, Tang, Wenbing, Nan, Yuhong, Zheng, Zibin, Liu, Yang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Augmenting Smart Contract Decompiler Output through Fine-grained Dependency Analysis and LLM-facilitated Semantic Recovery
par: Liao, Zeqin, et autres
Publié: (2025)
par: Liao, Zeqin, et autres
Publié: (2025)
BrainMem: Brain-Inspired Evolving Memory for Embodied Agent Task Planning
par: Ma, Xiaoyu, et autres
Publié: (2026)
par: Ma, Xiaoyu, et autres
Publié: (2026)
An Empirical Study on Embodied Artificial Intelligence Robot (EAIR) Software Bugs
par: Liao, Zeqin, et autres
Publié: (2025)
par: Liao, Zeqin, et autres
Publié: (2025)
SmartState: Detecting State-Reverting Vulnerabilities in Smart Contracts via Fine-Grained State-Dependency Analysis
par: Liao, Zeqin, et autres
Publié: (2024)
par: Liao, Zeqin, et autres
Publié: (2024)
Satellite: Detecting and Analyzing Smart Contract Vulnerabilities caused by Subcontract Misuse
par: Liao, Zeqin, et autres
Publié: (2025)
par: Liao, Zeqin, et autres
Publié: (2025)
Detecting Non-Optimal Decisions of Embodied Agents via Diversity-Guided Metamorphic Testing
par: Wu, Wenzhao, et autres
Publié: (2025)
par: Wu, Wenzhao, et autres
Publié: (2025)
ST4VLA: Spatially Guided Training for Vision-Language-Action Models
par: Ye, Jinhui, et autres
Publié: (2026)
par: Ye, Jinhui, et autres
Publié: (2026)
V-VLAPS: Value-Guided Planning for Vision-Language-Action Models
par: Ren, Ke, et autres
Publié: (2026)
par: Ren, Ke, et autres
Publié: (2026)
SwitchVLA: Execution-Aware Task Switching for Vision-Language-Action Models
par: Li, Meng, et autres
Publié: (2025)
par: Li, Meng, et autres
Publié: (2025)
EVOLVE-VLA: Test-Time Training from Environment Feedback for Vision-Language-Action Models
par: Bai, Zechen, et autres
Publié: (2025)
par: Bai, Zechen, et autres
Publié: (2025)
LaViRA: Language-Vision-Robot Actions Translation for Zero-Shot Vision Language Navigation in Continuous Environments
par: Ding, Hongyu, et autres
Publié: (2025)
par: Ding, Hongyu, et autres
Publié: (2025)
FASTer: Toward Efficient Autoregressive Vision Language Action Modeling via Neural Action Tokenization
par: Liu, Yicheng, et autres
Publié: (2025)
par: Liu, Yicheng, et autres
Publié: (2025)
SmartAxe: Detecting Cross-Chain Vulnerabilities in Bridge Smart Contracts via Fine-Grained Static Analysis
par: Liao, Zeqin, et autres
Publié: (2024)
par: Liao, Zeqin, et autres
Publié: (2024)
ActionFlow: A Pipelined Action Acceleration for Vision Language Models on Edge
par: Dai, Yuntao, et autres
Publié: (2025)
par: Dai, Yuntao, et autres
Publié: (2025)
ACoT-VLA: Action Chain-of-Thought for Vision-Language-Action Models
par: Zhong, Linqing, et autres
Publié: (2026)
par: Zhong, Linqing, et autres
Publié: (2026)
ActionCodec: What Makes for Good Action Tokenizers
par: Dong, Zibin, et autres
Publié: (2026)
par: Dong, Zibin, et autres
Publié: (2026)
LatBot: Distilling Universal Latent Actions for Vision-Language-Action Models
par: Li, Zuolei, et autres
Publié: (2025)
par: Li, Zuolei, et autres
Publié: (2025)
Metamorphic Testing of Vision-Language Action-Enabled Robots
par: Valle, Pablo, et autres
Publié: (2026)
par: Valle, Pablo, et autres
Publié: (2026)
A Vision-Language-Action Model for Adaptive Ultrasound-Guided Needle Insertion and Needle Tracking
par: Zhang, Yuelin, et autres
Publié: (2026)
par: Zhang, Yuelin, et autres
Publié: (2026)
KineVLA: Towards Kinematics-Aware Vision-Language-Action Models with Bi-Level Action Decomposition
par: Han, Gaoge, et autres
Publié: (2026)
par: Han, Gaoge, et autres
Publié: (2026)
GeneralVLA: Generalizable Vision-Language-Action Models with Knowledge-Guided Trajectory Planning
par: Ma, Guoqing, et autres
Publié: (2026)
par: Ma, Guoqing, et autres
Publié: (2026)
HEADER: Hierarchical Robot Exploration via Attention-Based Deep Reinforcement Learning with Expert-Guided Reward
par: Cao, Yuhong, et autres
Publié: (2025)
par: Cao, Yuhong, et autres
Publié: (2025)
CollabVLA: Self-Reflective Vision-Language-Action Model Dreaming Together with Human
par: Sun, Nan, et autres
Publié: (2025)
par: Sun, Nan, et autres
Publié: (2025)
ProgressVLA: Progress-Guided Diffusion Policy for Vision-Language Robotic Manipulation
par: Yan, Hongyu, et autres
Publié: (2026)
par: Yan, Hongyu, et autres
Publié: (2026)
XR-1: Towards Versatile Vision-Language-Action Models via Learning Unified Vision-Motion Representations
par: Fan, Shichao, et autres
Publié: (2025)
par: Fan, Shichao, et autres
Publié: (2025)
BitVLA: 1-bit Vision-Language-Action Models for Robotics Manipulation
par: Wang, Hongyu, et autres
Publié: (2025)
par: Wang, Hongyu, et autres
Publié: (2025)
StereoVLA: Enhancing Vision-Language-Action Models with Stereo Vision
par: Deng, Shengliang, et autres
Publié: (2025)
par: Deng, Shengliang, et autres
Publié: (2025)
Failing Forward: Adaptive Failure-Informed Learning for Vision-Language-Action Models
par: Zheng, Meng, et autres
Publié: (2026)
par: Zheng, Meng, et autres
Publié: (2026)
Multi-Agent Trajectory Prediction with Difficulty-Guided Feature Enhancement Network
par: Xin, Guipeng, et autres
Publié: (2024)
par: Xin, Guipeng, et autres
Publié: (2024)
Unveiling the Potential of Vision-Language-Action Models with Open-Ended Multimodal Instructions
par: Zhao, Wei, et autres
Publié: (2025)
par: Zhao, Wei, et autres
Publié: (2025)
HazardArena: Evaluating Semantic Safety in Vision-Language-Action Models
par: Chen, Zixing, et autres
Publié: (2026)
par: Chen, Zixing, et autres
Publié: (2026)
VLATest: Testing and Evaluating Vision-Language-Action Models for Robotic Manipulation
par: Wang, Zhijie, et autres
Publié: (2024)
par: Wang, Zhijie, et autres
Publié: (2024)
Premover: Fast Vision-Language-Action Control by Acting Before Instructions Are Complete
par: Park, Joonha, et autres
Publié: (2026)
par: Park, Joonha, et autres
Publié: (2026)
FlowVLA: Visual Chain of Thought-based Motion Reasoning for Vision-Language-Action Models
par: Zhong, Zhide, et autres
Publié: (2025)
par: Zhong, Zhide, et autres
Publié: (2025)
RoVer: Robot Reward Model as Test-Time Verifier for Vision-Language-Action Model
par: Dai, Mingtong, et autres
Publié: (2025)
par: Dai, Mingtong, et autres
Publié: (2025)
QuadAgent: A Responsive Agent System for Vision-Language Guided Quadrotor Agile Flight
par: Zhuang, Ao, et autres
Publié: (2026)
par: Zhuang, Ao, et autres
Publié: (2026)
VLAS: Vision-Language-Action Model With Speech Instructions For Customized Robot Manipulation
par: Zhao, Wei, et autres
Publié: (2025)
par: Zhao, Wei, et autres
Publié: (2025)
ECHO: Continuous Hierarchical Memory for Vision-Language-Action Models
par: Hu, Yanbin, et autres
Publié: (2026)
par: Hu, Yanbin, et autres
Publié: (2026)
AID: Agent Intent from Diffusion for Multi-Agent Informative Path Planning
par: Lew, Jeric, et autres
Publié: (2025)
par: Lew, Jeric, et autres
Publié: (2025)
One Agent to Guide Them All: Empowering MLLMs for Vision-and-Language Navigation via Explicit World Representation
par: Li, Zerui, et autres
Publié: (2026)
par: Li, Zerui, et autres
Publié: (2026)
Documents similaires
-
Augmenting Smart Contract Decompiler Output through Fine-grained Dependency Analysis and LLM-facilitated Semantic Recovery
par: Liao, Zeqin, et autres
Publié: (2025) -
BrainMem: Brain-Inspired Evolving Memory for Embodied Agent Task Planning
par: Ma, Xiaoyu, et autres
Publié: (2026) -
An Empirical Study on Embodied Artificial Intelligence Robot (EAIR) Software Bugs
par: Liao, Zeqin, et autres
Publié: (2025) -
SmartState: Detecting State-Reverting Vulnerabilities in Smart Contracts via Fine-Grained State-Dependency Analysis
par: Liao, Zeqin, et autres
Publié: (2024) -
Satellite: Detecting and Analyzing Smart Contract Vulnerabilities caused by Subcontract Misuse
par: Liao, Zeqin, et autres
Publié: (2025)