VGAS: Value-Guided Action-Chunk Selection for Few-Shot Vision-Language-Action Adaptation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Changhua, Yu, En, Xuan, Junyu, Lu, Jie |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mixture of Horizons in Action Chunking
par: Jing, Dong, et autres
Publié: (2025)
par: Jing, Dong, et autres
Publié: (2025)
ATA: Bridging Implicit Reasoning with Attention-Guided and Action-Guided Inference for Vision-Language Action Models
par: Yang, Cheng, et autres
Publié: (2026)
par: Yang, Cheng, et autres
Publié: (2026)
STAR: Semantic-Temporal Adaptive Representation Learning for Few-Shot Action Recognition
par: Liu, Hongli, et autres
Publié: (2026)
par: Liu, Hongli, et autres
Publié: (2026)
Multimodal Prototype-Enhanced Network for Few-Shot Action Recognition
par: Ni, Xinzhe, et autres
Publié: (2022)
par: Ni, Xinzhe, et autres
Publié: (2022)
Text-Guided Attention is All You Need for Zero-Shot Robustness in Vision-Language Models
par: Yu, Lu, et autres
Publié: (2024)
par: Yu, Lu, et autres
Publié: (2024)
Like Humans to Few-Shot Learning through Knowledge Permeation of Vision and Text
par: Jia, Yuyu, et autres
Publié: (2024)
par: Jia, Yuyu, et autres
Publié: (2024)
TINA: Think, Interaction, and Action Framework for Zero-Shot Vision Language Navigation
par: Li, Dingbang, et autres
Publié: (2024)
par: Li, Dingbang, et autres
Publié: (2024)
CF-VLA: Efficient Coarse-to-Fine Action Generation for Vision-Language-Action Policies
par: Du, Fan, et autres
Publié: (2026)
par: Du, Fan, et autres
Publié: (2026)
Generalizable Vision-Language Few-Shot Adaptation with Predictive Prompts and Negative Learning
par: Mandalika, Sriram
Publié: (2025)
par: Mandalika, Sriram
Publié: (2025)
SOAP: Enhancing Spatio-Temporal Relation and Motion Information Capturing for Few-Shot Action Recognition
par: Huang, Wenbo, et autres
Publié: (2024)
par: Huang, Wenbo, et autres
Publié: (2024)
Offline Semantic Guidance for Efficient Vision-Language-Action Policy Distillation
par: Shi, Jin, et autres
Publié: (2026)
par: Shi, Jin, et autres
Publié: (2026)
Attention-Guided Patch-Wise Sparse Adversarial Attacks on Vision-Language-Action Models
par: Zhang, Naifu, et autres
Publié: (2025)
par: Zhang, Naifu, et autres
Publié: (2025)
Efficient Few-Shot Continual Learning in Vision-Language Models
par: Panos, Aristeidis, et autres
Publié: (2025)
par: Panos, Aristeidis, et autres
Publié: (2025)
SpecPrune-VLA: Accelerating Vision-Language-Action Models via Action-Aware Self-Speculative Pruning
par: Wang, Hanzhen, et autres
Publié: (2025)
par: Wang, Hanzhen, et autres
Publié: (2025)
ALAM: Algebraically Consistent Latent Action Model for Vision-Language-Action Models
par: Tang, Zuojin, et autres
Publié: (2026)
par: Tang, Zuojin, et autres
Publié: (2026)
Towards Efficient and General-Purpose Few-Shot Misclassification Detection for Vision-Language Models
par: Zeng, Fanhu, et autres
Publié: (2025)
par: Zeng, Fanhu, et autres
Publié: (2025)
CombatVLA: An Efficient Vision-Language-Action Model for Combat Tasks in 3D Action Role-Playing Games
par: Chen, Peng, et autres
Publié: (2025)
par: Chen, Peng, et autres
Publié: (2025)
Boosting Skeleton-based Zero-Shot Action Recognition with Training-Free Test-Time Adaptation
par: Zhu, Jingmin, et autres
Publié: (2025)
par: Zhu, Jingmin, et autres
Publié: (2025)
COREY: Entropy-Guided Runtime Chunk Scheduling for Selective Scan Kernels
par: Ma, Bo, et autres
Publié: (2026)
par: Ma, Bo, et autres
Publié: (2026)
Closed-Loop Action Chunks with Dynamic Corrections for Training-Free Diffusion Policy
par: Wu, Pengyuan, et autres
Publié: (2026)
par: Wu, Pengyuan, et autres
Publié: (2026)
A$^2$M$^2$-Net: Adaptively Aligned Multi-Scale Moment for Few-Shot Action Recognition
par: Gao, Zilin, et autres
Publié: (2025)
par: Gao, Zilin, et autres
Publié: (2025)
Survey on Vision-Language-Action Models
par: Adilkhanov, Adilzhan, et autres
Publié: (2025)
par: Adilkhanov, Adilzhan, et autres
Publié: (2025)
Modality-Collaborative Low-Rank Decomposers for Few-Shot Video Domain Adaptation
par: Wanyan, Yuyang, et autres
Publié: (2025)
par: Wanyan, Yuyang, et autres
Publié: (2025)
When Robots Obey the Patch: Universal Transferable Patch Attacks on Vision-Language-Action Models
par: Lu, Hui, et autres
Publié: (2025)
par: Lu, Hui, et autres
Publié: (2025)
VLM4VLA: Revisiting Vision-Language-Models in Vision-Language-Action Models
par: Zhang, Jianke, et autres
Publié: (2026)
par: Zhang, Jianke, et autres
Publié: (2026)
Active Multimodal Distillation for Few-shot Action Recognition
par: Feng, Weijia, et autres
Publié: (2025)
par: Feng, Weijia, et autres
Publié: (2025)
Exploring Cross-Domain Few-Shot Classification via Frequency-Aware Prompting
par: Zhang, Tiange, et autres
Publié: (2024)
par: Zhang, Tiange, et autres
Publié: (2024)
Sparsity Outperforms Low-Rank Projections in Few-Shot Adaptation
par: Mrabah, Nairouz, et autres
Publié: (2025)
par: Mrabah, Nairouz, et autres
Publié: (2025)
Knowledge Adaptation Network for Few-Shot Class-Incremental Learning
par: Wang, Ye, et autres
Publié: (2024)
par: Wang, Ye, et autres
Publié: (2024)
NORA: A Small Open-Sourced Generalist Vision Language Action Model for Embodied Tasks
par: Hung, Chia-Yu, et autres
Publié: (2025)
par: Hung, Chia-Yu, et autres
Publié: (2025)
Learning Vision-Language-Action World Models for Autonomous Driving
par: Wang, Guoqing, et autres
Publié: (2026)
par: Wang, Guoqing, et autres
Publié: (2026)
Conformal Predictions for Human Action Recognition with Vision-Language Models
par: Tim, Bary, et autres
Publié: (2025)
par: Tim, Bary, et autres
Publié: (2025)
Information-Theoretic Constraints for Continual Vision-Language-Action Alignment
par: Zhao, Libang, et autres
Publié: (2026)
par: Zhao, Libang, et autres
Publié: (2026)
VLA-Pro: Cross-Task Procedural Memory Transfer for Vision-Language-Action Models
par: Si, Shengyu, et autres
Publié: (2026)
par: Si, Shengyu, et autres
Publié: (2026)
ProKeR: A Kernel Perspective on Few-Shot Adaptation of Large Vision-Language Models
par: Bendou, Yassir, et autres
Publié: (2025)
par: Bendou, Yassir, et autres
Publié: (2025)
Weight Copy and Low-Rank Adaptation for Few-Shot Distillation of Vision Transformers
par: Grigore, Diana-Nicoleta, et autres
Publié: (2024)
par: Grigore, Diana-Nicoleta, et autres
Publié: (2024)
VOTE: Vision-Language-Action Optimization with Trajectory Ensemble Voting
par: Lin, Juyi, et autres
Publié: (2025)
par: Lin, Juyi, et autres
Publié: (2025)
LVDrive: Latent Visual Representation Enhanced Vision-Language-Action Autonomous Driving Model
par: Mei, Xiaodong, et autres
Publié: (2026)
par: Mei, Xiaodong, et autres
Publié: (2026)
ThinkAct: Vision-Language-Action Reasoning via Reinforced Visual Latent Planning
par: Huang, Chi-Pin, et autres
Publié: (2025)
par: Huang, Chi-Pin, et autres
Publié: (2025)
ForgeVLA: Federated Vision-Language-Action Learning without Language Annotations
par: Zhou, Yuhao, et autres
Publié: (2026)
par: Zhou, Yuhao, et autres
Publié: (2026)
Documents similaires
-
Mixture of Horizons in Action Chunking
par: Jing, Dong, et autres
Publié: (2025) -
ATA: Bridging Implicit Reasoning with Attention-Guided and Action-Guided Inference for Vision-Language Action Models
par: Yang, Cheng, et autres
Publié: (2026) -
STAR: Semantic-Temporal Adaptive Representation Learning for Few-Shot Action Recognition
par: Liu, Hongli, et autres
Publié: (2026) -
Multimodal Prototype-Enhanced Network for Few-Shot Action Recognition
par: Ni, Xinzhe, et autres
Publié: (2022) -
Text-Guided Attention is All You Need for Zero-Shot Robustness in Vision-Language Models
par: Yu, Lu, et autres
Publié: (2024)