GuidedVLA: Specifying Task-Relevant Factors via Plug-and-Play Action Attention Specialization
Fuente:
arXiv
Guardado en:
| Autores principales: | Jia, Xiaosong, Yang, Bowen, Ge, Zuhao, Nie, Xian, Zhou, Yuchen, Fan, Cunxin, Li, Yufeng, Chai, Yilin, Jing, Chao, Liang, Zijian, Bu, Qingwen, Cao, Haidong, Wu, Chao, Li, Qifeng, Yang, Zhenjie, Zhang, Chenhe, Li, Hongyang, Wu, Zuxuan, Yan, Junchi, Jiang, Yu-Gang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LLM4Drive: A Survey of Large Language Models for Autonomous Driving
por: Yang, Zhenjie, et al.
Publicado: (2023)
por: Yang, Zhenjie, et al.
Publicado: (2023)
Bench2Drive: Towards Multi-Ability Benchmarking of Closed-Loop End-To-End Autonomous Driving
por: Jia, Xiaosong, et al.
Publicado: (2024)
por: Jia, Xiaosong, et al.
Publicado: (2024)
Raw2Drive: Reinforcement Learning with Aligned World Models for End-to-End Autonomous Driving (in CARLA v2)
por: Yang, Zhenjie, et al.
Publicado: (2025)
por: Yang, Zhenjie, et al.
Publicado: (2025)
Bench2Drive-VL: Benchmarks for Closed-Loop Autonomous Driving with Vision-Language Models
por: Jia, Xiaosong, et al.
Publicado: (2026)
por: Jia, Xiaosong, et al.
Publicado: (2026)
DriveMoE: Mixture-of-Experts for Vision-Language-Action Model in End-to-End Autonomous Driving
por: Yang, Zhenjie, et al.
Publicado: (2025)
por: Yang, Zhenjie, et al.
Publicado: (2025)
UniVLA: Learning to Act Anywhere with Task-centric Latent Actions
por: Bu, Qingwen, et al.
Publicado: (2025)
por: Bu, Qingwen, et al.
Publicado: (2025)
Think2Drive: Efficient Reinforcement Learning by Thinking in Latent World Model for Quasi-Realistic Autonomous Driving (in CARLA-v2)
por: Li, Qifeng, et al.
Publicado: (2024)
por: Li, Qifeng, et al.
Publicado: (2024)
AsyncShield: A Plug-and-Play Edge Adapter for Asynchronous Cloud-based VLA Navigation
por: Yang, Kai, et al.
Publicado: (2026)
por: Yang, Kai, et al.
Publicado: (2026)
Interleave-VLA: Enhancing Robot Manipulation with Interleaved Image-Text Instructions
por: Fan, Cunxin, et al.
Publicado: (2025)
por: Fan, Cunxin, et al.
Publicado: (2025)
Integrating Reweighted Least Squares with Plug-and-Play Diffusion Priors for Noisy Image Restoration
por: Li, Ji, et al.
Publicado: (2025)
por: Li, Ji, et al.
Publicado: (2025)
WholeBodyVLA: Towards Unified Latent VLA for Whole-Body Loco-Manipulation Control
por: Jiang, Haoran, et al.
Publicado: (2025)
por: Jiang, Haoran, et al.
Publicado: (2025)
Accelerating Cross‐Scenario Metasurface Adaptability with Plug‐and‐Play Kernel
por: Nanxuan Wu, et al.
Publicado: (2025)
por: Nanxuan Wu, et al.
Publicado: (2025)
Plug-and-Play Diffusion Meets ADMM: Dual-Variable Coupling for Robust Medical Image Reconstruction
por: Du, Chenhe, et al.
Publicado: (2026)
por: Du, Chenhe, et al.
Publicado: (2026)
Can Users Specify Driving Speed? Bench2Drive-Speed: Benchmark and Baselines for Desired-Speed Conditioned Autonomous Driving
por: Shao, Yuqian, et al.
Publicado: (2026)
por: Shao, Yuqian, et al.
Publicado: (2026)
TrajTok: Technical Report for 2025 Waymo Open Sim Agents Challenge
por: Zhang, Zhiyuan, et al.
Publicado: (2025)
por: Zhang, Zhiyuan, et al.
Publicado: (2025)
PlugSI: Plug-and-Play Test-Time Graph Adaptation for Spatial Interpolation
por: Wu, Xuhang, et al.
Publicado: (2026)
por: Wu, Xuhang, et al.
Publicado: (2026)
FastDriveVLA: Efficient End-to-End Driving via Plug-and-Play Reconstruction-based Token Pruning
por: Cao, Jiajun, et al.
Publicado: (2025)
por: Cao, Jiajun, et al.
Publicado: (2025)
Closed-Loop Visuomotor Control with Generative Expectation for Robotic Manipulation
por: Bu, Qingwen, et al.
Publicado: (2024)
por: Bu, Qingwen, et al.
Publicado: (2024)
Resolving Representation Ambiguity in Feedforward Novel View Synthesis Transformer via Semantic-Spatial Decoupling
por: Wu, Yihang, et al.
Publicado: (2026)
por: Wu, Yihang, et al.
Publicado: (2026)
Surface‐Modified Nano‐SiO2 in Natural Ester Insulating Oil for Enhanced Interfacial Interaction: Insights from Molecular Dynamics Simulations
por: Yingrui Wu, et al.
Publicado: (2025)
por: Yingrui Wu, et al.
Publicado: (2025)
Towards Deploying VLA without Fine-Tuning: Plug-and-Play Inference-Time VLA Policy Steering via Embodied Evolutionary Diffusion
por: Li, Zhuo, et al.
Publicado: (2025)
por: Li, Zhuo, et al.
Publicado: (2025)
ToDRE: Effective Visual Token Pruning via Token Diversity and Task Relevance
por: Li, Duo, et al.
Publicado: (2025)
por: Li, Duo, et al.
Publicado: (2025)
Plug-and-Play Consistency Models for MIMO Channel Estimation
por: Li, Jinlong, et al.
Publicado: (2026)
por: Li, Jinlong, et al.
Publicado: (2026)
HiMoE-VLA: Hierarchical Mixture-of-Experts for Generalist Vision-Language-Action Policies
por: Du, Zhiying, et al.
Publicado: (2025)
por: Du, Zhiying, et al.
Publicado: (2025)
Plug it and Play on Logs: A Configuration-Free Statistic-Based Log Parser
por: Qin, Qiaolin, et al.
Publicado: (2025)
por: Qin, Qiaolin, et al.
Publicado: (2025)
GENPLUGIN: A Plug-and-Play Framework for Long-Tail Generative Recommendation with Exposure Bias Mitigation
por: Yang, Kun, et al.
Publicado: (2025)
por: Yang, Kun, et al.
Publicado: (2025)
Domain-Specialized Tree of Thought through Plug-and-Play Predictors
por: Gao, Xuanqi, et al.
Publicado: (2026)
por: Gao, Xuanqi, et al.
Publicado: (2026)
Plug-and-Play Training Framework for Preference Optimization
por: Ma, Jingyuan, et al.
Publicado: (2024)
por: Ma, Jingyuan, et al.
Publicado: (2024)
T-TIME: Test-Time Information Maximization Ensemble for Plug-and-Play BCIs
por: Li, Siyang, et al.
Publicado: (2024)
por: Li, Siyang, et al.
Publicado: (2024)
QuGStep: Refining Step Size Selection in Gradient Estimation for Variational Quantum Algorithms
por: Liang, Senwei, et al.
Publicado: (2025)
por: Liang, Senwei, et al.
Publicado: (2025)
Optimizing Shot Assignment in Variational Quantum Eigensolver Measurement
por: Zhu, Linghua, et al.
Publicado: (2023)
por: Zhu, Linghua, et al.
Publicado: (2023)
Nautilus: From One Prompt to Plug-and-Play Robot Learning
por: Jin, Yufeng, et al.
Publicado: (2026)
por: Jin, Yufeng, et al.
Publicado: (2026)
SDFP: Speculative Decoding with FIT-Pruned Models for Training-Free and Plug-and-Play LLM Acceleration
por: Wei, Hanyu, et al.
Publicado: (2026)
por: Wei, Hanyu, et al.
Publicado: (2026)
Plug-and-Play Tri-Branch Invertible Block for Image Rescaling
por: Bao, Jingwei, et al.
Publicado: (2024)
por: Bao, Jingwei, et al.
Publicado: (2024)
ELAN4D: Embodiment-Centric 4D Supervision for Vision-Language-Action Models via Plug-and-Play Adaptation
por: He, Zeyuan, et al.
Publicado: (2026)
por: He, Zeyuan, et al.
Publicado: (2026)
Plug-and-Play Versatile Compressed Video Enhancement
por: Zeng, Huimin, et al.
Publicado: (2025)
por: Zeng, Huimin, et al.
Publicado: (2025)
VLA-Pro: Cross-Task Procedural Memory Transfer for Vision-Language-Action Models
por: Si, Shengyu, et al.
Publicado: (2026)
por: Si, Shengyu, et al.
Publicado: (2026)
FasterVAR: Plug-and-Play Acceleration for Visual Autoregressive Models
por: Li, Senmao, et al.
Publicado: (2025)
por: Li, Senmao, et al.
Publicado: (2025)
Causal Effects of Inflammatory Bowel Disease on Lung Function and Disease: A Two‐Sample Mendelian Randomization Study
por: Xuewei Fu, et al.
Publicado: (2025)
por: Xuewei Fu, et al.
Publicado: (2025)
Attention Itself Could Retrieve.RetrieveVGGT: Training-Free Long Context Streaming 3D Reconstruction via Query-Key Similarity Retrieval
por: Zou, Zichen, et al.
Publicado: (2026)
por: Zou, Zichen, et al.
Publicado: (2026)
Ejemplares similares
-
LLM4Drive: A Survey of Large Language Models for Autonomous Driving
por: Yang, Zhenjie, et al.
Publicado: (2023) -
Bench2Drive: Towards Multi-Ability Benchmarking of Closed-Loop End-To-End Autonomous Driving
por: Jia, Xiaosong, et al.
Publicado: (2024) -
Raw2Drive: Reinforcement Learning with Aligned World Models for End-to-End Autonomous Driving (in CARLA v2)
por: Yang, Zhenjie, et al.
Publicado: (2025) -
Bench2Drive-VL: Benchmarks for Closed-Loop Autonomous Driving with Vision-Language Models
por: Jia, Xiaosong, et al.
Publicado: (2026) -
DriveMoE: Mixture-of-Experts for Vision-Language-Action Model in End-to-End Autonomous Driving
por: Yang, Zhenjie, et al.
Publicado: (2025)