VLAgents: A Policy Server for Efficient VLA Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jülg, Tobias, Gamal, Khaled, Nilavadi, Nisarga, Krack, Pierre, Bien, Seongjin, Krawez, Michael, Walter, Florian, Burgard, Wolfram |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLM-Pack: Intuitive Grocery Handling for Logistics Applications
par: Blei, Yannik, et autres
Publié: (2025)
par: Blei, Yannik, et autres
Publié: (2025)
Refined Policy Distillation: From VLA Generalists to RL Experts
par: Jülg, Tobias, et autres
Publié: (2025)
par: Jülg, Tobias, et autres
Publié: (2025)
Rewarding DINO: Predicting Dense Rewards with Vision Foundation Models
par: Krack, Pierre, et autres
Publié: (2026)
par: Krack, Pierre, et autres
Publié: (2026)
Robot Control Stack: A Lean Ecosystem for Robot Learning at Scale
par: Jülg, Tobias, et autres
Publié: (2025)
par: Jülg, Tobias, et autres
Publié: (2025)
CloudTrack: Scalable UAV Tracking with Cloud Semantics
par: Blei, Yannik, et autres
Publié: (2024)
par: Blei, Yannik, et autres
Publié: (2024)
Augmented Reality for RObots (ARRO): Pointing Visuomotor Policies Towards Visual Robustness
par: Mirjalili, Reihaneh, et autres
Publié: (2025)
par: Mirjalili, Reihaneh, et autres
Publié: (2025)
ConPoSe: LLM-Guided Contact Point Selection for Scalable Cooperative Object Pushing
par: Steinkrüger, Noah, et autres
Publié: (2025)
par: Steinkrüger, Noah, et autres
Publié: (2025)
VLM-Vac: Enhancing Smart Vacuums through VLM Knowledge Distillation and Language-Guided Experience Replay
par: Mirjalili, Reihaneh, et autres
Publié: (2024)
par: Mirjalili, Reihaneh, et autres
Publié: (2024)
FlowTouch: View-Invariant Visuo-Tactile Prediction
par: Bien, Seongjin, et autres
Publié: (2026)
par: Bien, Seongjin, et autres
Publié: (2026)
Lan-grasp: Using Large Language Models for Semantic Object Grasping and Placement
par: Mirjalili, Reihaneh, et autres
Publié: (2023)
par: Mirjalili, Reihaneh, et autres
Publié: (2023)
UPTor: Unified 3D Human Pose Dynamics and Trajectory Prediction for Human-Robot Interaction
par: Nilavadi, Nisarga, et autres
Publié: (2025)
par: Nilavadi, Nisarga, et autres
Publié: (2025)
FlowNav: Combining Flow Matching and Depth Priors for Efficient Navigation
par: Gode, Samiran, et autres
Publié: (2024)
par: Gode, Samiran, et autres
Publié: (2024)
Bayesian Optimization for Sample-Efficient Policy Improvement in Robotic Manipulation
par: Röfer, Adrian, et autres
Publié: (2024)
par: Röfer, Adrian, et autres
Publié: (2024)
uPLAM: Robust Panoptic Localization and Mapping Leveraging Perception Uncertainties
par: Sirohi, Kshitij, et autres
Publié: (2024)
par: Sirohi, Kshitij, et autres
Publié: (2024)
Agent-Agnostic Centralized Training for Decentralized Multi-Agent Cooperative Driving
par: Yan, Shengchao, et autres
Publié: (2024)
par: Yan, Shengchao, et autres
Publié: (2024)
A Good Foundation is Worth Many Labels: Label-Efficient Panoptic Segmentation
par: Vödisch, Niclas, et autres
Publié: (2024)
par: Vödisch, Niclas, et autres
Publié: (2024)
MetricNet: Recovering Metric Scale in Generative Navigation Policies
par: Nayak, Abhijeet, et autres
Publié: (2025)
par: Nayak, Abhijeet, et autres
Publié: (2025)
Enabling Dynamic Tracking in Vision-Language-Action Models via Time-Discrete and Time-Continuous Velocity Feedforward
par: Hechtl, Johannes, et autres
Publié: (2026)
par: Hechtl, Johannes, et autres
Publié: (2026)
Label-Efficient LiDAR Panoptic Segmentation
par: Çanakçı, Ahmet Selim, et autres
Publié: (2025)
par: Çanakçı, Ahmet Selim, et autres
Publié: (2025)
Learning Continuous Control with Geometric Regularity from Robot Intrinsic Symmetry
par: Yan, Shengchao, et autres
Publié: (2023)
par: Yan, Shengchao, et autres
Publié: (2023)
Collaborative Dynamic 3D Scene Graphs for Automated Driving
par: Greve, Elias, et autres
Publié: (2023)
par: Greve, Elias, et autres
Publié: (2023)
LiDAR Registration with Visual Foundation Models
par: Vödisch, Niclas, et autres
Publié: (2025)
par: Vödisch, Niclas, et autres
Publié: (2025)
BYE: Build Your Encoder with One Sequence of Exploration Data for Long-Term Dynamic Scene Understanding
par: Huang, Chenguang, et autres
Publié: (2024)
par: Huang, Chenguang, et autres
Publié: (2024)
Vision-Based Autonomous UAV Navigation and Landing for Urban Search and Rescue
par: Mittal, Mayank, et autres
Publié: (2019)
par: Mittal, Mayank, et autres
Publié: (2019)
CoDEPS: Online Continual Learning for Depth Estimation and Panoptic Segmentation
par: Vödisch, Niclas, et autres
Publié: (2023)
par: Vödisch, Niclas, et autres
Publié: (2023)
DiWA: Diffusion Policy Adaptation with World Models
par: Chandra, Akshay L, et autres
Publié: (2025)
par: Chandra, Akshay L, et autres
Publié: (2025)
How Fast Can I Run My VLA? Demystifying VLA Inference Performance with VLA-Perf
par: Jiang, Wenqi, et autres
Publié: (2026)
par: Jiang, Wenqi, et autres
Publié: (2026)
Automatic Target-Less Camera-LiDAR Calibration From Motion and Deep Point Correspondences
par: Petek, Kürsat, et autres
Publié: (2024)
par: Petek, Kürsat, et autres
Publié: (2024)
Bridging the Sim-to-Real Gap with multipanda ros2: A Real-Time ROS2 Framework for Multimanual Systems
par: Škerlj, Jon, et autres
Publié: (2026)
par: Škerlj, Jon, et autres
Publié: (2026)
Towards Deploying VLA without Fine-Tuning: Plug-and-Play Inference-Time VLA Policy Steering via Embodied Evolutionary Diffusion
par: Li, Zhuo, et autres
Publié: (2025)
par: Li, Zhuo, et autres
Publié: (2025)
REGRACE: A Robust and Efficient Graph-based Re-localization Algorithm using Consistency Evaluation
par: Oliveira, Débora N. P., et autres
Publié: (2025)
par: Oliveira, Débora N. P., et autres
Publié: (2025)
CenterGrasp: Object-Aware Implicit Representation Learning for Simultaneous Shape Reconstruction and 6-DoF Grasp Estimation
par: Chisari, Eugenio, et autres
Publié: (2023)
par: Chisari, Eugenio, et autres
Publié: (2023)
Few-Shot Panoptic Segmentation With Foundation Models
par: Käppeler, Markus, et autres
Publié: (2023)
par: Käppeler, Markus, et autres
Publié: (2023)
End-to-End Dexterous Arm-Hand VLA Policies via Shared Autonomy: VR Teleoperation Augmented by Autonomous Hand VLA Policy for Efficient Data Collection
par: Cui, Yu, et autres
Publié: (2025)
par: Cui, Yu, et autres
Publié: (2025)
Label-Efficient Point Cloud Segmentation with Active Learning
par: Meyer, Johannes, et autres
Publié: (2025)
par: Meyer, Johannes, et autres
Publié: (2025)
Sci-VLA: Agentic VLA Inference Plugin for Long-Horizon Tasks in Scientific Experiments
par: Pang, Yiwen, et autres
Publié: (2026)
par: Pang, Yiwen, et autres
Publié: (2026)
VLA-GSE: Boosting Parameter-Efficient Fine-Tuning in VLA with Generalized and Specialized Experts
par: Jiang, Yuhua, et autres
Publié: (2026)
par: Jiang, Yuhua, et autres
Publié: (2026)
VLA-RAIL: A Real-Time Asynchronous Inference Linker for VLA Models and Robots
par: Zhao, Yongsheng, et autres
Publié: (2025)
par: Zhao, Yongsheng, et autres
Publié: (2025)
HyperVLA: Efficient Inference in Vision-Language-Action Models via Hypernetworks
par: Xiong, Zheng, et autres
Publié: (2025)
par: Xiong, Zheng, et autres
Publié: (2025)
Multimodal Spatial Language Maps for Robot Navigation and Manipulation
par: Huang, Chenguang, et autres
Publié: (2025)
par: Huang, Chenguang, et autres
Publié: (2025)
Documents similaires
-
LLM-Pack: Intuitive Grocery Handling for Logistics Applications
par: Blei, Yannik, et autres
Publié: (2025) -
Refined Policy Distillation: From VLA Generalists to RL Experts
par: Jülg, Tobias, et autres
Publié: (2025) -
Rewarding DINO: Predicting Dense Rewards with Vision Foundation Models
par: Krack, Pierre, et autres
Publié: (2026) -
Robot Control Stack: A Lean Ecosystem for Robot Learning at Scale
par: Jülg, Tobias, et autres
Publié: (2025) -
CloudTrack: Scalable UAV Tracking with Cloud Semantics
par: Blei, Yannik, et autres
Publié: (2024)