cVLA: Towards Efficient Camera-Space VLAs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Argus, Max, Bratulic, Jelena, Masnavi, Houman, Velikanov, Maxim, Heppert, Nick, Valada, Abhinav, Brox, Thomas |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DITTO: Demonstration Imitation by Trajectory Transformation
par: Heppert, Nick, et autres
Publié: (2024)
par: Heppert, Nick, et autres
Publié: (2024)
Learning Robotic Manipulation Policies from Point Clouds with Conditional Flow Matching
par: Chisari, Eugenio, et autres
Publié: (2024)
par: Chisari, Eugenio, et autres
Publié: (2024)
SparTa: Sparse Graphical Task Models from a Handful of Demonstrations
par: Röfer, Adrian, et autres
Publié: (2026)
par: Röfer, Adrian, et autres
Publié: (2026)
Scaling Single Human Demonstrations for Imitation Learning using Generative Foundational Models
par: Heppert, Nick, et autres
Publié: (2026)
par: Heppert, Nick, et autres
Publié: (2026)
Imagine2touch: Predictive Tactile Sensing for Robotic Manipulation using Efficient Low-Dimensional Signals
par: Ayad, Abdallah, et autres
Publié: (2024)
par: Ayad, Abdallah, et autres
Publié: (2024)
Self-Supervised Online Robot-Agnostic Traversability Estimation for Open-World Environments
par: Hindel, Julia, et autres
Publié: (2026)
par: Hindel, Julia, et autres
Publié: (2026)
Efficient Learning of Object Placement with Intra-Category Transfer
par: Röfer, Adrian, et autres
Publié: (2024)
par: Röfer, Adrian, et autres
Publié: (2024)
CenterArt: Joint Shape Reconstruction and 6-DoF Grasp Estimation of Articulated Objects
par: Mokhtar, Sassan, et autres
Publié: (2024)
par: Mokhtar, Sassan, et autres
Publié: (2024)
AnchorD: Metric Grounding of Monocular Depth Using Factor Graphs
par: Dorer, Simon, et autres
Publié: (2026)
par: Dorer, Simon, et autres
Publié: (2026)
PseudoTouch: Efficiently Imaging the Surface Feel of Objects for Robotic Manipulation
par: Röfer, Adrian, et autres
Publié: (2024)
par: Röfer, Adrian, et autres
Publié: (2024)
The Neural Compass: Probabilistic Relative Feature Fields for Robotic Search
par: Somaschini, Gabriele, et autres
Publié: (2026)
par: Somaschini, Gabriele, et autres
Publié: (2026)
Neural Fields in Robotics: A Survey
par: Irshad, Muhammad Zubair, et autres
Publié: (2024)
par: Irshad, Muhammad Zubair, et autres
Publié: (2024)
CenterGrasp: Object-Aware Implicit Representation Learning for Simultaneous Shape Reconstruction and 6-DoF Grasp Estimation
par: Chisari, Eugenio, et autres
Publié: (2023)
par: Chisari, Eugenio, et autres
Publié: (2023)
Label-Efficient LiDAR Semantic Segmentation with 2D-3D Vision Transformer Adapters
par: Hindel, Julia, et autres
Publié: (2025)
par: Hindel, Julia, et autres
Publié: (2025)
MSG: Multi-Stream Generative Policies for Sample-Efficient Robotic Manipulation
par: von Hartz, Jan Ole, et autres
Publié: (2025)
par: von Hartz, Jan Ole, et autres
Publié: (2025)
ParkDiffusion: Heterogeneous Multi-Agent Multi-Modal Trajectory Prediction for Automated Parking using Diffusion Models
par: Wei, Jiarong, et autres
Publié: (2025)
par: Wei, Jiarong, et autres
Publié: (2025)
The Art of Imitation: Learning Long-Horizon Manipulation Tasks from Few Demonstrations
par: von Hartz, Jan Ole, et autres
Publié: (2024)
par: von Hartz, Jan Ole, et autres
Publié: (2024)
NeRF and Gaussian Splatting SLAM in the Wild
par: Schmidt, Fabian, et autres
Publié: (2024)
par: Schmidt, Fabian, et autres
Publié: (2024)
When and How Does CLIP Enable Domain and Compositional Generalization?
par: Kempf, Elias, et autres
Publié: (2025)
par: Kempf, Elias, et autres
Publié: (2025)
Concept Bottleneck Models Without Predefined Concepts
par: Schrodi, Simon, et autres
Publié: (2024)
par: Schrodi, Simon, et autres
Publié: (2024)
Affordance Field Intervention: Enabling VLAs to Escape Memory Traps in Robotic Manipulation
par: Xu, Siyu, et autres
Publié: (2025)
par: Xu, Siyu, et autres
Publié: (2025)
The Unreasonable Effectiveness of Discrete-Time Gaussian Process Mixtures for Robot Policy Learning
par: von Hartz, Jan Ole, et autres
Publié: (2025)
par: von Hartz, Jan Ole, et autres
Publié: (2025)
Eureka-Moments in Transformers: Multi-Step Tasks Reveal Softmax Induced Optimization Problems
par: Hoffmann, David T., et autres
Publié: (2023)
par: Hoffmann, David T., et autres
Publié: (2023)
Hyperspectral Adapter for Semantic Segmentation with Vision Foundation Models
par: Hurtado, Juana Valeria, et autres
Publié: (2025)
par: Hurtado, Juana Valeria, et autres
Publié: (2025)
Using Knowledge Graphs to harvest datasets for efficient CLIP model training
par: Ging, Simon, et autres
Publié: (2025)
par: Ging, Simon, et autres
Publié: (2025)
Differentiable-Optimization Based Neural Policy for Occlusion-Aware Target Tracking
par: Masnavi, Houman, et autres
Publié: (2024)
par: Masnavi, Houman, et autres
Publié: (2024)
SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics
par: Shukor, Mustafa, et autres
Publié: (2025)
par: Shukor, Mustafa, et autres
Publié: (2025)
Two Effects, One Trigger: On the Modality Gap, Object Bias, and Information Imbalance in Contrastive Vision-Language Models
par: Schrodi, Simon, et autres
Publié: (2024)
par: Schrodi, Simon, et autres
Publié: (2024)
VLASH: Real-Time VLAs via Future-State-Aware Asynchronous Inference
par: Tang, Jiaming, et autres
Publié: (2025)
par: Tang, Jiaming, et autres
Publié: (2025)
CMRNext: Camera to LiDAR Matching in the Wild for Localization and Extrinsic Calibration
par: Cattaneo, Daniele, et autres
Publié: (2024)
par: Cattaneo, Daniele, et autres
Publié: (2024)
SimVLA: A Simple VLA Baseline for Robotic Manipulation
par: Luo, Yuankai, et autres
Publié: (2026)
par: Luo, Yuankai, et autres
Publié: (2026)
AsyncVLA: An Asynchronous VLA for Fast and Robust Navigation on the Edge
par: Hirose, Noriaki, et autres
Publié: (2026)
par: Hirose, Noriaki, et autres
Publié: (2026)
Scaling Sim-to-Real Reinforcement Learning for Robot VLAs with Generative 3D Worlds
par: Choi, Andrew, et autres
Publié: (2026)
par: Choi, Andrew, et autres
Publié: (2026)
Motion Forecasting via Model-Based Risk Minimization
par: Distelzweig, Aron, et autres
Publié: (2024)
par: Distelzweig, Aron, et autres
Publié: (2024)
Don't Run with Scissors: Pruning Breaks VLA Models but They Can Be Recovered
par: Jabbour, Jason, et autres
Publié: (2025)
par: Jabbour, Jason, et autres
Publié: (2025)
Dual Agent Learning Based Aerial Trajectory Tracking
par: Garg, Shaswat, et autres
Publié: (2024)
par: Garg, Shaswat, et autres
Publié: (2024)
Spectral Alignment in Forward-Backward Representations via Temporal Abstraction
par: Azad, Seyed Mahdi B., et autres
Publié: (2026)
par: Azad, Seyed Mahdi B., et autres
Publié: (2026)
Traffic and Safety Rule Compliance of Humans in Diverse Driving Situations
par: Kurenkov, Michael, et autres
Publié: (2024)
par: Kurenkov, Michael, et autres
Publié: (2024)
Learn Where Outcomes Diverge: Efficient VLA RL via Probabilistic Chunk Masking
par: Bagaria, Vaidehi, et autres
Publié: (2026)
par: Bagaria, Vaidehi, et autres
Publié: (2026)
ForecastOcc: Vision-based Semantic Occupancy Forecasting
par: Mohan, Riya, et autres
Publié: (2026)
par: Mohan, Riya, et autres
Publié: (2026)
Documents similaires
-
DITTO: Demonstration Imitation by Trajectory Transformation
par: Heppert, Nick, et autres
Publié: (2024) -
Learning Robotic Manipulation Policies from Point Clouds with Conditional Flow Matching
par: Chisari, Eugenio, et autres
Publié: (2024) -
SparTa: Sparse Graphical Task Models from a Handful of Demonstrations
par: Röfer, Adrian, et autres
Publié: (2026) -
Scaling Single Human Demonstrations for Imitation Learning using Generative Foundational Models
par: Heppert, Nick, et autres
Publié: (2026) -
Imagine2touch: Predictive Tactile Sensing for Robotic Manipulation using Efficient Low-Dimensional Signals
par: Ayad, Abdallah, et autres
Publié: (2024)