AntiGrounding: Lifting Robotic Actions into VLM Representation Space for Decision Making
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Wenbo, Wang, Shiyi, Chen, Yiteng, Zhuang, Huiping, Wu, Qingyao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
T-Rex: Task-Adaptive Spatial Representation Extraction for Robotic Manipulation with Vision-Language Models
par: Chen, Yiteng, et autres
Publié: (2025)
par: Chen, Yiteng, et autres
Publié: (2025)
CLIP-Joint-Detect: End-to-End Joint Training of Object Detectors with Contrastive Vision-Language Supervision
par: Raoufi, Behnam, et autres
Publié: (2025)
par: Raoufi, Behnam, et autres
Publié: (2025)
CARScenes: Semantic VLM Dataset for Safe Autonomous Driving
par: He, Yuankai, et autres
Publié: (2025)
par: He, Yuankai, et autres
Publié: (2025)
Unveiling the Potential of iMarkers: Invisible Fiducial Markers for Advanced Robotics
par: Tourani, Ali, et autres
Publié: (2025)
par: Tourani, Ali, et autres
Publié: (2025)
Temporally Consistent Object 6D Pose Estimation for Robot Control
par: Zorina, Kateryna, et autres
Publié: (2026)
par: Zorina, Kateryna, et autres
Publié: (2026)
Large Language Models and 3D Vision for Intelligent Robotic Perception and Autonomy
par: Mehta, Vinit, et autres
Publié: (2025)
par: Mehta, Vinit, et autres
Publié: (2025)
StemVLA:An Open-Source Vision-Language-Action Model with Future 3D Spatial Geometry Knowledge and 4D Historical Representation
par: Xiao, Jiasong, et autres
Publié: (2026)
par: Xiao, Jiasong, et autres
Publié: (2026)
Single-Shot Metric Depth from Focused Plenoptic Cameras
par: Lasheras-Hernandez, Blanca, et autres
Publié: (2024)
par: Lasheras-Hernandez, Blanca, et autres
Publié: (2024)
Evaluating the Impact of Synthetic Data on Object Detection Tasks in Autonomous Driving
par: Özeren, Enes, et autres
Publié: (2025)
par: Özeren, Enes, et autres
Publié: (2025)
SuperPoint-SLAM3: Augmenting ORB-SLAM3 with Deep Features, Adaptive NMS, and Learning-Based Loop Closure
par: Syed, Shahram Najam, et autres
Publié: (2025)
par: Syed, Shahram Najam, et autres
Publié: (2025)
Autonomous Underwater Cognitive System for Adaptive Navigation: A SLAM-Integrated Cognitive Architecture
par: Jayarathne, K. A. I. N, et autres
Publié: (2025)
par: Jayarathne, K. A. I. N, et autres
Publié: (2025)
vS-Graphs: Tightly Coupling Visual SLAM and 3D Scene Graphs Exploiting Hierarchical Scene Understanding
par: Tourani, Ali, et autres
Publié: (2025)
par: Tourani, Ali, et autres
Publié: (2025)
Is Single-View Mesh Reconstruction Ready for Robotics?
par: Nolte, Frederik, et autres
Publié: (2025)
par: Nolte, Frederik, et autres
Publié: (2025)
Systematic Comparison of Projection Methods for Monocular 3D Human Pose Estimation on Fisheye Images
par: Käs, Stephanie, et autres
Publié: (2025)
par: Käs, Stephanie, et autres
Publié: (2025)
CODEI: Resource-Efficient Task-Driven Co-Design of Perception and Decision Making for Mobile Robots Applied to Autonomous Vehicles
par: Milojevic, Dejan, et autres
Publié: (2025)
par: Milojevic, Dejan, et autres
Publié: (2025)
Introspection in Learned Semantic Scene Graph Localisation
par: Bissessur, Manshika Charvi, et autres
Publié: (2025)
par: Bissessur, Manshika Charvi, et autres
Publié: (2025)
Deep Probabilistic Traversability with Test-time Adaptation for Uncertainty-aware Planetary Rover Navigation
par: Endo, Masafumi, et autres
Publié: (2024)
par: Endo, Masafumi, et autres
Publié: (2024)
Botany Meets Robotics in Alpine Scree Monitoring
par: De Benedittis, Davide, et autres
Publié: (2025)
par: De Benedittis, Davide, et autres
Publié: (2025)
Distributed Intelligent System Architecture for UAV-Assisted Monitoring of Wind Energy Infrastructure
par: Svystun, Serhii, et autres
Publié: (2024)
par: Svystun, Serhii, et autres
Publié: (2024)
FACT: Multinomial Misalignment Classification for Point Cloud Registration
par: Dillén, Ludvig, et autres
Publié: (2025)
par: Dillén, Ludvig, et autres
Publié: (2025)
Key-Scan-Based Mobile Robot Navigation: Integrated Mapping, Planning, and Control using Graphs of Scan Regions
par: Latha, Dharshan Bashkaran, et autres
Publié: (2024)
par: Latha, Dharshan Bashkaran, et autres
Publié: (2024)
EmbodiedLGR: Integrating Lightweight Graph Representation and Retrieval for Semantic-Spatial Memory in Robotic Agents
par: Riva, Paolo, et autres
Publié: (2026)
par: Riva, Paolo, et autres
Publié: (2026)
Have We Mastered Scale in Deep Monocular Visual SLAM? The ScaleMaster Dataset and Benchmark
par: Ju, Hyoseok, et autres
Publié: (2026)
par: Ju, Hyoseok, et autres
Publié: (2026)
From Photons to Physics: Autonomous Indoor Drones and the Future of Objective Property Assessment
par: Teikari, Petteri, et autres
Publié: (2025)
par: Teikari, Petteri, et autres
Publié: (2025)
MSPCaps: A Multi-Scale Patchify Capsule Network with Cross-Agreement Routing for Visual Recognition
par: Hu, Yudong, et autres
Publié: (2025)
par: Hu, Yudong, et autres
Publié: (2025)
Thermal and RGB Images Work Better Together in Wind Turbine Damage Detection
par: Svystun, Serhii, et autres
Publié: (2024)
par: Svystun, Serhii, et autres
Publié: (2024)
OpenMap: Instruction Grounding via Open-Vocabulary Visual-Language Mapping
par: Li, Danyang, et autres
Publié: (2025)
par: Li, Danyang, et autres
Publié: (2025)
From Demonstrations to Safe Deployment: Path-Consistent Safety Filtering for Diffusion Policies
par: Römer, Ralf, et autres
Publié: (2025)
par: Römer, Ralf, et autres
Publié: (2025)
Failure Prediction at Runtime for Generative Robot Policies
par: Römer, Ralf, et autres
Publié: (2025)
par: Römer, Ralf, et autres
Publié: (2025)
Learning from Watching: Scalable Extraction of Manipulation Trajectories from Human Videos
par: Hu, X., et autres
Publié: (2025)
par: Hu, X., et autres
Publié: (2025)
How do Foundation Models Compare to Skeleton-Based Approaches for Gesture Recognition in Human-Robot Interaction?
par: Käs, Stephanie, et autres
Publié: (2025)
par: Käs, Stephanie, et autres
Publié: (2025)
CoMoCAVs: Cohesive Decision-Guided Motion Planning for Connected and Autonomous Vehicles with Multi-Policy Reinforcement Learning
par: Hu, Pan
Publié: (2025)
par: Hu, Pan
Publié: (2025)
FCBV-Net: Category-Level Robotic Garment Smoothing via Feature-Conditioned Bimanual Value Prediction
par: Daba, Mohammed, et autres
Publié: (2025)
par: Daba, Mohammed, et autres
Publié: (2025)
Flex: End-to-End Text-Instructed Visual Navigation from Foundation Model Features
par: Chahine, Makram, et autres
Publié: (2024)
par: Chahine, Makram, et autres
Publié: (2024)
Safe Road-Crossing by Autonomous Wheelchairs: a Novel Dataset and its Experimental Evaluation
par: Grigioni, Carlo, et autres
Publié: (2024)
par: Grigioni, Carlo, et autres
Publié: (2024)
Experimental Evaluation of Road-Crossing Decisions by Autonomous Wheelchairs against Environmental Factors
par: Corradini, Franca, et autres
Publié: (2024)
par: Corradini, Franca, et autres
Publié: (2024)
Human-Robot Dialogue Annotation for Multi-Modal Common Ground
par: Bonial, Claire, et autres
Publié: (2024)
par: Bonial, Claire, et autres
Publié: (2024)
FrankenBot: Brain-Morphic Modular Orchestration for Robotic Manipulation with Vision-Language Models
par: Wang, Shiyi, et autres
Publié: (2025)
par: Wang, Shiyi, et autres
Publié: (2025)
Closed-Loop Neural Activation Control in Vision-Language-Action Models
par: Babu, Abhijith, et autres
Publié: (2026)
par: Babu, Abhijith, et autres
Publié: (2026)
Motion Perceiver: Real-Time Occupancy Forecasting for Embedded Systems
par: Ferenczi, Bryce, et autres
Publié: (2023)
par: Ferenczi, Bryce, et autres
Publié: (2023)
Documents similaires
-
T-Rex: Task-Adaptive Spatial Representation Extraction for Robotic Manipulation with Vision-Language Models
par: Chen, Yiteng, et autres
Publié: (2025) -
CLIP-Joint-Detect: End-to-End Joint Training of Object Detectors with Contrastive Vision-Language Supervision
par: Raoufi, Behnam, et autres
Publié: (2025) -
CARScenes: Semantic VLM Dataset for Safe Autonomous Driving
par: He, Yuankai, et autres
Publié: (2025) -
Unveiling the Potential of iMarkers: Invisible Fiducial Markers for Advanced Robotics
par: Tourani, Ali, et autres
Publié: (2025) -
Temporally Consistent Object 6D Pose Estimation for Robot Control
par: Zorina, Kateryna, et autres
Publié: (2026)