GeoVLM: Improving Automated Vehicle Geolocalisation Using Vision-Language Matching
Fuente:
arXiv
Salvato in:
| Autori principali: | Dagda, Barkin, Awais, Muhammad, Fallah, Saber |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Behavioral Cloning Models Reality Check for Autonomous Driving
di: Yildirim, Mustafa, et al.
Pubblicazione: (2024)
di: Yildirim, Mustafa, et al.
Pubblicazione: (2024)
HighwayLLM: Decision-Making and Navigation in Highway Driving with RL-Informed Language Model
di: Yildirim, Mustafa, et al.
Pubblicazione: (2024)
di: Yildirim, Mustafa, et al.
Pubblicazione: (2024)
GeoVLM-R1: Reinforcement Fine-Tuning for Improved Remote Sensing Reasoning
di: Fiaz, Mustansar, et al.
Pubblicazione: (2025)
di: Fiaz, Mustansar, et al.
Pubblicazione: (2025)
WorldVLM: Combining World Model Forecasting and Vision-Language Reasoning
di: Englmeier, Stefan, et al.
Pubblicazione: (2026)
di: Englmeier, Stefan, et al.
Pubblicazione: (2026)
TagaVLM: Topology-Aware Global Action Reasoning for Vision-Language Navigation
di: Liu, Jiaxing, et al.
Pubblicazione: (2026)
di: Liu, Jiaxing, et al.
Pubblicazione: (2026)
Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey
di: Shao, Rui, et al.
Pubblicazione: (2025)
di: Shao, Rui, et al.
Pubblicazione: (2025)
NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation
di: Zhang, Jiazhao, et al.
Pubblicazione: (2024)
di: Zhang, Jiazhao, et al.
Pubblicazione: (2024)
Improving 3D Labeling in Self-Driving by Inferring Vehicle Information using Vision Language Models
di: Chen, Steven, et al.
Pubblicazione: (2026)
di: Chen, Steven, et al.
Pubblicazione: (2026)
Dynam3D: Dynamic Layered 3D Tokens Empower VLM for Vision-and-Language Navigation
di: Wang, Zihan, et al.
Pubblicazione: (2025)
di: Wang, Zihan, et al.
Pubblicazione: (2025)
Automated Data Curation Using GPS & NLP to Generate Instruction-Action Pairs for Autonomous Vehicle Vision-Language Navigation Datasets
di: Roque, Guillermo, et al.
Pubblicazione: (2025)
di: Roque, Guillermo, et al.
Pubblicazione: (2025)
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond
di: Halacheva, Anna-Maria, et al.
Pubblicazione: (2025)
di: Halacheva, Anna-Maria, et al.
Pubblicazione: (2025)
VLM-Guided Visual Place Recognition for Planet-Scale Geo-Localization
di: Waheed, Sania, et al.
Pubblicazione: (2025)
di: Waheed, Sania, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning using Human-Aligned Reward Labeling for Autonomous Emergency Braking in Occluded Pedestrian Crossing
di: Asodia, Vinal, et al.
Pubblicazione: (2025)
di: Asodia, Vinal, et al.
Pubblicazione: (2025)
VLM-GLoc: Vision-Language Model Enhanced Monte Carlo Localization for Robust Semantic Global Localization in Cluttered Quasi-Static Environments
di: Agrawal, Shivendra, et al.
Pubblicazione: (2026)
di: Agrawal, Shivendra, et al.
Pubblicazione: (2026)
Efficient Perception, Planning, and Control Algorithm for Vision-Based Automated Vehicles
di: Lee, Der-Hau
Pubblicazione: (2022)
di: Lee, Der-Hau
Pubblicazione: (2022)
Low-Cost Infrared Vision Systems for Improved Safety of Emergency Vehicle Operations Under Low-Visibility Conditions
di: Naddaf-Sh, M-Mahdi, et al.
Pubblicazione: (2025)
di: Naddaf-Sh, M-Mahdi, et al.
Pubblicazione: (2025)
Improving Explainable Object-induced Model through Uncertainty for Automated Vehicles
di: Ling, Shihong, et al.
Pubblicazione: (2024)
di: Ling, Shihong, et al.
Pubblicazione: (2024)
Manipulate-Anything: Automating Real-World Robots using Vision-Language Models
di: Duan, Jiafei, et al.
Pubblicazione: (2024)
di: Duan, Jiafei, et al.
Pubblicazione: (2024)
From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving
di: Ang, Sining, et al.
Pubblicazione: (2026)
di: Ang, Sining, et al.
Pubblicazione: (2026)
VLM-Grounder: A VLM Agent for Zero-Shot 3D Visual Grounding
di: Xu, Runsen, et al.
Pubblicazione: (2024)
di: Xu, Runsen, et al.
Pubblicazione: (2024)
SpatialVLM: Endowing Vision-Language Models with Spatial Reasoning Capabilities
di: Chen, Boyuan, et al.
Pubblicazione: (2024)
di: Chen, Boyuan, et al.
Pubblicazione: (2024)
PhysVLM: Enabling Visual Language Models to Understand Robotic Physical Reachability
di: Zhou, Weijie, et al.
Pubblicazione: (2025)
di: Zhou, Weijie, et al.
Pubblicazione: (2025)
StreamingVLA: Streaming Vision-Language-Action Model with Action Flow Matching and Adaptive Early Observation
di: Shi, Yiran, et al.
Pubblicazione: (2026)
di: Shi, Yiran, et al.
Pubblicazione: (2026)
NaturalVLM: Leveraging Fine-grained Natural Language for Affordance-Guided Visual Manipulation
di: Xu, Ran, et al.
Pubblicazione: (2024)
di: Xu, Ran, et al.
Pubblicazione: (2024)
Improving Robustness of Vision-Language-Action Models by Restoring Corrupted Visual Inputs
di: Orjuela, Daniel Yezid Guarnizo, et al.
Pubblicazione: (2026)
di: Orjuela, Daniel Yezid Guarnizo, et al.
Pubblicazione: (2026)
CLIP-Clique: Graph-based Correspondence Matching Augmented by Vision Language Models for Object-based Global Localization
di: Matsuzaki, Shigemichi, et al.
Pubblicazione: (2024)
di: Matsuzaki, Shigemichi, et al.
Pubblicazione: (2024)
VLM-RL: A Unified Vision Language Models and Reinforcement Learning Framework for Safe Autonomous Driving
di: Huang, Zilin, et al.
Pubblicazione: (2024)
di: Huang, Zilin, et al.
Pubblicazione: (2024)
Closed-Loop Hybrid Digital Twin Platform for Connected and Automated Vehicle Validation
di: Quan, Kanglong, et al.
Pubblicazione: (2026)
di: Quan, Kanglong, et al.
Pubblicazione: (2026)
Evaluating Low-Resource Lane Following Algorithms for Compute-Constrained Automated Vehicles
di: Froemming-Aldanondo, Beñat, et al.
Pubblicazione: (2024)
di: Froemming-Aldanondo, Beñat, et al.
Pubblicazione: (2024)
Self-Improving Vision-Language-Action Models with Data Generation via Residual RL
di: Xiao, Wenli, et al.
Pubblicazione: (2025)
di: Xiao, Wenli, et al.
Pubblicazione: (2025)
Image-based Geo-localization for Robotics: Are Black-box Vision-Language Models there yet?
di: Waheed, Sania, et al.
Pubblicazione: (2025)
di: Waheed, Sania, et al.
Pubblicazione: (2025)
DriveVLM-RL: Neuroscience-Inspired Reinforcement Learning with Vision-Language Models for Safe and Deployable Autonomous Driving
di: Huang, Zilin, et al.
Pubblicazione: (2026)
di: Huang, Zilin, et al.
Pubblicazione: (2026)
AutoVDC: Automated Vision Data Cleaning Using Vision-Language Models
di: Vasa, Santosh, et al.
Pubblicazione: (2025)
di: Vasa, Santosh, et al.
Pubblicazione: (2025)
CurricuVLM: Towards Safe Autonomous Driving via Personalized Safety-Critical Curriculum Learning with Vision-Language Models
di: Sheng, Zihao, et al.
Pubblicazione: (2025)
di: Sheng, Zihao, et al.
Pubblicazione: (2025)
V2V-LLM: Vehicle-to-Vehicle Cooperative Autonomous Driving with Multimodal Large Language Models
di: Chiu, Hsu-kuang, et al.
Pubblicazione: (2025)
di: Chiu, Hsu-kuang, et al.
Pubblicazione: (2025)
Keypoint Semantic Integration for Improved Feature Matching in Outdoor Agricultural Environments
di: de Silva, Rajitha, et al.
Pubblicazione: (2025)
di: de Silva, Rajitha, et al.
Pubblicazione: (2025)
Mechanical Automation with Vision: A Design for Rubik's Cube Solver
di: Chalise, Abhinav, et al.
Pubblicazione: (2025)
di: Chalise, Abhinav, et al.
Pubblicazione: (2025)
VQ-VLA: Improving Vision-Language-Action Models via Scaling Vector-Quantized Action Tokenizers
di: Wang, Yating, et al.
Pubblicazione: (2025)
di: Wang, Yating, et al.
Pubblicazione: (2025)
Robust Flower Cluster Matching Using The Unscented Transform
di: Chu, Andy, et al.
Pubblicazione: (2025)
di: Chu, Andy, et al.
Pubblicazione: (2025)
Velocity Driven Vision: Asynchronous Sensor Fusion Birds Eye View Models for Autonomous Vehicles
di: Hayes, Seamie, et al.
Pubblicazione: (2024)
di: Hayes, Seamie, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Behavioral Cloning Models Reality Check for Autonomous Driving
di: Yildirim, Mustafa, et al.
Pubblicazione: (2024) -
HighwayLLM: Decision-Making and Navigation in Highway Driving with RL-Informed Language Model
di: Yildirim, Mustafa, et al.
Pubblicazione: (2024) -
GeoVLM-R1: Reinforcement Fine-Tuning for Improved Remote Sensing Reasoning
di: Fiaz, Mustansar, et al.
Pubblicazione: (2025) -
WorldVLM: Combining World Model Forecasting and Vision-Language Reasoning
di: Englmeier, Stefan, et al.
Pubblicazione: (2026) -
TagaVLM: Topology-Aware Global Action Reasoning for Vision-Language Navigation
di: Liu, Jiaxing, et al.
Pubblicazione: (2026)