MapVerse: A Benchmark for Geospatial Question Answering on Diverse Real-World Maps
Fuente:
arXiv
Guardado en:
| Autores principales: | Bhat, Sharat, Khandelwal, Harshita, Kataria, Tushar, Gupta, Vivek |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MapIQ: Evaluating Multimodal Large Language Models for Map Question Answering
por: Srivastava, Varun, et al.
Publicado: (2025)
por: Srivastava, Varun, et al.
Publicado: (2025)
FlowVQA: Mapping Multimodal Logic in Visual Question Answering with Flowcharts
por: Singh, Shubhankar, et al.
Publicado: (2024)
por: Singh, Shubhankar, et al.
Publicado: (2024)
NTSEBENCH: Cognitive Reasoning Benchmark for Vision Language Models
por: Pandya, Pranshu, et al.
Publicado: (2024)
por: Pandya, Pranshu, et al.
Publicado: (2024)
Enhancing Scientific Visual Question Answering through Multimodal Reasoning and Ensemble Modeling
por: Movva, Prahitha, et al.
Publicado: (2025)
por: Movva, Prahitha, et al.
Publicado: (2025)
TransientTables: Evaluating LLMs' Reasoning on Temporally Evolving Semi-structured Tables
por: Shankarampeta, Abhilash, et al.
Publicado: (2025)
por: Shankarampeta, Abhilash, et al.
Publicado: (2025)
Cropland Mapping using Geospatial Embeddings
por: Zvonkov, Ivan, et al.
Publicado: (2025)
por: Zvonkov, Ivan, et al.
Publicado: (2025)
MMTABREAL: Real-World Benchmark for Multimodal Table Understanding
por: Titiya, Prasham, et al.
Publicado: (2025)
por: Titiya, Prasham, et al.
Publicado: (2025)
BoundarySeg:An Embarrassingly Simple Method To Boost Medical Image Segmentation Performance for Low Data Regimes
por: Kataria, Tushar, et al.
Publicado: (2025)
por: Kataria, Tushar, et al.
Publicado: (2025)
Geospatial Chain of Thought Reasoning for Enhanced Visual Question Answering on Satellite Imagery
por: Shanker, Shambhavi, et al.
Publicado: (2025)
por: Shanker, Shambhavi, et al.
Publicado: (2025)
DomainVerse: A Benchmark Towards Real-World Distribution Shifts For Tuning-Free Adaptive Domain Generalization
por: Hou, Feng, et al.
Publicado: (2024)
por: Hou, Feng, et al.
Publicado: (2024)
Map-based Modular Approach for Zero-shot Embodied Question Answering
por: Sakamoto, Koya, et al.
Publicado: (2024)
por: Sakamoto, Koya, et al.
Publicado: (2024)
Re:Verse -- Can Your VLM Read a Manga?
por: Baranwal, Aaditya, et al.
Publicado: (2025)
por: Baranwal, Aaditya, et al.
Publicado: (2025)
MapGCLR: Geospatial Contrastive Learning of Representations for Online Vectorized HD Map Construction
por: Merkert, Jonas, et al.
Publicado: (2026)
por: Merkert, Jonas, et al.
Publicado: (2026)
BIMBA: Selective-Scan Compression for Long-Range Video Question Answering
por: Islam, Md Mohaiminul, et al.
Publicado: (2025)
por: Islam, Md Mohaiminul, et al.
Publicado: (2025)
Exploiting Contextual Uncertainty of Visual Data for Efficient Training of Deep Models
por: Agarwal, Sharat
Publicado: (2024)
por: Agarwal, Sharat
Publicado: (2024)
MASSM: An End-to-End Deep Learning Framework for Multi-Anatomy Statistical Shape Modeling Directly From Images
por: Ukey, Janmesh, et al.
Publicado: (2024)
por: Ukey, Janmesh, et al.
Publicado: (2024)
Evaluating Variance in Visual Question Answering Benchmarks
por: SR, Nikitha
Publicado: (2025)
por: SR, Nikitha
Publicado: (2025)
Knowledge-Aware Reasoning over Multimodal Semi-structured Tables
por: Mathur, Suyash Vardhan, et al.
Publicado: (2024)
por: Mathur, Suyash Vardhan, et al.
Publicado: (2024)
Authentic Emotion Mapping: Benchmarking Facial Expressions in Real News
por: Zhang, Qixuan, et al.
Publicado: (2024)
por: Zhang, Qixuan, et al.
Publicado: (2024)
MorphoFlow: Sparse-Supervised Generative Shape Modeling with Adaptive Latent Relevance
por: Karanam, Mokshagna Sai Teja, et al.
Publicado: (2026)
por: Karanam, Mokshagna Sai Teja, et al.
Publicado: (2026)
Visual Robustness Benchmark for Visual Question Answering (VQA)
por: Ishmam, Md Farhan, et al.
Publicado: (2024)
por: Ishmam, Md Farhan, et al.
Publicado: (2024)
Exploring Real World Map Change Generalization of Prior-Informed HD Map Prediction Models
por: Bateman, Samuel M., et al.
Publicado: (2024)
por: Bateman, Samuel M., et al.
Publicado: (2024)
MTVQA: Benchmarking Multilingual Text-Centric Visual Question Answering
por: Tang, Jingqun, et al.
Publicado: (2024)
por: Tang, Jingqun, et al.
Publicado: (2024)
On the Viability of Semi-Supervised Segmentation Methods for Statistical Shape Modeling
por: Khan, Asma, et al.
Publicado: (2024)
por: Khan, Asma, et al.
Publicado: (2024)
Map2World: Segment Map Conditioned Text to 3D World Generation
por: Chung, Jaeyoung, et al.
Publicado: (2026)
por: Chung, Jaeyoung, et al.
Publicado: (2026)
Low-Rank Adaptation of Geospatial Foundation Models for Wildfire Mapping Using Sentinel-2 Data
por: Shibli, Ali, et al.
Publicado: (2026)
por: Shibli, Ali, et al.
Publicado: (2026)
Structure-Semantic Decoupled Modulation of Global Geospatial Embeddings for High-Resolution Remote Sensing Mapping
por: Lyu, Jienan, et al.
Publicado: (2026)
por: Lyu, Jienan, et al.
Publicado: (2026)
Landslide Hazard Mapping with Geospatial Foundation Models: Geographical Generalizability, Data Scarcity, and Band Adaptability
por: Li, Wenwen, et al.
Publicado: (2025)
por: Li, Wenwen, et al.
Publicado: (2025)
DisasterVQA: A Visual Question Answering Benchmark Dataset for Disaster Scenes
por: Al-Mohannadi, Aisha, et al.
Publicado: (2026)
por: Al-Mohannadi, Aisha, et al.
Publicado: (2026)
Beyond the Destination: A Novel Benchmark for Exploration-Aware Embodied Question Answering
por: Jiang, Kaixuan, et al.
Publicado: (2025)
por: Jiang, Kaixuan, et al.
Publicado: (2025)
SynthVerse: A Large-Scale Diverse Synthetic Dataset for Point Tracking
por: Zhao, Weiguang, et al.
Publicado: (2026)
por: Zhao, Weiguang, et al.
Publicado: (2026)
Answering Diverse Questions via Text Attached with Key Audio-Visual Clues
por: Ye, Qilang, et al.
Publicado: (2024)
por: Ye, Qilang, et al.
Publicado: (2024)
Overview of TREC 2024 Medical Video Question Answering (MedVidQA) Track
por: Gupta, Deepak, et al.
Publicado: (2024)
por: Gupta, Deepak, et al.
Publicado: (2024)
MirrorVerse: Pushing Diffusion Models to Realistically Reflect the World
por: Dhiman, Ankit, et al.
Publicado: (2025)
por: Dhiman, Ankit, et al.
Publicado: (2025)
Combining Satellite and Weather Data for Crop Type Mapping: An Inverse Modelling Approach
por: Ravirathinam, Praveen, et al.
Publicado: (2024)
por: Ravirathinam, Praveen, et al.
Publicado: (2024)
MedConcept: Unsupervised Concept Discovery for Interpretability in Medical VLMs
por: Haque, Md Rakibul, et al.
Publicado: (2026)
por: Haque, Md Rakibul, et al.
Publicado: (2026)
MovieRecapsQA: A Multimodal Open-Ended Video Question-Answering Benchmark
por: Shaar, Shaden, et al.
Publicado: (2026)
por: Shaar, Shaden, et al.
Publicado: (2026)
MAVIS: A Benchmark for Multimodal Source Attribution in Long-form Visual Question Answering
por: Song, Seokwon, et al.
Publicado: (2025)
por: Song, Seokwon, et al.
Publicado: (2025)
Space3D-Bench: Spatial 3D Question Answering Benchmark
por: Szymanska, Emilia, et al.
Publicado: (2024)
por: Szymanska, Emilia, et al.
Publicado: (2024)
CG-Bench: Clue-grounded Question Answering Benchmark for Long Video Understanding
por: Chen, Guo, et al.
Publicado: (2024)
por: Chen, Guo, et al.
Publicado: (2024)
Ejemplares similares
-
MapIQ: Evaluating Multimodal Large Language Models for Map Question Answering
por: Srivastava, Varun, et al.
Publicado: (2025) -
FlowVQA: Mapping Multimodal Logic in Visual Question Answering with Flowcharts
por: Singh, Shubhankar, et al.
Publicado: (2024) -
NTSEBENCH: Cognitive Reasoning Benchmark for Vision Language Models
por: Pandya, Pranshu, et al.
Publicado: (2024) -
Enhancing Scientific Visual Question Answering through Multimodal Reasoning and Ensemble Modeling
por: Movva, Prahitha, et al.
Publicado: (2025) -
TransientTables: Evaluating LLMs' Reasoning on Temporally Evolving Semi-structured Tables
por: Shankarampeta, Abhilash, et al.
Publicado: (2025)