DDFAV: Remote Sensing Large Vision Language Models Dataset and Evaluation Benchmark
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Haodong, Qu, Haicheng, Zhang, Xiaofeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DASSF: Dynamic-Attention Scale-Sequence Fusion for Aerial Object Detection
di: Li, Haodong, et al.
Pubblicazione: (2024)
di: Li, Haodong, et al.
Pubblicazione: (2024)
CHOICE: Benchmarking the Remote Sensing Capabilities of Large Vision-Language Models
di: An, Xiao, et al.
Pubblicazione: (2024)
di: An, Xiao, et al.
Pubblicazione: (2024)
VRSBench: A Versatile Vision-Language Benchmark Dataset for Remote Sensing Image Understanding
di: Li, Xiang, et al.
Pubblicazione: (2024)
di: Li, Xiang, et al.
Pubblicazione: (2024)
RSVLM-QA: A Benchmark Dataset for Remote Sensing Vision Language Model-based Question Answering
di: Zi, Xing, et al.
Pubblicazione: (2025)
di: Zi, Xing, et al.
Pubblicazione: (2025)
Vision-Language Modeling Meets Remote Sensing: Models, Datasets and Perspectives
di: Weng, Xingxing, et al.
Pubblicazione: (2025)
di: Weng, Xingxing, et al.
Pubblicazione: (2025)
Few-Shot Adaptation Benchmark for Remote Sensing Vision-Language Models
di: Khoury, Karim El, et al.
Pubblicazione: (2025)
di: Khoury, Karim El, et al.
Pubblicazione: (2025)
Continual Vision-Language Learning for Remote Sensing: Benchmarking and Analysis
di: Weng, Xingxing, et al.
Pubblicazione: (2026)
di: Weng, Xingxing, et al.
Pubblicazione: (2026)
A Large-Scale Referring Remote Sensing Image Segmentation Dataset and Benchmark
di: Yang, Zhigang, et al.
Pubblicazione: (2025)
di: Yang, Zhigang, et al.
Pubblicazione: (2025)
LHRS-Bot-Nova: Improved Multimodal Large Language Model for Remote Sensing Vision-Language Interpretation
di: Li, Zhenshi, et al.
Pubblicazione: (2024)
di: Li, Zhenshi, et al.
Pubblicazione: (2024)
GeoGround: A Unified Large Vision-Language Model for Remote Sensing Visual Grounding
di: Zhou, Yue, et al.
Pubblicazione: (2024)
di: Zhou, Yue, et al.
Pubblicazione: (2024)
Measuring and Mitigating Hallucinations in Vision-Language Dataset Generation for Remote Sensing
di: Anderson, Madeline, et al.
Pubblicazione: (2025)
di: Anderson, Madeline, et al.
Pubblicazione: (2025)
ATRNet-STAR: A Large Dataset and Benchmark Towards Remote Sensing Object Recognition in the Wild
di: Liu, Yongxiang, et al.
Pubblicazione: (2025)
di: Liu, Yongxiang, et al.
Pubblicazione: (2025)
RemoteCLIP: A Vision Language Foundation Model for Remote Sensing
di: Liu, Fan, et al.
Pubblicazione: (2023)
di: Liu, Fan, et al.
Pubblicazione: (2023)
Large Vision-Language Models for Remote Sensing Visual Question Answering
di: Siripong, Surasakdi, et al.
Pubblicazione: (2024)
di: Siripong, Surasakdi, et al.
Pubblicazione: (2024)
Are We on the Right Way for Evaluating Large Vision-Language Models?
di: Chen, Lin, et al.
Pubblicazione: (2024)
di: Chen, Lin, et al.
Pubblicazione: (2024)
SenseBench: A Benchmark for Remote Sensing Low-Level Visual Perception and Description in Large Vision-Language Models
di: Zhong, Chen, et al.
Pubblicazione: (2026)
di: Zhong, Chen, et al.
Pubblicazione: (2026)
VLRS-Bench: A Vision-Language Reasoning Benchmark for Remote Sensing
di: Luo, Zhiming, et al.
Pubblicazione: (2026)
di: Luo, Zhiming, et al.
Pubblicazione: (2026)
RS5M and GeoRSCLIP: A Large Scale Vision-Language Dataset and A Large Vision-Language Model for Remote Sensing
di: Zhang, Zilun, et al.
Pubblicazione: (2023)
di: Zhang, Zilun, et al.
Pubblicazione: (2023)
LMOD: A Large Multimodal Ophthalmology Dataset and Benchmark for Large Vision-Language Models
di: Qin, Zhenyue, et al.
Pubblicazione: (2024)
di: Qin, Zhenyue, et al.
Pubblicazione: (2024)
Enhancing Remote Sensing Vision-Language Models Through MLLM and LLM-Based High-Quality Image-Text Dataset Generation
di: He, Yiguo, et al.
Pubblicazione: (2025)
di: He, Yiguo, et al.
Pubblicazione: (2025)
A Benchmark for Multi-Lingual Vision-Language Learning in Remote Sensing Image Captioning
di: Zhou, Qing, et al.
Pubblicazione: (2025)
di: Zhou, Qing, et al.
Pubblicazione: (2025)
SkySenseGPT: A Fine-Grained Instruction Tuning Dataset and Model for Remote Sensing Vision-Language Understanding
di: Luo, Junwei, et al.
Pubblicazione: (2024)
di: Luo, Junwei, et al.
Pubblicazione: (2024)
Falcon: A Remote Sensing Vision-Language Foundation Model (Technical Report)
di: Yao, Kelu, et al.
Pubblicazione: (2025)
di: Yao, Kelu, et al.
Pubblicazione: (2025)
VHM: Versatile and Honest Vision Language Model for Remote Sensing Image Analysis
di: Pang, Chao, et al.
Pubblicazione: (2024)
di: Pang, Chao, et al.
Pubblicazione: (2024)
Quality-Driven Curation of Remote Sensing Vision-Language Data via Learned Scoring Models
di: Muhtar, Dilxat, et al.
Pubblicazione: (2025)
di: Muhtar, Dilxat, et al.
Pubblicazione: (2025)
Remote Sensing SpatioTemporal Vision-Language Models: A Comprehensive Survey
di: Liu, Chenyang, et al.
Pubblicazione: (2024)
di: Liu, Chenyang, et al.
Pubblicazione: (2024)
Redundancy-Aware Pretraining of Vision-Language Foundation Models in Remote Sensing
di: Adler, Mathis Jürgen, et al.
Pubblicazione: (2025)
di: Adler, Mathis Jürgen, et al.
Pubblicazione: (2025)
Co-Training Vision Language Models for Remote Sensing Multi-task Learning
di: Li, Qingyun, et al.
Pubblicazione: (2025)
di: Li, Qingyun, et al.
Pubblicazione: (2025)
Benchmarking Large Vision-Language Models on CFMME: A Comprehensive Chinese Financial Multimodal Evaluation Dataset
di: Chen, Qian, et al.
Pubblicazione: (2026)
di: Chen, Qian, et al.
Pubblicazione: (2026)
Hyperspectral Remote Sensing Images Salient Object Detection: The First Benchmark Dataset and Baseline
di: Liu, Peifu, et al.
Pubblicazione: (2025)
di: Liu, Peifu, et al.
Pubblicazione: (2025)
Large Language Models for Captioning and Retrieving Remote Sensing Images
di: Silva, João Daniel, et al.
Pubblicazione: (2024)
di: Silva, João Daniel, et al.
Pubblicazione: (2024)
SkyEyeGPT: Unifying Remote Sensing Vision-Language Tasks via Instruction Tuning with Large Language Model
di: Zhan, Yang, et al.
Pubblicazione: (2024)
di: Zhan, Yang, et al.
Pubblicazione: (2024)
Transferring Physical Priors into Remote Sensing Segmentation via Large Language Models
di: Lu, Yuxi, et al.
Pubblicazione: (2026)
di: Lu, Yuxi, et al.
Pubblicazione: (2026)
EarthMarker: A Visual Prompting Multi-modal Large Language Model for Remote Sensing
di: Zhang, Wei, et al.
Pubblicazione: (2024)
di: Zhang, Wei, et al.
Pubblicazione: (2024)
Pansharpening for Thin-Cloud Contaminated Remote Sensing Images: A Unified Framework and Benchmark Dataset
di: Du, Songcheng, et al.
Pubblicazione: (2026)
di: Du, Songcheng, et al.
Pubblicazione: (2026)
HM-Bench: A Comprehensive Benchmark for Multimodal Large Language Models in Hyperspectral Remote Sensing
di: Zhang, Xinyu, et al.
Pubblicazione: (2026)
di: Zhang, Xinyu, et al.
Pubblicazione: (2026)
ReCon1M:A Large-scale Benchmark Dataset for Relation Comprehension in Remote Sensing Imagery
di: Sun, Xian, et al.
Pubblicazione: (2024)
di: Sun, Xian, et al.
Pubblicazione: (2024)
UniRS: Unifying Multi-temporal Remote Sensing Tasks through Vision Language Models
di: Li, Yujie, et al.
Pubblicazione: (2024)
di: Li, Yujie, et al.
Pubblicazione: (2024)
GeoRSMLLM: A Multimodal Large Language Model for Vision-Language Tasks in Geoscience and Remote Sensing
di: Zhang, Zilun, et al.
Pubblicazione: (2025)
di: Zhang, Zilun, et al.
Pubblicazione: (2025)
Remote Sensing Large Vision-Language Model: Semantic-augmented Multi-level Alignment and Semantic-aware Expert Modeling
di: Park, Sungjune, et al.
Pubblicazione: (2025)
di: Park, Sungjune, et al.
Pubblicazione: (2025)
Documenti analoghi
-
DASSF: Dynamic-Attention Scale-Sequence Fusion for Aerial Object Detection
di: Li, Haodong, et al.
Pubblicazione: (2024) -
CHOICE: Benchmarking the Remote Sensing Capabilities of Large Vision-Language Models
di: An, Xiao, et al.
Pubblicazione: (2024) -
VRSBench: A Versatile Vision-Language Benchmark Dataset for Remote Sensing Image Understanding
di: Li, Xiang, et al.
Pubblicazione: (2024) -
RSVLM-QA: A Benchmark Dataset for Remote Sensing Vision Language Model-based Question Answering
di: Zi, Xing, et al.
Pubblicazione: (2025) -
Vision-Language Modeling Meets Remote Sensing: Models, Datasets and Perspectives
di: Weng, Xingxing, et al.
Pubblicazione: (2025)