Foundation Models for Remote Sensing and Earth Observation: A Survey
Fuente:
arXiv
Salvato in:
| Autori principali: | Xiao, Aoran, Xuan, Weihao, Wang, Junjue, Huang, Jiaxing, Tao, Dacheng, Lu, Shijian, Yokoya, Naoto |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Direction-aware 3D Large Multimodal Models
di: Liu, Quan, et al.
Pubblicazione: (2026)
di: Liu, Quan, et al.
Pubblicazione: (2026)
Geo3DVQA: Evaluating Vision-Language Models for 3D Geospatial Reasoning from Aerial Imagery
di: Tsujimoto, Mai, et al.
Pubblicazione: (2025)
di: Tsujimoto, Mai, et al.
Pubblicazione: (2025)
Segment Anything with Multiple Modalities
di: Xiao, Aoran, et al.
Pubblicazione: (2024)
di: Xiao, Aoran, et al.
Pubblicazione: (2024)
Seeing is Believing, but How Much? A Comprehensive Analysis of Verbalized Calibration in Vision-Language Models
di: Xuan, Weihao, et al.
Pubblicazione: (2025)
di: Xuan, Weihao, et al.
Pubblicazione: (2025)
MM-OVSeg:Multimodal Optical-SAR Fusion for Open-Vocabulary Segmentation in Remote Sensing
di: Wei, Yimin, et al.
Pubblicazione: (2026)
di: Wei, Yimin, et al.
Pubblicazione: (2026)
GeoMMBench and GeoMMAgent: Toward Expert-Level Multimodal Intelligence in Geoscience and Remote Sensing
di: Xiao, Aoran, et al.
Pubblicazione: (2026)
di: Xiao, Aoran, et al.
Pubblicazione: (2026)
SynRS3D: A Synthetic Dataset for Global 3D Semantic Understanding from Monocular Remote Sensing Imagery
di: Song, Jian, et al.
Pubblicazione: (2024)
di: Song, Jian, et al.
Pubblicazione: (2024)
OpenEarth-Agent: From Tool Calling to Tool Creation for Open-Environment Earth Observation
di: Zhao, Sijie, et al.
Pubblicazione: (2026)
di: Zhao, Sijie, et al.
Pubblicazione: (2026)
Experience-Driven Multi-Agent Systems Are Training-free Context-aware Earth Observers
di: Dai, Pengyu, et al.
Pubblicazione: (2026)
di: Dai, Pengyu, et al.
Pubblicazione: (2026)
DynamicVL: Benchmarking Multimodal Large Language Models for Dynamic City Understanding
di: Xuan, Weihao, et al.
Pubblicazione: (2025)
di: Xuan, Weihao, et al.
Pubblicazione: (2025)
DisasterM3: A Remote Sensing Vision-Language Dataset for Disaster Damage Assessment and Response
di: Wang, Junjue, et al.
Pubblicazione: (2025)
di: Wang, Junjue, et al.
Pubblicazione: (2025)
A Vision Centric Remote Sensing Benchmark
di: Adejumo, Abduljaleel, et al.
Pubblicazione: (2025)
di: Adejumo, Abduljaleel, et al.
Pubblicazione: (2025)
CrossEarth: Geospatial Vision Foundation Model for Domain Generalizable Remote Sensing Semantic Segmentation
di: Gong, Ziyang, et al.
Pubblicazione: (2024)
di: Gong, Ziyang, et al.
Pubblicazione: (2024)
A Survey of Label-Efficient Deep Learning for 3D Point Clouds
di: Xiao, Aoran, et al.
Pubblicazione: (2023)
di: Xiao, Aoran, et al.
Pubblicazione: (2023)
CAT-SAM: Conditional Tuning for Few-Shot Adaptation of Segment Anything Model
di: Xiao, Aoran, et al.
Pubblicazione: (2024)
di: Xiao, Aoran, et al.
Pubblicazione: (2024)
SpectralGPT: Spectral Remote Sensing Foundation Model
di: Hong, Danfeng, et al.
Pubblicazione: (2023)
di: Hong, Danfeng, et al.
Pubblicazione: (2023)
Vision-Language Models for Vision Tasks: A Survey
di: Zhang, Jingyi, et al.
Pubblicazione: (2023)
di: Zhang, Jingyi, et al.
Pubblicazione: (2023)
SARLANG-1M: A Benchmark for Vision-Language Modeling in SAR Image Understanding
di: Wei, Yimin, et al.
Pubblicazione: (2025)
di: Wei, Yimin, et al.
Pubblicazione: (2025)
SkySense: A Multi-Modal Remote Sensing Foundation Model Towards Universal Interpretation for Earth Observation Imagery
di: Guo, Xin, et al.
Pubblicazione: (2023)
di: Guo, Xin, et al.
Pubblicazione: (2023)
Generalized Few-Shot Semantic Segmentation in Remote Sensing: Challenge and Benchmark
di: Broni-Bediako, Clifford, et al.
Pubblicazione: (2024)
di: Broni-Bediako, Clifford, et al.
Pubblicazione: (2024)
Change Detection Between Optical Remote Sensing Imagery and Map Data via Segment Anything Model (SAM)
di: Chen, Hongruixuan, et al.
Pubblicazione: (2024)
di: Chen, Hongruixuan, et al.
Pubblicazione: (2024)
DynamicVis: Dynamic Visual Perception for Efficient Remote Sensing Foundation Models
di: Chen, Keyan, et al.
Pubblicazione: (2025)
di: Chen, Keyan, et al.
Pubblicazione: (2025)
REOBench: Benchmarking Robustness of Earth Observation Foundation Models
di: Li, Xiang, et al.
Pubblicazione: (2025)
di: Li, Xiang, et al.
Pubblicazione: (2025)
A Survey of Sample-Efficient Deep Learning for Change Detection in Remote Sensing: Tasks, Strategies, and Challenges
di: Ding, Lei, et al.
Pubblicazione: (2025)
di: Ding, Lei, et al.
Pubblicazione: (2025)
Vision Foundation Models in Remote Sensing: A Survey
di: Lu, Siqi, et al.
Pubblicazione: (2024)
di: Lu, Siqi, et al.
Pubblicazione: (2024)
MTP: Advancing Remote Sensing Foundation Model via Multi-Task Pretraining
di: Wang, Di, et al.
Pubblicazione: (2024)
di: Wang, Di, et al.
Pubblicazione: (2024)
PacGDC: Label-Efficient Generalizable Depth Completion with Projection Ambiguity and Consistency
di: Wang, Haotian, et al.
Pubblicazione: (2025)
di: Wang, Haotian, et al.
Pubblicazione: (2025)
ChangeMamba: Remote Sensing Change Detection With Spatiotemporal State Space Model
di: Chen, Hongruixuan, et al.
Pubblicazione: (2024)
di: Chen, Hongruixuan, et al.
Pubblicazione: (2024)
A Survey on Remote Sensing Foundation Models: From Vision to Multimodality
di: Huang, Ziyue, et al.
Pubblicazione: (2025)
di: Huang, Ziyue, et al.
Pubblicazione: (2025)
CHOICE: Benchmarking the Remote Sensing Capabilities of Large Vision-Language Models
di: An, Xiao, et al.
Pubblicazione: (2024)
di: An, Xiao, et al.
Pubblicazione: (2024)
Historical Test-time Prompt Tuning for Vision Foundation Models
di: Zhang, Jingyi, et al.
Pubblicazione: (2024)
di: Zhang, Jingyi, et al.
Pubblicazione: (2024)
Robust Self-Supervised Cross-Modal Super-Resolution against Real-World Misaligned Observations
di: Dong, Xiaoyu, et al.
Pubblicazione: (2026)
di: Dong, Xiaoyu, et al.
Pubblicazione: (2026)
DescribeEarth: Describe Anything for Remote Sensing Images
di: Li, Kaiyu, et al.
Pubblicazione: (2025)
di: Li, Kaiyu, et al.
Pubblicazione: (2025)
R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization
di: Zhang, Jingyi, et al.
Pubblicazione: (2025)
di: Zhang, Jingyi, et al.
Pubblicazione: (2025)
MetaEarth: A Generative Foundation Model for Global-Scale Remote Sensing Image Generation
di: Yu, Zhiping, et al.
Pubblicazione: (2024)
di: Yu, Zhiping, et al.
Pubblicazione: (2024)
Deep Multimodal Fusion for Semantic Segmentation of Remote Sensing Earth Observation Data
di: Dimitrovski, Ivica, et al.
Pubblicazione: (2024)
di: Dimitrovski, Ivica, et al.
Pubblicazione: (2024)
Rewrite Caption Semantics: Bridging Semantic Gaps for Language-Supervised Semantic Segmentation
di: Xing, Yun, et al.
Pubblicazione: (2023)
di: Xing, Yun, et al.
Pubblicazione: (2023)
EarthGPT-X: A Spatial MLLM for Multi-level Multi-Source Remote Sensing Imagery Understanding with Visual Prompting
di: Zhang, Wei, et al.
Pubblicazione: (2025)
di: Zhang, Wei, et al.
Pubblicazione: (2025)
Neural Plasticity-Inspired Multimodal Foundation Model for Earth Observation
di: Xiong, Zhitong, et al.
Pubblicazione: (2024)
di: Xiong, Zhitong, et al.
Pubblicazione: (2024)
LLMs Meet VLMs: Boost Open Vocabulary Object Detection with Fine-grained Descriptors
di: Jin, Sheng, et al.
Pubblicazione: (2024)
di: Jin, Sheng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Direction-aware 3D Large Multimodal Models
di: Liu, Quan, et al.
Pubblicazione: (2026) -
Geo3DVQA: Evaluating Vision-Language Models for 3D Geospatial Reasoning from Aerial Imagery
di: Tsujimoto, Mai, et al.
Pubblicazione: (2025) -
Segment Anything with Multiple Modalities
di: Xiao, Aoran, et al.
Pubblicazione: (2024) -
Seeing is Believing, but How Much? A Comprehensive Analysis of Verbalized Calibration in Vision-Language Models
di: Xuan, Weihao, et al.
Pubblicazione: (2025) -
MM-OVSeg:Multimodal Optical-SAR Fusion for Open-Vocabulary Segmentation in Remote Sensing
di: Wei, Yimin, et al.
Pubblicazione: (2026)