RemoteCLIP: A Vision Language Foundation Model for Remote Sensing
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Fan, Chen, Delong, Guan, Zhangqingyun, Zhou, Xiaocong, Zhu, Jiale, Ye, Qiaolin, Fu, Liyong, Zhou, Jun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Prompting DirectSAM for Semantic Contour Extraction in Remote Sensing Images
di: Miao, Shiyu, et al.
Pubblicazione: (2024)
di: Miao, Shiyu, et al.
Pubblicazione: (2024)
TimeSenCLIP: A Time Series Vision-Language Model for Remote Sensing
di: Jain, Pallavi, et al.
Pubblicazione: (2025)
di: Jain, Pallavi, et al.
Pubblicazione: (2025)
Redundancy-Aware Pretraining of Vision-Language Foundation Models in Remote Sensing
di: Adler, Mathis Jürgen, et al.
Pubblicazione: (2025)
di: Adler, Mathis Jürgen, et al.
Pubblicazione: (2025)
Few-shot Adaptation of Multi-modal Foundation Models: A Survey
di: Liu, Fan, et al.
Pubblicazione: (2024)
di: Liu, Fan, et al.
Pubblicazione: (2024)
DGTRSD & DGTRS-CLIP: A Dual-Granularity Remote Sensing Image-Text Dataset and Vision Language Foundation Model for Alignment
di: Chen, Weizhi, et al.
Pubblicazione: (2025)
di: Chen, Weizhi, et al.
Pubblicazione: (2025)
Falcon: A Remote Sensing Vision-Language Foundation Model (Technical Report)
di: Yao, Kelu, et al.
Pubblicazione: (2025)
di: Yao, Kelu, et al.
Pubblicazione: (2025)
RemoteTrimmer: Adaptive Structural Pruning for Remote Sensing Image Classification
di: Zou, Guangwenjie, et al.
Pubblicazione: (2024)
di: Zou, Guangwenjie, et al.
Pubblicazione: (2024)
PriorCLIP: Visual Prior Guided Vision-Language Model for Remote Sensing Image-Text Retrieval
di: Pan, Jiancheng, et al.
Pubblicazione: (2024)
di: Pan, Jiancheng, et al.
Pubblicazione: (2024)
Vision Foundation Models in Remote Sensing: A Survey
di: Lu, Siqi, et al.
Pubblicazione: (2024)
di: Lu, Siqi, et al.
Pubblicazione: (2024)
A Survey on Remote Sensing Foundation Models: From Vision to Multimodality
di: Huang, Ziyue, et al.
Pubblicazione: (2025)
di: Huang, Ziyue, et al.
Pubblicazione: (2025)
Co-Training Vision Language Models for Remote Sensing Multi-task Learning
di: Li, Qingyun, et al.
Pubblicazione: (2025)
di: Li, Qingyun, et al.
Pubblicazione: (2025)
GeoAlignCLIP: Enhancing Fine-Grained Vision-Language Alignment in Remote Sensing via Multi-Granular Consistency Learning
di: Yang, Xiao, et al.
Pubblicazione: (2026)
di: Yang, Xiao, et al.
Pubblicazione: (2026)
FLAVARS: A Multimodal Foundational Language and Vision Alignment Model for Remote Sensing
di: Corley, Isaac, et al.
Pubblicazione: (2025)
di: Corley, Isaac, et al.
Pubblicazione: (2025)
FUSAR-KLIP: Towards Multimodal Foundation Models for Remote Sensing
di: Yang, Yi, et al.
Pubblicazione: (2025)
di: Yang, Yi, et al.
Pubblicazione: (2025)
FUSE-RSVLM: Feature Fusion Vision-Language Model for Remote Sensing
di: Dang, Yunkai, et al.
Pubblicazione: (2025)
di: Dang, Yunkai, et al.
Pubblicazione: (2025)
RSDehamba: Lightweight Vision Mamba for Remote Sensing Satellite Image Dehazing
di: Zhou, Huiling, et al.
Pubblicazione: (2024)
di: Zhou, Huiling, et al.
Pubblicazione: (2024)
Adapting Vision Foundation Models for Robust Cloud Segmentation in Remote Sensing Images
di: Zou, Xuechao, et al.
Pubblicazione: (2024)
di: Zou, Xuechao, et al.
Pubblicazione: (2024)
SIGMAE: A Spectral-Index-Guided Foundation Model for Multispectral Remote Sensing
di: Zhang, Xiaokang, et al.
Pubblicazione: (2026)
di: Zhang, Xiaokang, et al.
Pubblicazione: (2026)
CrossEarth: Geospatial Vision Foundation Model for Domain Generalizable Remote Sensing Semantic Segmentation
di: Gong, Ziyang, et al.
Pubblicazione: (2024)
di: Gong, Ziyang, et al.
Pubblicazione: (2024)
Synthetic Instance Segmentation from Semantic Image Segmentation Masks
di: Shen, Yuchen, et al.
Pubblicazione: (2023)
di: Shen, Yuchen, et al.
Pubblicazione: (2023)
Making Large Vision Language Models to be Good Few-shot Learners
di: Liu, Fan, et al.
Pubblicazione: (2024)
di: Liu, Fan, et al.
Pubblicazione: (2024)
Vision-Language Modeling Meets Remote Sensing: Models, Datasets and Perspectives
di: Weng, Xingxing, et al.
Pubblicazione: (2025)
di: Weng, Xingxing, et al.
Pubblicazione: (2025)
Vision-Language Model Purified Semi-Supervised Semantic Segmentation for Remote Sensing Images
di: Wang, Shanwen, et al.
Pubblicazione: (2026)
di: Wang, Shanwen, et al.
Pubblicazione: (2026)
SpectralGPT: Spectral Remote Sensing Foundation Model
di: Hong, Danfeng, et al.
Pubblicazione: (2023)
di: Hong, Danfeng, et al.
Pubblicazione: (2023)
Remote Sensing SpatioTemporal Vision-Language Models: A Comprehensive Survey
di: Liu, Chenyang, et al.
Pubblicazione: (2024)
di: Liu, Chenyang, et al.
Pubblicazione: (2024)
Semantic-CC: Boosting Remote Sensing Image Change Captioning via Foundational Knowledge and Semantic Guidance
di: Zhu, Yongshuo, et al.
Pubblicazione: (2024)
di: Zhu, Yongshuo, et al.
Pubblicazione: (2024)
Vision-Language Models in Remote Sensing: Current Progress and Future Trends
di: Li, Xiang, et al.
Pubblicazione: (2023)
di: Li, Xiang, et al.
Pubblicazione: (2023)
GeoGround: A Unified Large Vision-Language Model for Remote Sensing Visual Grounding
di: Zhou, Yue, et al.
Pubblicazione: (2024)
di: Zhou, Yue, et al.
Pubblicazione: (2024)
A Benchmark for Multi-Lingual Vision-Language Learning in Remote Sensing Image Captioning
di: Zhou, Qing, et al.
Pubblicazione: (2025)
di: Zhou, Qing, et al.
Pubblicazione: (2025)
CHOICE: Benchmarking the Remote Sensing Capabilities of Large Vision-Language Models
di: An, Xiao, et al.
Pubblicazione: (2024)
di: An, Xiao, et al.
Pubblicazione: (2024)
Few-Shot Adaptation Benchmark for Remote Sensing Vision-Language Models
di: Khoury, Karim El, et al.
Pubblicazione: (2025)
di: Khoury, Karim El, et al.
Pubblicazione: (2025)
RS-vHeat: Heat Conduction Guided Efficient Remote Sensing Foundation Model
di: Hu, Huiyang, et al.
Pubblicazione: (2024)
di: Hu, Huiyang, et al.
Pubblicazione: (2024)
CGEarthEye:A High-Resolution Remote Sensing Vision Foundation Model Based on the Jilin-1 Satellite Constellation
di: Yi, Zhiwei, et al.
Pubblicazione: (2025)
di: Yi, Zhiwei, et al.
Pubblicazione: (2025)
VFM-ISRefiner: Towards Better Adapting Vision Foundation Models for Interactive Segmentation of Remote Sensing Images
di: Wang, Deliang, et al.
Pubblicazione: (2025)
di: Wang, Deliang, et al.
Pubblicazione: (2025)
RSRefSeg: Referring Remote Sensing Image Segmentation with Foundation Models
di: Chen, Keyan, et al.
Pubblicazione: (2025)
di: Chen, Keyan, et al.
Pubblicazione: (2025)
Rethinking Scanning Strategies with Vision Mamba in Semantic Segmentation of Remote Sensing Imagery: An Experimental Study
di: Zhu, Qinfeng, et al.
Pubblicazione: (2024)
di: Zhu, Qinfeng, et al.
Pubblicazione: (2024)
MMLGNet: Cross-Modal Alignment of Remote Sensing Data using CLIP
di: Chaudhary, Aditya, et al.
Pubblicazione: (2026)
di: Chaudhary, Aditya, et al.
Pubblicazione: (2026)
Cloud Adversarial Example Generation for Remote Sensing Image Classification
di: Ma, Fei, et al.
Pubblicazione: (2024)
di: Ma, Fei, et al.
Pubblicazione: (2024)
SatelliteCalculator: A Multi-Task Vision Foundation Model for Quantitative Remote Sensing Inversion
di: Yu, Zhenyu, et al.
Pubblicazione: (2025)
di: Yu, Zhenyu, et al.
Pubblicazione: (2025)
Evaluating Remote Sensing Image Captions Beyond Metric Biases
di: Chen, Ziyun, et al.
Pubblicazione: (2026)
di: Chen, Ziyun, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Prompting DirectSAM for Semantic Contour Extraction in Remote Sensing Images
di: Miao, Shiyu, et al.
Pubblicazione: (2024) -
TimeSenCLIP: A Time Series Vision-Language Model for Remote Sensing
di: Jain, Pallavi, et al.
Pubblicazione: (2025) -
Redundancy-Aware Pretraining of Vision-Language Foundation Models in Remote Sensing
di: Adler, Mathis Jürgen, et al.
Pubblicazione: (2025) -
Few-shot Adaptation of Multi-modal Foundation Models: A Survey
di: Liu, Fan, et al.
Pubblicazione: (2024) -
DGTRSD & DGTRS-CLIP: A Dual-Granularity Remote Sensing Image-Text Dataset and Vision Language Foundation Model for Alignment
di: Chen, Weizhi, et al.
Pubblicazione: (2025)