Pushing the Limits of Vision-Language Models in Remote Sensing without Human Annotations
Fuente:
arXiv
Guardado en:
| Autores principales: | Cha, Keumgang, Yu, Donggeun, Seo, Junghoon |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Billion-scale Foundation Model for Remote Sensing Images
por: Cha, Keumgang, et al.
Publicado: (2023)
por: Cha, Keumgang, et al.
Publicado: (2023)
On Pitfalls of $\textit{RemOve-And-Retrain}$: Data Processing Inequality Perspective
por: Song, Junhwa, et al.
Publicado: (2023)
por: Song, Junhwa, et al.
Publicado: (2023)
Measuring and Mitigating Hallucinations in Vision-Language Dataset Generation for Remote Sensing
por: Anderson, Madeline, et al.
Publicado: (2025)
por: Anderson, Madeline, et al.
Publicado: (2025)
Masked Autoregressive Model for Weather Forecasting
por: Kim, Doyi, et al.
Publicado: (2024)
por: Kim, Doyi, et al.
Publicado: (2024)
RemoteCLIP: A Vision Language Foundation Model for Remote Sensing
por: Liu, Fan, et al.
Publicado: (2023)
por: Liu, Fan, et al.
Publicado: (2023)
Retaining and Enhancing Pre-trained Knowledge in Vision-Language Models with Prompt Ensembling
por: Kim, Donggeun, et al.
Publicado: (2024)
por: Kim, Donggeun, et al.
Publicado: (2024)
Debiased Prompt Tuning in Vision-Language Model without Annotations
por: Jiang, Chaoquan, et al.
Publicado: (2025)
por: Jiang, Chaoquan, et al.
Publicado: (2025)
Effortless Vision-Language Model Specialization in Histopathology without Annotation
por: Qiu, Jingna, et al.
Publicado: (2025)
por: Qiu, Jingna, et al.
Publicado: (2025)
Performance of Human Annotators in Object Detection and Segmentation of Remotely Sensed Data
por: Blushtein-Livnon, Roni, et al.
Publicado: (2024)
por: Blushtein-Livnon, Roni, et al.
Publicado: (2024)
Vision-Language Modeling Meets Remote Sensing: Models, Datasets and Perspectives
por: Weng, Xingxing, et al.
Publicado: (2025)
por: Weng, Xingxing, et al.
Publicado: (2025)
Co-Training Vision Language Models for Remote Sensing Multi-task Learning
por: Li, Qingyun, et al.
Publicado: (2025)
por: Li, Qingyun, et al.
Publicado: (2025)
Continual Vision-Language Learning for Remote Sensing: Benchmarking and Analysis
por: Weng, Xingxing, et al.
Publicado: (2026)
por: Weng, Xingxing, et al.
Publicado: (2026)
CHOICE: Benchmarking the Remote Sensing Capabilities of Large Vision-Language Models
por: An, Xiao, et al.
Publicado: (2024)
por: An, Xiao, et al.
Publicado: (2024)
Redundancy-Aware Pretraining of Vision-Language Foundation Models in Remote Sensing
por: Adler, Mathis Jürgen, et al.
Publicado: (2025)
por: Adler, Mathis Jürgen, et al.
Publicado: (2025)
Few-Shot Adaptation Benchmark for Remote Sensing Vision-Language Models
por: Khoury, Karim El, et al.
Publicado: (2025)
por: Khoury, Karim El, et al.
Publicado: (2025)
UniRS: Unifying Multi-temporal Remote Sensing Tasks through Vision Language Models
por: Li, Yujie, et al.
Publicado: (2024)
por: Li, Yujie, et al.
Publicado: (2024)
DDFAV: Remote Sensing Large Vision Language Models Dataset and Evaluation Benchmark
por: Li, Haodong, et al.
Publicado: (2024)
por: Li, Haodong, et al.
Publicado: (2024)
Remote Sensing SpatioTemporal Vision-Language Models: A Comprehensive Survey
por: Liu, Chenyang, et al.
Publicado: (2024)
por: Liu, Chenyang, et al.
Publicado: (2024)
VHM: Versatile and Honest Vision Language Model for Remote Sensing Image Analysis
por: Pang, Chao, et al.
Publicado: (2024)
por: Pang, Chao, et al.
Publicado: (2024)
Enhancing Remote Sensing Vision-Language Models for Zero-Shot Scene Classification
por: Khoury, Karim El, et al.
Publicado: (2024)
por: Khoury, Karim El, et al.
Publicado: (2024)
Falcon: A Remote Sensing Vision-Language Foundation Model (Technical Report)
por: Yao, Kelu, et al.
Publicado: (2025)
por: Yao, Kelu, et al.
Publicado: (2025)
An Efficient and Effective Encoder Model for Vision and Language Tasks in the Remote Sensing Domain
por: Silva, João Daniel, et al.
Publicado: (2025)
por: Silva, João Daniel, et al.
Publicado: (2025)
Large Vision-Language Models for Remote Sensing Visual Question Answering
por: Siripong, Surasakdi, et al.
Publicado: (2024)
por: Siripong, Surasakdi, et al.
Publicado: (2024)
You Only Pose Once: A Minimalist's Detection Transformer for Monocular RGB Category-level 9D Multi-Object Pose Estimation
por: Lee, Hakjin, et al.
Publicado: (2025)
por: Lee, Hakjin, et al.
Publicado: (2025)
Multilingual Vision-Language Pre-training for the Remote Sensing Domain
por: Silva, João Daniel, et al.
Publicado: (2024)
por: Silva, João Daniel, et al.
Publicado: (2024)
Frequency-Aware Vision-Language Multimodality Generalization Network for Remote Sensing Image Classification
por: Zhang, Junjie, et al.
Publicado: (2025)
por: Zhang, Junjie, et al.
Publicado: (2025)
FMARS: Annotating Remote Sensing Images for Disaster Management using Foundation Models
por: Arnaudo, Edoardo, et al.
Publicado: (2024)
por: Arnaudo, Edoardo, et al.
Publicado: (2024)
SAM2-ELNet: Label Enhancement and Automatic Annotation for Remote Sensing Segmentation
por: Yang, Jianhao, et al.
Publicado: (2025)
por: Yang, Jianhao, et al.
Publicado: (2025)
TimeSenCLIP: A Time Series Vision-Language Model for Remote Sensing
por: Jain, Pallavi, et al.
Publicado: (2025)
por: Jain, Pallavi, et al.
Publicado: (2025)
Sentinel2Cap: A Human-Annotated Benchmark Dataset for Multimodal Remote Sensing Image Captioning
por: Tosato, Lucrezia, et al.
Publicado: (2026)
por: Tosato, Lucrezia, et al.
Publicado: (2026)
Annotation-Free Open-Vocabulary Segmentation for Remote-Sensing Images
por: Li, Kaiyu, et al.
Publicado: (2025)
por: Li, Kaiyu, et al.
Publicado: (2025)
LHRS-Bot-Nova: Improved Multimodal Large Language Model for Remote Sensing Vision-Language Interpretation
por: Li, Zhenshi, et al.
Publicado: (2024)
por: Li, Zhenshi, et al.
Publicado: (2024)
Active-SAOOD: Active Sparsely Annotated Oriented Object Detection in Remote Sensing Images
por: Lin, Yu, et al.
Publicado: (2026)
por: Lin, Yu, et al.
Publicado: (2026)
RS-OOD: A Vision-Language Augmented Framework for Out-of-Distribution Detection in Remote Sensing
por: Wang, Chenhao, et al.
Publicado: (2025)
por: Wang, Chenhao, et al.
Publicado: (2025)
Rethinking Electro-Optical Vision Foundation Models for Remote Sensing Retrieval: A Controlled Comparison with Generalist VFM
por: Park, Hyobin, et al.
Publicado: (2026)
por: Park, Hyobin, et al.
Publicado: (2026)
RemoteZero: Geospatial Reasoning with Zero Human Annotations
por: Yao, Liang, et al.
Publicado: (2026)
por: Yao, Liang, et al.
Publicado: (2026)
GeoGround: A Unified Large Vision-Language Model for Remote Sensing Visual Grounding
por: Zhou, Yue, et al.
Publicado: (2024)
por: Zhou, Yue, et al.
Publicado: (2024)
SPEX: A Vision-Language Model for Land Cover Extraction on Spectral Remote Sensing Images
por: Si, Dongchen, et al.
Publicado: (2025)
por: Si, Dongchen, et al.
Publicado: (2025)
Weakly Supervised Ephemeral Gully Detection In Remote Sensing Images Using Vision Language Models
por: Tousi, Seyed Mohamad Ali, et al.
Publicado: (2025)
por: Tousi, Seyed Mohamad Ali, et al.
Publicado: (2025)
Quality-Driven Curation of Remote Sensing Vision-Language Data via Learned Scoring Models
por: Muhtar, Dilxat, et al.
Publicado: (2025)
por: Muhtar, Dilxat, et al.
Publicado: (2025)
Ejemplares similares
-
A Billion-scale Foundation Model for Remote Sensing Images
por: Cha, Keumgang, et al.
Publicado: (2023) -
On Pitfalls of $\textit{RemOve-And-Retrain}$: Data Processing Inequality Perspective
por: Song, Junhwa, et al.
Publicado: (2023) -
Measuring and Mitigating Hallucinations in Vision-Language Dataset Generation for Remote Sensing
por: Anderson, Madeline, et al.
Publicado: (2025) -
Masked Autoregressive Model for Weather Forecasting
por: Kim, Doyi, et al.
Publicado: (2024) -
RemoteCLIP: A Vision Language Foundation Model for Remote Sensing
por: Liu, Fan, et al.
Publicado: (2023)