GeoLLaVA: Efficient Fine-Tuned Vision-Language Models for Temporal Change Detection in Remote Sensing
Fuente:
arXiv
Salvato in:
| Autori principali: | Elgendy, Hosam, Sharshar, Ahmed, Aboeitta, Ahmed, Ashraf, Yasser, Guizani, Mohsen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ChatENV: An Interactive Vision-Language Model for Sensor-Guided Environmental Monitoring and Scenario Simulation
di: Elgendy, Hosam, et al.
Pubblicazione: (2025)
di: Elgendy, Hosam, et al.
Pubblicazione: (2025)
Not Only Grey Matter: OmniBrain for Robust Multimodal Classification of Alzheimer's Disease
di: Sharshar, Ahmed, et al.
Pubblicazione: (2025)
di: Sharshar, Ahmed, et al.
Pubblicazione: (2025)
PulmoFusion: Advancing Pulmonary Health with Efficient Multi-Modal Fusion
di: Sharshar, Ahmed, et al.
Pubblicazione: (2025)
di: Sharshar, Ahmed, et al.
Pubblicazione: (2025)
GeoLLaVA-8K: Scaling Remote-Sensing Multimodal Large Language Models to 8K Resolution
di: Wang, Fengxiang, et al.
Pubblicazione: (2025)
di: Wang, Fengxiang, et al.
Pubblicazione: (2025)
Vision-Language Models for Edge Networks: A Comprehensive Survey
di: Sharshar, Ahmed, et al.
Pubblicazione: (2025)
di: Sharshar, Ahmed, et al.
Pubblicazione: (2025)
SPACT18: Spiking Human Action Recognition Benchmark Dataset with Complementary RGB and Thermal Modalities
di: Ashraf, Yasser, et al.
Pubblicazione: (2025)
di: Ashraf, Yasser, et al.
Pubblicazione: (2025)
Harm or Humor: A Multimodal, Multilingual Benchmark for Overt and Covert Harmful Humor
di: Sharshar, Ahmed, et al.
Pubblicazione: (2026)
di: Sharshar, Ahmed, et al.
Pubblicazione: (2026)
FairLLaVA: Fairness-Aware Parameter-Efficient Fine-Tuning for Large Vision-Language Assistants
di: Bhosale, Mahesh, et al.
Pubblicazione: (2026)
di: Bhosale, Mahesh, et al.
Pubblicazione: (2026)
PeftCD: Leveraging Vision Foundation Models with Parameter-Efficient Fine-Tuning for Remote Sensing Change Detection
di: Dong, Sijun, et al.
Pubblicazione: (2025)
di: Dong, Sijun, et al.
Pubblicazione: (2025)
CityLLaVA: Efficient Fine-Tuning for VLMs in City Scenario
di: Duan, Zhizhao, et al.
Pubblicazione: (2024)
di: Duan, Zhizhao, et al.
Pubblicazione: (2024)
Constraint-Driven Warm-Freeze for Efficient Transfer Learning in Photovoltaic Systems
di: Saeed, Yasmeen, et al.
Pubblicazione: (2026)
di: Saeed, Yasmeen, et al.
Pubblicazione: (2026)
Towards Inclusive NLP: Assessing Compressed Multilingual Transformers across Diverse Language Benchmarks
di: Alshehhi, Maitha, et al.
Pubblicazione: (2025)
di: Alshehhi, Maitha, et al.
Pubblicazione: (2025)
Continual LLaVA: Continual Instruction Tuning in Large Vision-Language Models
di: Cao, Meng, et al.
Pubblicazione: (2024)
di: Cao, Meng, et al.
Pubblicazione: (2024)
LLaVA-SLT: Visual Language Tuning for Sign Language Translation
di: Liang, Han, et al.
Pubblicazione: (2024)
di: Liang, Han, et al.
Pubblicazione: (2024)
Bridging ASR and LLMs for Dysarthric Speech Recognition: Benchmarking Self-Supervised and Generative Approaches
di: Aboeitta, Ahmed, et al.
Pubblicazione: (2025)
di: Aboeitta, Ahmed, et al.
Pubblicazione: (2025)
LLaVA-ST: A Multimodal Large Language Model for Fine-Grained Spatial-Temporal Understanding
di: Li, Hongyu, et al.
Pubblicazione: (2025)
di: Li, Hongyu, et al.
Pubblicazione: (2025)
Delta-LLaVA: Base-then-Specialize Alignment for Token-Efficient Vision-Language Models
di: Zamini, Mohamad, et al.
Pubblicazione: (2025)
di: Zamini, Mohamad, et al.
Pubblicazione: (2025)
LLaVA-LE: Large Language-and-Vision Assistant for Lunar Exploration
di: Inal, Gokce, et al.
Pubblicazione: (2026)
di: Inal, Gokce, et al.
Pubblicazione: (2026)
Dr-LLaVA: Visual Instruction Tuning with Symbolic Clinical Grounding
di: Sun, Shenghuan, et al.
Pubblicazione: (2024)
di: Sun, Shenghuan, et al.
Pubblicazione: (2024)
Single-Temporal Supervised Learning for Universal Remote Sensing Change Detection
di: Zheng, Zhuo, et al.
Pubblicazione: (2024)
di: Zheng, Zhuo, et al.
Pubblicazione: (2024)
Efficient Remote Sensing Change Detection with Change State Space Models
di: Ghazaei, Elman, et al.
Pubblicazione: (2025)
di: Ghazaei, Elman, et al.
Pubblicazione: (2025)
Yo'LLaVA: Your Personalized Language and Vision Assistant
di: Nguyen, Thao, et al.
Pubblicazione: (2024)
di: Nguyen, Thao, et al.
Pubblicazione: (2024)
GeoVLM-R1: Reinforcement Fine-Tuning for Improved Remote Sensing Reasoning
di: Fiaz, Mustansar, et al.
Pubblicazione: (2025)
di: Fiaz, Mustansar, et al.
Pubblicazione: (2025)
EfficientLLaVA:Generalizable Auto-Pruning for Large Vision-language Models
di: Liang, Yinan, et al.
Pubblicazione: (2025)
di: Liang, Yinan, et al.
Pubblicazione: (2025)
SkySenseGPT: A Fine-Grained Instruction Tuning Dataset and Model for Remote Sensing Vision-Language Understanding
di: Luo, Junwei, et al.
Pubblicazione: (2024)
di: Luo, Junwei, et al.
Pubblicazione: (2024)
Remote Sensing Change Detection via Weak Temporal Supervision
di: Bou, Xavier, et al.
Pubblicazione: (2026)
di: Bou, Xavier, et al.
Pubblicazione: (2026)
ChestGPT: Integrating Large Language Models and Vision Transformers for Disease Detection and Localization in Chest X-Rays
di: Khan, Shehroz S., et al.
Pubblicazione: (2025)
di: Khan, Shehroz S., et al.
Pubblicazione: (2025)
LLaVA-c: Continual Improved Visual Instruction Tuning
di: Liu, Wenzhuo, et al.
Pubblicazione: (2025)
di: Liu, Wenzhuo, et al.
Pubblicazione: (2025)
Leveraging Fine-Grained Information and Noise Decoupling for Remote Sensing Change Detection
di: Du, Qiangang, et al.
Pubblicazione: (2024)
di: Du, Qiangang, et al.
Pubblicazione: (2024)
When LLaVA Meets Objects: Token Composition for Vision-Language-Models
di: Jahagirdar, Soumya, et al.
Pubblicazione: (2026)
di: Jahagirdar, Soumya, et al.
Pubblicazione: (2026)
LLaVA-MR: Large Language-and-Vision Assistant for Video Moment Retrieval
di: Lu, Weiheng, et al.
Pubblicazione: (2024)
di: Lu, Weiheng, et al.
Pubblicazione: (2024)
ATP-LLaVA: Adaptive Token Pruning for Large Vision Language Models
di: Ye, Xubing, et al.
Pubblicazione: (2024)
di: Ye, Xubing, et al.
Pubblicazione: (2024)
MoE-LLaVA: Mixture of Experts for Large Vision-Language Models
di: Lin, Bin, et al.
Pubblicazione: (2024)
di: Lin, Bin, et al.
Pubblicazione: (2024)
LLaVA-CoT: Let Vision Language Models Reason Step-by-Step
di: Xu, Guowei, et al.
Pubblicazione: (2024)
di: Xu, Guowei, et al.
Pubblicazione: (2024)
PE-CLIP: A Parameter-Efficient Fine-Tuning of Vision Language Models for Dynamic Facial Expression Recognition
di: Saadi, Ibtissam, et al.
Pubblicazione: (2025)
di: Saadi, Ibtissam, et al.
Pubblicazione: (2025)
Joint Spatio-Temporal Modeling for the Semantic Change Detection in Remote Sensing Images
di: Ding, Lei, et al.
Pubblicazione: (2022)
di: Ding, Lei, et al.
Pubblicazione: (2022)
NeXt2Former-CD: Efficient Remote Sensing Change Detection with Modern Vision Architectures
di: Wang, Yufan, et al.
Pubblicazione: (2026)
di: Wang, Yufan, et al.
Pubblicazione: (2026)
GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing
di: Ma, Xianzhi, et al.
Pubblicazione: (2025)
di: Ma, Xianzhi, et al.
Pubblicazione: (2025)
CosmoCLIP: Generalizing Large Vision-Language Models for Astronomical Imaging
di: Imam, Raza, et al.
Pubblicazione: (2024)
di: Imam, Raza, et al.
Pubblicazione: (2024)
FocusLLaVA: A Coarse-to-Fine Approach for Efficient and Effective Visual Token Compression
di: Zhu, Yuke, et al.
Pubblicazione: (2024)
di: Zhu, Yuke, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ChatENV: An Interactive Vision-Language Model for Sensor-Guided Environmental Monitoring and Scenario Simulation
di: Elgendy, Hosam, et al.
Pubblicazione: (2025) -
Not Only Grey Matter: OmniBrain for Robust Multimodal Classification of Alzheimer's Disease
di: Sharshar, Ahmed, et al.
Pubblicazione: (2025) -
PulmoFusion: Advancing Pulmonary Health with Efficient Multi-Modal Fusion
di: Sharshar, Ahmed, et al.
Pubblicazione: (2025) -
GeoLLaVA-8K: Scaling Remote-Sensing Multimodal Large Language Models to 8K Resolution
di: Wang, Fengxiang, et al.
Pubblicazione: (2025) -
Vision-Language Models for Edge Networks: A Comprehensive Survey
di: Sharshar, Ahmed, et al.
Pubblicazione: (2025)