LHRS-Bot-Nova: Improved Multimodal Large Language Model for Remote Sensing Vision-Language Interpretation
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Zhenshi, Muhtar, Dilxat, Gu, Feng, Zhang, Xueliang, Xiao, Pengfeng, He, Guangjun, Zhu, Xiaoxiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LHRS-Bot: Empowering Remote Sensing with VGI-Enhanced Large Multimodal Language Model
di: Muhtar, Dilxat, et al.
Pubblicazione: (2024)
di: Muhtar, Dilxat, et al.
Pubblicazione: (2024)
Quality-Driven Curation of Remote Sensing Vision-Language Data via Learned Scoring Models
di: Muhtar, Dilxat, et al.
Pubblicazione: (2025)
di: Muhtar, Dilxat, et al.
Pubblicazione: (2025)
Remote Sensing Image Super-Resolution for Imbalanced Textures: A Texture-Aware Diffusion Framework
di: Zhang, Enzhuo, et al.
Pubblicazione: (2026)
di: Zhang, Enzhuo, et al.
Pubblicazione: (2026)
FarSLIP: Discovering Effective CLIP Adaptation for Fine-Grained Remote Sensing Understanding
di: Li, Zhenshi, et al.
Pubblicazione: (2025)
di: Li, Zhenshi, et al.
Pubblicazione: (2025)
RS-Mamba for Large Remote Sensing Image Dense Prediction
di: Zhao, Sijie, et al.
Pubblicazione: (2024)
di: Zhao, Sijie, et al.
Pubblicazione: (2024)
Spatial-Temporal-Spectral Unified Modeling for Remote Sensing Dense Prediction
di: Zhao, Sijie, et al.
Pubblicazione: (2025)
di: Zhao, Sijie, et al.
Pubblicazione: (2025)
CHOICE: Benchmarking the Remote Sensing Capabilities of Large Vision-Language Models
di: An, Xiao, et al.
Pubblicazione: (2024)
di: An, Xiao, et al.
Pubblicazione: (2024)
Frequency-Aware Vision-Language Multimodality Generalization Network for Remote Sensing Image Classification
di: Zhang, Junjie, et al.
Pubblicazione: (2025)
di: Zhang, Junjie, et al.
Pubblicazione: (2025)
GeoRSMLLM: A Multimodal Large Language Model for Vision-Language Tasks in Geoscience and Remote Sensing
di: Zhang, Zilun, et al.
Pubblicazione: (2025)
di: Zhang, Zilun, et al.
Pubblicazione: (2025)
RemoteCLIP: A Vision Language Foundation Model for Remote Sensing
di: Liu, Fan, et al.
Pubblicazione: (2023)
di: Liu, Fan, et al.
Pubblicazione: (2023)
Multimodal Interpretation of Remote Sensing Images: Dynamic Resolution Input Strategy and Multi-scale Vision-Language Alignment Mechanism
di: Zhang, Siyu, et al.
Pubblicazione: (2025)
di: Zhang, Siyu, et al.
Pubblicazione: (2025)
SenseBench: A Benchmark for Remote Sensing Low-Level Visual Perception and Description in Large Vision-Language Models
di: Zhong, Chen, et al.
Pubblicazione: (2026)
di: Zhong, Chen, et al.
Pubblicazione: (2026)
Vision-Language Models in Remote Sensing: Current Progress and Future Trends
di: Li, Xiang, et al.
Pubblicazione: (2023)
di: Li, Xiang, et al.
Pubblicazione: (2023)
GeoHeight-Bench: Towards Height-Aware Multimodal Reasoning in Remote Sensing
di: Hu, Xuran, et al.
Pubblicazione: (2026)
di: Hu, Xuran, et al.
Pubblicazione: (2026)
GeoGround: A Unified Large Vision-Language Model for Remote Sensing Visual Grounding
di: Zhou, Yue, et al.
Pubblicazione: (2024)
di: Zhou, Yue, et al.
Pubblicazione: (2024)
VHM: Versatile and Honest Vision Language Model for Remote Sensing Image Analysis
di: Pang, Chao, et al.
Pubblicazione: (2024)
di: Pang, Chao, et al.
Pubblicazione: (2024)
DDFAV: Remote Sensing Large Vision Language Models Dataset and Evaluation Benchmark
di: Li, Haodong, et al.
Pubblicazione: (2024)
di: Li, Haodong, et al.
Pubblicazione: (2024)
FLAVARS: A Multimodal Foundational Language and Vision Alignment Model for Remote Sensing
di: Corley, Isaac, et al.
Pubblicazione: (2025)
di: Corley, Isaac, et al.
Pubblicazione: (2025)
Large Vision-Language Models for Remote Sensing Visual Question Answering
di: Siripong, Surasakdi, et al.
Pubblicazione: (2024)
di: Siripong, Surasakdi, et al.
Pubblicazione: (2024)
EagleVision: Object-level Attribute Multimodal LLM for Remote Sensing
di: Jiang, Hongxiang, et al.
Pubblicazione: (2025)
di: Jiang, Hongxiang, et al.
Pubblicazione: (2025)
GAIA: A Global, Multi-modal, Multi-scale Vision-Language Dataset for Remote Sensing Image Analysis
di: Zavras, Angelos, et al.
Pubblicazione: (2025)
di: Zavras, Angelos, et al.
Pubblicazione: (2025)
VegeDiff: Latent Diffusion Model for Geospatial Vegetation Forecasting
di: Zhao, Sijie, et al.
Pubblicazione: (2024)
di: Zhao, Sijie, et al.
Pubblicazione: (2024)
Multilingual Vision-Language Pre-training for the Remote Sensing Domain
di: Silva, João Daniel, et al.
Pubblicazione: (2024)
di: Silva, João Daniel, et al.
Pubblicazione: (2024)
Continual Vision-Language Learning for Remote Sensing: Benchmarking and Analysis
di: Weng, Xingxing, et al.
Pubblicazione: (2026)
di: Weng, Xingxing, et al.
Pubblicazione: (2026)
LithoBench: Benchmarking Large Multimodal Models for Remote-Sensing Lithology Interpretation
di: Wang, Jun, et al.
Pubblicazione: (2026)
di: Wang, Jun, et al.
Pubblicazione: (2026)
Co-Training Vision Language Models for Remote Sensing Multi-task Learning
di: Li, Qingyun, et al.
Pubblicazione: (2025)
di: Li, Qingyun, et al.
Pubblicazione: (2025)
BTCChat: Advancing Remote Sensing Bi-temporal Change Captioning with Multimodal Large Language Model
di: Li, Yujie, et al.
Pubblicazione: (2025)
di: Li, Yujie, et al.
Pubblicazione: (2025)
Decoding the Delta: Unifying Remote Sensing Change Detection and Understanding with Multimodal Large Language Models
di: Li, Xiaohe, et al.
Pubblicazione: (2026)
di: Li, Xiaohe, et al.
Pubblicazione: (2026)
SkyEyeGPT: Unifying Remote Sensing Vision-Language Tasks via Instruction Tuning with Large Language Model
di: Zhan, Yang, et al.
Pubblicazione: (2024)
di: Zhan, Yang, et al.
Pubblicazione: (2024)
FUSE-RSVLM: Feature Fusion Vision-Language Model for Remote Sensing
di: Dang, Yunkai, et al.
Pubblicazione: (2025)
di: Dang, Yunkai, et al.
Pubblicazione: (2025)
Vision-Language Modeling Meets Remote Sensing: Models, Datasets and Perspectives
di: Weng, Xingxing, et al.
Pubblicazione: (2025)
di: Weng, Xingxing, et al.
Pubblicazione: (2025)
Redundancy-Aware Pretraining of Vision-Language Foundation Models in Remote Sensing
di: Adler, Mathis Jürgen, et al.
Pubblicazione: (2025)
di: Adler, Mathis Jürgen, et al.
Pubblicazione: (2025)
Measuring and Mitigating Hallucinations in Vision-Language Dataset Generation for Remote Sensing
di: Anderson, Madeline, et al.
Pubblicazione: (2025)
di: Anderson, Madeline, et al.
Pubblicazione: (2025)
Few-Shot Adaptation Benchmark for Remote Sensing Vision-Language Models
di: Khoury, Karim El, et al.
Pubblicazione: (2025)
di: Khoury, Karim El, et al.
Pubblicazione: (2025)
RSHallu: Dual-Mode Hallucination Evaluation for Remote-Sensing Multimodal Large Language Models with Domain-Tailored Mitigation
di: Zhou, Zihui, et al.
Pubblicazione: (2026)
di: Zhou, Zihui, et al.
Pubblicazione: (2026)
RS-OOD: A Vision-Language Augmented Framework for Out-of-Distribution Detection in Remote Sensing
di: Wang, Chenhao, et al.
Pubblicazione: (2025)
di: Wang, Chenhao, et al.
Pubblicazione: (2025)
Task Preference Optimization: Improving Multimodal Large Language Models with Vision Task Alignment
di: Yan, Ziang, et al.
Pubblicazione: (2024)
di: Yan, Ziang, et al.
Pubblicazione: (2024)
Large Language Models for Captioning and Retrieving Remote Sensing Images
di: Silva, João Daniel, et al.
Pubblicazione: (2024)
di: Silva, João Daniel, et al.
Pubblicazione: (2024)
LVLM-Interpret: An Interpretability Tool for Large Vision-Language Models
di: Stan, Gabriela Ben Melech, et al.
Pubblicazione: (2024)
di: Stan, Gabriela Ben Melech, et al.
Pubblicazione: (2024)
Semantically Aware UAV Landing Site Assessment from Remote Sensing Imagery via Multimodal Large Language Models
di: Hua, Chunliang, et al.
Pubblicazione: (2026)
di: Hua, Chunliang, et al.
Pubblicazione: (2026)
Documenti analoghi
-
LHRS-Bot: Empowering Remote Sensing with VGI-Enhanced Large Multimodal Language Model
di: Muhtar, Dilxat, et al.
Pubblicazione: (2024) -
Quality-Driven Curation of Remote Sensing Vision-Language Data via Learned Scoring Models
di: Muhtar, Dilxat, et al.
Pubblicazione: (2025) -
Remote Sensing Image Super-Resolution for Imbalanced Textures: A Texture-Aware Diffusion Framework
di: Zhang, Enzhuo, et al.
Pubblicazione: (2026) -
FarSLIP: Discovering Effective CLIP Adaptation for Fine-Grained Remote Sensing Understanding
di: Li, Zhenshi, et al.
Pubblicazione: (2025) -
RS-Mamba for Large Remote Sensing Image Dense Prediction
di: Zhao, Sijie, et al.
Pubblicazione: (2024)