LHRS-Bot: Empowering Remote Sensing with VGI-Enhanced Large Multimodal Language Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Muhtar, Dilxat, Li, Zhenshi, Gu, Feng, Zhang, Xueliang, Xiao, Pengfeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LHRS-Bot-Nova: Improved Multimodal Large Language Model for Remote Sensing Vision-Language Interpretation
di: Li, Zhenshi, et al.
Pubblicazione: (2024)
di: Li, Zhenshi, et al.
Pubblicazione: (2024)
Quality-Driven Curation of Remote Sensing Vision-Language Data via Learned Scoring Models
di: Muhtar, Dilxat, et al.
Pubblicazione: (2025)
di: Muhtar, Dilxat, et al.
Pubblicazione: (2025)
Remote Sensing Image Super-Resolution for Imbalanced Textures: A Texture-Aware Diffusion Framework
di: Zhang, Enzhuo, et al.
Pubblicazione: (2026)
di: Zhang, Enzhuo, et al.
Pubblicazione: (2026)
FarSLIP: Discovering Effective CLIP Adaptation for Fine-Grained Remote Sensing Understanding
di: Li, Zhenshi, et al.
Pubblicazione: (2025)
di: Li, Zhenshi, et al.
Pubblicazione: (2025)
LatticeWorld: A Multimodal Large Language Model-Empowered Framework for Interactive Complex World Generation
di: Duan, Yinglin, et al.
Pubblicazione: (2025)
di: Duan, Yinglin, et al.
Pubblicazione: (2025)
RS-Mamba for Large Remote Sensing Image Dense Prediction
di: Zhao, Sijie, et al.
Pubblicazione: (2024)
di: Zhao, Sijie, et al.
Pubblicazione: (2024)
RSHallu: Dual-Mode Hallucination Evaluation for Remote-Sensing Multimodal Large Language Models with Domain-Tailored Mitigation
di: Zhou, Zihui, et al.
Pubblicazione: (2026)
di: Zhou, Zihui, et al.
Pubblicazione: (2026)
GeoRSMLLM: A Multimodal Large Language Model for Vision-Language Tasks in Geoscience and Remote Sensing
di: Zhang, Zilun, et al.
Pubblicazione: (2025)
di: Zhang, Zilun, et al.
Pubblicazione: (2025)
From Pixels to Prose: Advancing Multi-Modal Language Models for Remote Sensing
di: Sun, Xintian, et al.
Pubblicazione: (2024)
di: Sun, Xintian, et al.
Pubblicazione: (2024)
Semantically Aware UAV Landing Site Assessment from Remote Sensing Imagery via Multimodal Large Language Models
di: Hua, Chunliang, et al.
Pubblicazione: (2026)
di: Hua, Chunliang, et al.
Pubblicazione: (2026)
HM-Bench: A Comprehensive Benchmark for Multimodal Large Language Models in Hyperspectral Remote Sensing
di: Zhang, Xinyu, et al.
Pubblicazione: (2026)
di: Zhang, Xinyu, et al.
Pubblicazione: (2026)
REMONI: An Autonomous System Integrating Wearables and Multimodal Large Language Models for Enhanced Remote Health Monitoring
di: Ho, Thanh Cong, et al.
Pubblicazione: (2025)
di: Ho, Thanh Cong, et al.
Pubblicazione: (2025)
Can Multimodal Large Language Models Truly Perform Multimodal In-Context Learning?
di: Chen, Shuo, et al.
Pubblicazione: (2023)
di: Chen, Shuo, et al.
Pubblicazione: (2023)
Aquila: A Hierarchically Aligned Visual-Language Model for Enhanced Remote Sensing Image Comprehension
di: Lu, Kaixuan, et al.
Pubblicazione: (2024)
di: Lu, Kaixuan, et al.
Pubblicazione: (2024)
LithoBench: Benchmarking Large Multimodal Models for Remote-Sensing Lithology Interpretation
di: Wang, Jun, et al.
Pubblicazione: (2026)
di: Wang, Jun, et al.
Pubblicazione: (2026)
Spatial-Temporal-Spectral Unified Modeling for Remote Sensing Dense Prediction
di: Zhao, Sijie, et al.
Pubblicazione: (2025)
di: Zhao, Sijie, et al.
Pubblicazione: (2025)
SenseBench: A Benchmark for Remote Sensing Low-Level Visual Perception and Description in Large Vision-Language Models
di: Zhong, Chen, et al.
Pubblicazione: (2026)
di: Zhong, Chen, et al.
Pubblicazione: (2026)
Efficient Few-Shot Learning in Remote Sensing: Fusing Vision and Vision-Language Models
di: Chua, Jia Yun, et al.
Pubblicazione: (2025)
di: Chua, Jia Yun, et al.
Pubblicazione: (2025)
Vision-Language Models in Remote Sensing: Current Progress and Future Trends
di: Li, Xiang, et al.
Pubblicazione: (2023)
di: Li, Xiang, et al.
Pubblicazione: (2023)
Genixer: Empowering Multimodal Large Language Models as a Powerful Data Generator
di: Zhao, Henry Hengyuan, et al.
Pubblicazione: (2023)
di: Zhao, Henry Hengyuan, et al.
Pubblicazione: (2023)
A Billion-scale Foundation Model for Remote Sensing Images
di: Cha, Keumgang, et al.
Pubblicazione: (2023)
di: Cha, Keumgang, et al.
Pubblicazione: (2023)
Geospatial-Temporal Sensemaking of Remote Sensing Activity Detections with Multimodal Large Language Model
di: Ramirez, David F., et al.
Pubblicazione: (2026)
di: Ramirez, David F., et al.
Pubblicazione: (2026)
DiffRIS: Enhancing Referring Remote Sensing Image Segmentation with Pre-trained Text-to-Image Diffusion Models
di: Dong, Zhe, et al.
Pubblicazione: (2025)
di: Dong, Zhe, et al.
Pubblicazione: (2025)
Exploring Perceptual Limitation of Multimodal Large Language Models
di: Zhang, Jiarui, et al.
Pubblicazione: (2024)
di: Zhang, Jiarui, et al.
Pubblicazione: (2024)
Learning to Inference Adaptively for Multimodal Large Language Models
di: Xu, Zhuoyan, et al.
Pubblicazione: (2025)
di: Xu, Zhuoyan, et al.
Pubblicazione: (2025)
Visual Question Decomposition on Multimodal Large Language Models
di: Zhang, Haowei, et al.
Pubblicazione: (2024)
di: Zhang, Haowei, et al.
Pubblicazione: (2024)
Beyond Visual Fidelity: Benchmarking Super-Resolution Models for Large-Scale Remote Sensing Imagery via Downstream Task Integration
di: Li, Zhili, et al.
Pubblicazione: (2026)
di: Li, Zhili, et al.
Pubblicazione: (2026)
Perception Tokens Enhance Visual Reasoning in Multimodal Language Models
di: Bigverdi, Mahtab, et al.
Pubblicazione: (2024)
di: Bigverdi, Mahtab, et al.
Pubblicazione: (2024)
How to Teach Large Multimodal Models New Skills
di: Zhu, Zhen, et al.
Pubblicazione: (2025)
di: Zhu, Zhen, et al.
Pubblicazione: (2025)
Active-O3: Empowering Multimodal Large Language Models with Active Perception via GRPO
di: Zhu, Muzhi, et al.
Pubblicazione: (2025)
di: Zhu, Muzhi, et al.
Pubblicazione: (2025)
Causal Decoding for Hallucination-Resistant Multimodal Large Language Models
di: Tan, Shiwei, et al.
Pubblicazione: (2026)
di: Tan, Shiwei, et al.
Pubblicazione: (2026)
Exploring the Transferability of Visual Prompting for Multimodal Large Language Models
di: Zhang, Yichi, et al.
Pubblicazione: (2024)
di: Zhang, Yichi, et al.
Pubblicazione: (2024)
Diagnosing and Mitigating Modality Interference in Multimodal Large Language Models
di: Cai, Rui, et al.
Pubblicazione: (2025)
di: Cai, Rui, et al.
Pubblicazione: (2025)
Vision Search Assistant: Empower Vision-Language Models as Multimodal Search Engines
di: Zhang, Zhixin, et al.
Pubblicazione: (2024)
di: Zhang, Zhixin, et al.
Pubblicazione: (2024)
Revisiting Change VQA in Remote Sensing with Structured and Native Multimodal Qwen Models
di: Bazi, Yakoub, et al.
Pubblicazione: (2026)
di: Bazi, Yakoub, et al.
Pubblicazione: (2026)
FairCoT: Enhancing Fairness in Text-to-Image Generation via Chain of Thought Reasoning with Multimodal Large Language Models
di: Sahili, Zahraa Al, et al.
Pubblicazione: (2024)
di: Sahili, Zahraa Al, et al.
Pubblicazione: (2024)
Adaptive Diagnostic Reasoning Framework for Pathology with Multimodal Large Language Models
di: Hong, Yunqi, et al.
Pubblicazione: (2025)
di: Hong, Yunqi, et al.
Pubblicazione: (2025)
CompCap: Improving Multimodal Large Language Models with Composite Captions
di: Chen, Xiaohui, et al.
Pubblicazione: (2024)
di: Chen, Xiaohui, et al.
Pubblicazione: (2024)
Can GPT tell us why these images are synthesized? Empowering Multimodal Large Language Models for Forensics
di: He, Yiran, et al.
Pubblicazione: (2025)
di: He, Yiran, et al.
Pubblicazione: (2025)
Towards Visual Text Grounding of Multimodal Large Language Model
di: Li, Ming, et al.
Pubblicazione: (2025)
di: Li, Ming, et al.
Pubblicazione: (2025)
Documenti analoghi
-
LHRS-Bot-Nova: Improved Multimodal Large Language Model for Remote Sensing Vision-Language Interpretation
di: Li, Zhenshi, et al.
Pubblicazione: (2024) -
Quality-Driven Curation of Remote Sensing Vision-Language Data via Learned Scoring Models
di: Muhtar, Dilxat, et al.
Pubblicazione: (2025) -
Remote Sensing Image Super-Resolution for Imbalanced Textures: A Texture-Aware Diffusion Framework
di: Zhang, Enzhuo, et al.
Pubblicazione: (2026) -
FarSLIP: Discovering Effective CLIP Adaptation for Fine-Grained Remote Sensing Understanding
di: Li, Zhenshi, et al.
Pubblicazione: (2025) -
LatticeWorld: A Multimodal Large Language Model-Empowered Framework for Interactive Complex World Generation
di: Duan, Yinglin, et al.
Pubblicazione: (2025)