MGIMM: Multi-Granularity Instruction Multimodal Model for Attribute-Guided Remote Sensing Image Detailed Description
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yang, Cong, Li, Zuchao, Zhang, Lefei |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Enhancing Perception of Key Changes in Remote Sensing Image Change Captioning
von: Yang, Cong, et al.
Veröffentlicht: (2024)
von: Yang, Cong, et al.
Veröffentlicht: (2024)
Centroid-centered Modeling for Efficient Vision Transformer Pre-training
von: Yan, Xin, et al.
Veröffentlicht: (2023)
von: Yan, Xin, et al.
Veröffentlicht: (2023)
SIGMAE: A Spectral-Index-Guided Foundation Model for Multispectral Remote Sensing
von: Zhang, Xiaokang, et al.
Veröffentlicht: (2026)
von: Zhang, Xiaokang, et al.
Veröffentlicht: (2026)
FedEU: Evidential Uncertainty-Driven Federated Fine-Tuning of Vision Foundation Models for Remote Sensing Image Segmentation
von: Zhang, Xiaokang, et al.
Veröffentlicht: (2026)
von: Zhang, Xiaokang, et al.
Veröffentlicht: (2026)
RS2-SAM2: Customized SAM2 for Referring Remote Sensing Image Segmentation
von: Rong, Fu, et al.
Veröffentlicht: (2025)
von: Rong, Fu, et al.
Veröffentlicht: (2025)
S5: Scalable Semi-Supervised Semantic Segmentation in Remote Sensing
von: Lv, Liang, et al.
Veröffentlicht: (2025)
von: Lv, Liang, et al.
Veröffentlicht: (2025)
Multi-modal Auto-regressive Modeling via Visual Words
von: Peng, Tianshuo, et al.
Veröffentlicht: (2024)
von: Peng, Tianshuo, et al.
Veröffentlicht: (2024)
Instruction-guided Multi-Granularity Segmentation and Captioning with Large Multimodal Model
von: Zhou, Li, et al.
Veröffentlicht: (2024)
von: Zhou, Li, et al.
Veröffentlicht: (2024)
Global-Local Detail Guided Transformer for Sea Ice Recognition in Optical Remote Sensing Images
von: Huang, Zhanchao, et al.
Veröffentlicht: (2024)
von: Huang, Zhanchao, et al.
Veröffentlicht: (2024)
CDChat: A Large Multimodal Model for Remote Sensing Change Description
von: Noman, Mubashir, et al.
Veröffentlicht: (2024)
von: Noman, Mubashir, et al.
Veröffentlicht: (2024)
MapGlue: Multimodal Remote Sensing Image Matching
von: Wu, Peihao, et al.
Veröffentlicht: (2025)
von: Wu, Peihao, et al.
Veröffentlicht: (2025)
Cross-modal Context-aware Learning for Visual Prompt Guided Multimodal Image Understanding in Remote Sensing
von: Zhang, Xu, et al.
Veröffentlicht: (2025)
von: Zhang, Xu, et al.
Veröffentlicht: (2025)
RSEdit: Text-Guided Image Editing for Remote Sensing
von: Zhenyuan, Chen, et al.
Veröffentlicht: (2026)
von: Zhenyuan, Chen, et al.
Veröffentlicht: (2026)
EagleVision: Object-level Attribute Multimodal LLM for Remote Sensing
von: Jiang, Hongxiang, et al.
Veröffentlicht: (2025)
von: Jiang, Hongxiang, et al.
Veröffentlicht: (2025)
Balanced Diffusion-Guided Fusion for Multimodal Remote Sensing Classification
von: Liu, Hao, et al.
Veröffentlicht: (2025)
von: Liu, Hao, et al.
Veröffentlicht: (2025)
FUSAR-KLIP: Towards Multimodal Foundation Models for Remote Sensing
von: Yang, Yi, et al.
Veröffentlicht: (2025)
von: Yang, Yi, et al.
Veröffentlicht: (2025)
MSP-MVS: Multi-Granularity Segmentation Prior Guided Multi-View Stereo
von: Yuan, Zhenlong, et al.
Veröffentlicht: (2024)
von: Yuan, Zhenlong, et al.
Veröffentlicht: (2024)
ChangeChat: An Interactive Model for Remote Sensing Change Analysis via Multimodal Instruction Tuning
von: Deng, Pei, et al.
Veröffentlicht: (2024)
von: Deng, Pei, et al.
Veröffentlicht: (2024)
Exploring Text-Guided Single Image Editing for Remote Sensing Images
von: Han, Fangzhou, et al.
Veröffentlicht: (2024)
von: Han, Fangzhou, et al.
Veröffentlicht: (2024)
Interactive Masked Image Modeling for Multimodal Object Detection in Remote Sensing
von: Vu, Minh-Duc, et al.
Veröffentlicht: (2024)
von: Vu, Minh-Duc, et al.
Veröffentlicht: (2024)
Multimodal-Aware Fusion Network for Referring Remote Sensing Image Segmentation
von: Shi, Leideng, et al.
Veröffentlicht: (2025)
von: Shi, Leideng, et al.
Veröffentlicht: (2025)
Hi-ResNet: Edge Detail Enhancement for High-Resolution Remote Sensing Segmentation
von: Chen, Yuxia, et al.
Veröffentlicht: (2023)
von: Chen, Yuxia, et al.
Veröffentlicht: (2023)
Guiding Instruction-based Image Editing via Multimodal Large Language Models
von: Fu, Tsu-Jui, et al.
Veröffentlicht: (2023)
von: Fu, Tsu-Jui, et al.
Veröffentlicht: (2023)
Fast-then-Fine: A Two-Stage Framework with Multi-Granular Representation for Cross-Modal Retrieval in Remote Sensing
von: Chen, Xi, et al.
Veröffentlicht: (2026)
von: Chen, Xi, et al.
Veröffentlicht: (2026)
OmniCD: A Foundational Framework for Remote Sensing Image Change Detection Guided by Multimodal Semantics
von: Sun, Chenhao
Veröffentlicht: (2026)
von: Sun, Chenhao
Veröffentlicht: (2026)
Multi-Granularity Reasoning for Image Quality Assessment via Attribute-Aware Reinforcement Learning to Rank
von: Chen, Xiangyong, et al.
Veröffentlicht: (2026)
von: Chen, Xiangyong, et al.
Veröffentlicht: (2026)
GeoAlignCLIP: Enhancing Fine-Grained Vision-Language Alignment in Remote Sensing via Multi-Granular Consistency Learning
von: Yang, Xiao, et al.
Veröffentlicht: (2026)
von: Yang, Xiao, et al.
Veröffentlicht: (2026)
Referring Remote Sensing Image Segmentation via Bidirectional Alignment Guided Joint Prediction
von: Zhang, Tianxiang, et al.
Veröffentlicht: (2025)
von: Zhang, Tianxiang, et al.
Veröffentlicht: (2025)
PriorCLIP: Visual Prior Guided Vision-Language Model for Remote Sensing Image-Text Retrieval
von: Pan, Jiancheng, et al.
Veröffentlicht: (2024)
von: Pan, Jiancheng, et al.
Veröffentlicht: (2024)
A Survey on Remote Sensing Foundation Models: From Vision to Multimodality
von: Huang, Ziyue, et al.
Veröffentlicht: (2025)
von: Huang, Ziyue, et al.
Veröffentlicht: (2025)
ChangeBridge: Spatiotemporal Image Generation with Multimodal Controls for Remote Sensing
von: Zhao, Zhenghui, et al.
Veröffentlicht: (2025)
von: Zhao, Zhenghui, et al.
Veröffentlicht: (2025)
MG-LLaVA: Towards Multi-Granularity Visual Instruction Tuning
von: Zhao, Xiangyu, et al.
Veröffentlicht: (2024)
von: Zhao, Xiangyu, et al.
Veröffentlicht: (2024)
Enhancing Descriptive Captions with Visual Attributes for Multimodal Perception
von: Sun, Yanpeng, et al.
Veröffentlicht: (2024)
von: Sun, Yanpeng, et al.
Veröffentlicht: (2024)
Beyond Open Vocabulary: Multimodal Prompting for Object Detection in Remote Sensing Images
von: Yang, Shuai, et al.
Veröffentlicht: (2026)
von: Yang, Shuai, et al.
Veröffentlicht: (2026)
TEFormer: Texture-Aware and Edge-Guided Transformer for Semantic Segmentation of Urban Remote Sensing Images
von: Zhou, Guoyu, et al.
Veröffentlicht: (2025)
von: Zhou, Guoyu, et al.
Veröffentlicht: (2025)
STAND: Semantic Anchoring Constraint with Dual-Granularity Disambiguation for Remote Sensing Image Change Captioning
von: Gong, Yanpei, et al.
Veröffentlicht: (2026)
von: Gong, Yanpei, et al.
Veröffentlicht: (2026)
AMMUNet: Multi-Scale Attention Map Merging for Remote Sensing Image Segmentation
von: Yang, Yang, et al.
Veröffentlicht: (2024)
von: Yang, Yang, et al.
Veröffentlicht: (2024)
NOTA: Multimodal Music Notation Understanding for Visual Large Language Model
von: Tang, Mingni, et al.
Veröffentlicht: (2025)
von: Tang, Mingni, et al.
Veröffentlicht: (2025)
RS-GPT4V: A Unified Multimodal Instruction-Following Dataset for Remote Sensing Image Understanding
von: Xu, Linrui, et al.
Veröffentlicht: (2024)
von: Xu, Linrui, et al.
Veröffentlicht: (2024)
Image Textualization: An Automatic Framework for Creating Accurate and Detailed Image Descriptions
von: Pi, Renjie, et al.
Veröffentlicht: (2024)
von: Pi, Renjie, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Enhancing Perception of Key Changes in Remote Sensing Image Change Captioning
von: Yang, Cong, et al.
Veröffentlicht: (2024) -
Centroid-centered Modeling for Efficient Vision Transformer Pre-training
von: Yan, Xin, et al.
Veröffentlicht: (2023) -
SIGMAE: A Spectral-Index-Guided Foundation Model for Multispectral Remote Sensing
von: Zhang, Xiaokang, et al.
Veröffentlicht: (2026) -
FedEU: Evidential Uncertainty-Driven Federated Fine-Tuning of Vision Foundation Models for Remote Sensing Image Segmentation
von: Zhang, Xiaokang, et al.
Veröffentlicht: (2026) -
RS2-SAM2: Customized SAM2 for Referring Remote Sensing Image Segmentation
von: Rong, Fu, et al.
Veröffentlicht: (2025)