Frequency-Aware Vision-Language Multimodality Generalization Network for Remote Sensing Image Classification
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Junjie, Zhao, Feng, Liu, Hanqiang, Yu, Jun |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
A Spatial-Spectral-Frequency Interactive Network for Multimodal Remote Sensing Classification
by: Liu, Hao, et al.
Published: (2025)
by: Liu, Hao, et al.
Published: (2025)
Multimodal-Aware Fusion Network for Referring Remote Sensing Image Segmentation
by: Shi, Leideng, et al.
Published: (2025)
by: Shi, Leideng, et al.
Published: (2025)
Cloud Adversarial Example Generation for Remote Sensing Image Classification
by: Ma, Fei, et al.
Published: (2024)
by: Ma, Fei, et al.
Published: (2024)
Enhancing Remote Sensing Vision-Language Models Through MLLM and LLM-Based High-Quality Image-Text Dataset Generation
by: He, Yiguo, et al.
Published: (2025)
by: He, Yiguo, et al.
Published: (2025)
RemoteTrimmer: Adaptive Structural Pruning for Remote Sensing Image Classification
by: Zou, Guangwenjie, et al.
Published: (2024)
by: Zou, Guangwenjie, et al.
Published: (2024)
ChangeBridge: Spatiotemporal Image Generation with Multimodal Controls for Remote Sensing
by: Zhao, Zhenghui, et al.
Published: (2025)
by: Zhao, Zhenghui, et al.
Published: (2025)
LHRS-Bot-Nova: Improved Multimodal Large Language Model for Remote Sensing Vision-Language Interpretation
by: Li, Zhenshi, et al.
Published: (2024)
by: Li, Zhenshi, et al.
Published: (2024)
RemoteCLIP: A Vision Language Foundation Model for Remote Sensing
by: Liu, Fan, et al.
Published: (2023)
by: Liu, Fan, et al.
Published: (2023)
Dynamic Frequency Feature Fusion Network for Multi-Source Remote Sensing Data Classification
by: Zhao, Yikang, et al.
Published: (2025)
by: Zhao, Yikang, et al.
Published: (2025)
Balanced Diffusion-Guided Fusion for Multimodal Remote Sensing Classification
by: Liu, Hao, et al.
Published: (2025)
by: Liu, Hao, et al.
Published: (2025)
VHM: Versatile and Honest Vision Language Model for Remote Sensing Image Analysis
by: Pang, Chao, et al.
Published: (2024)
by: Pang, Chao, et al.
Published: (2024)
SPEX: A Vision-Language Model for Land Cover Extraction on Spectral Remote Sensing Images
by: Si, Dongchen, et al.
Published: (2025)
by: Si, Dongchen, et al.
Published: (2025)
A Survey on Remote Sensing Foundation Models: From Vision to Multimodality
by: Huang, Ziyue, et al.
Published: (2025)
by: Huang, Ziyue, et al.
Published: (2025)
Redundancy-Aware Pretraining of Vision-Language Foundation Models in Remote Sensing
by: Adler, Mathis Jürgen, et al.
Published: (2025)
by: Adler, Mathis Jürgen, et al.
Published: (2025)
EagleVision: Object-level Attribute Multimodal LLM for Remote Sensing
by: Jiang, Hongxiang, et al.
Published: (2025)
by: Jiang, Hongxiang, et al.
Published: (2025)
Multimodal Interpretation of Remote Sensing Images: Dynamic Resolution Input Strategy and Multi-scale Vision-Language Alignment Mechanism
by: Zhang, Siyu, et al.
Published: (2025)
by: Zhang, Siyu, et al.
Published: (2025)
Building Extraction from Remote Sensing Images via an Uncertainty-Aware Network
by: He, Wei, et al.
Published: (2023)
by: He, Wei, et al.
Published: (2023)
MapGlue: Multimodal Remote Sensing Image Matching
by: Wu, Peihao, et al.
Published: (2025)
by: Wu, Peihao, et al.
Published: (2025)
Enhancing Remote Sensing Vision-Language Models for Zero-Shot Scene Classification
by: Khoury, Karim El, et al.
Published: (2024)
by: Khoury, Karim El, et al.
Published: (2024)
Adaptive Frequency Enhancement Network for Remote Sensing Image Semantic Segmentation
by: Gao, Feng, et al.
Published: (2025)
by: Gao, Feng, et al.
Published: (2025)
Frequency-Assisted Mamba for Remote Sensing Image Super-Resolution
by: Xiao, Yi, et al.
Published: (2024)
by: Xiao, Yi, et al.
Published: (2024)
Reconstruction Guided Few-shot Network For Remote Sensing Image Classification
by: Jaiswal, Mohit, et al.
Published: (2026)
by: Jaiswal, Mohit, et al.
Published: (2026)
CSFMamba: Cross State Fusion Mamba Operator for Multimodal Remote Sensing Image Classification
by: Wang, Qingyu, et al.
Published: (2025)
by: Wang, Qingyu, et al.
Published: (2025)
Pseudo-Prompt Generating in Pre-trained Vision-Language Models for Multi-Label Medical Image Classification
by: Ye, Yaoqin, et al.
Published: (2024)
by: Ye, Yaoqin, et al.
Published: (2024)
Multimodal Remote Sensing Scene Classification Using VLMs and Dual-Cross Attention Networks
by: Cai, Jinjin, et al.
Published: (2024)
by: Cai, Jinjin, et al.
Published: (2024)
Interactive Masked Image Modeling for Multimodal Object Detection in Remote Sensing
by: Vu, Minh-Duc, et al.
Published: (2024)
by: Vu, Minh-Duc, et al.
Published: (2024)
Continual Vision-Language Learning for Remote Sensing: Benchmarking and Analysis
by: Weng, Xingxing, et al.
Published: (2026)
by: Weng, Xingxing, et al.
Published: (2026)
ChessMamba: Structure-Aware Interleaving of State Spaces for Change Detection in Remote Sensing Images
by: Ding, Lei, et al.
Published: (2025)
by: Ding, Lei, et al.
Published: (2025)
Dual Contrastive Network for Few-Shot Remote Sensing Image Scene Classification
by: Ji, Zhong, et al.
Published: (2026)
by: Ji, Zhong, et al.
Published: (2026)
RSMamba: Remote Sensing Image Classification with State Space Model
by: Chen, Keyan, et al.
Published: (2024)
by: Chen, Keyan, et al.
Published: (2024)
Measuring and Mitigating Hallucinations in Vision-Language Dataset Generation for Remote Sensing
by: Anderson, Madeline, et al.
Published: (2025)
by: Anderson, Madeline, et al.
Published: (2025)
RSEdit: Text-Guided Image Editing for Remote Sensing
by: Zhenyuan, Chen, et al.
Published: (2026)
by: Zhenyuan, Chen, et al.
Published: (2026)
FusDreamer: Label-efficient Remote Sensing World Model for Multimodal Data Classification
by: Wang, Jinping, et al.
Published: (2025)
by: Wang, Jinping, et al.
Published: (2025)
Remote Sensing Image Classification with Decoupled Knowledge Distillation
by: He, Yaping, et al.
Published: (2025)
by: He, Yaping, et al.
Published: (2025)
GeoRSMLLM: A Multimodal Large Language Model for Vision-Language Tasks in Geoscience and Remote Sensing
by: Zhang, Zilun, et al.
Published: (2025)
by: Zhang, Zilun, et al.
Published: (2025)
Remote Sensing Image Segmentation Using Vision Mamba and Multi-Scale Multi-Frequency Feature Fusion
by: Cao, Yice, et al.
Published: (2024)
by: Cao, Yice, et al.
Published: (2024)
Multimodal Transformer Using Cross-Channel attention for Object Detection in Remote Sensing Images
by: Bahaduri, Bissmella, et al.
Published: (2023)
by: Bahaduri, Bissmella, et al.
Published: (2023)
Generic Knowledge Boosted Pre-training For Remote Sensing Images
by: Huang, Ziyue, et al.
Published: (2024)
by: Huang, Ziyue, et al.
Published: (2024)
Hard Region Aware Network for Remote Sensing Change Detection
by: Li, Zhenglai, et al.
Published: (2023)
by: Li, Zhenglai, et al.
Published: (2023)
Masked Angle-Aware Autoencoder for Remote Sensing Images
by: Li, Zhihao, et al.
Published: (2024)
by: Li, Zhihao, et al.
Published: (2024)
Similar Items
-
A Spatial-Spectral-Frequency Interactive Network for Multimodal Remote Sensing Classification
by: Liu, Hao, et al.
Published: (2025) -
Multimodal-Aware Fusion Network for Referring Remote Sensing Image Segmentation
by: Shi, Leideng, et al.
Published: (2025) -
Cloud Adversarial Example Generation for Remote Sensing Image Classification
by: Ma, Fei, et al.
Published: (2024) -
Enhancing Remote Sensing Vision-Language Models Through MLLM and LLM-Based High-Quality Image-Text Dataset Generation
by: He, Yiguo, et al.
Published: (2025) -
RemoteTrimmer: Adaptive Structural Pruning for Remote Sensing Image Classification
by: Zou, Guangwenjie, et al.
Published: (2024)