RSRWKV: A Linear-Complexity 2D Attention Mechanism for Efficient Remote Sensing Vision Task
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Chunshan, Wang, Rong, Yang, Xiaofei, Chu, Dianhui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
An Efficient and Effective Encoder Model for Vision and Language Tasks in the Remote Sensing Domain
por: Silva, João Daniel, et al.
Publicado: (2025)
por: Silva, João Daniel, et al.
Publicado: (2025)
Falcon: A Remote Sensing Vision-Language Foundation Model (Technical Report)
por: Yao, Kelu, et al.
Publicado: (2025)
por: Yao, Kelu, et al.
Publicado: (2025)
UniRS: Unifying Multi-temporal Remote Sensing Tasks through Vision Language Models
por: Li, Yujie, et al.
Publicado: (2024)
por: Li, Yujie, et al.
Publicado: (2024)
SatelliteCalculator: A Multi-Task Vision Foundation Model for Quantitative Remote Sensing Inversion
por: Yu, Zhenyu, et al.
Publicado: (2025)
por: Yu, Zhenyu, et al.
Publicado: (2025)
LWGANet: Addressing Spatial and Channel Redundancy in Remote Sensing Visual Tasks with Light-Weight Grouped Attention
por: Lu, Wei, et al.
Publicado: (2025)
por: Lu, Wei, et al.
Publicado: (2025)
Contributions to Label-Efficient Learning in Computer Vision and Remote Sensing
por: Pham, Minh-Tan
Publicado: (2025)
por: Pham, Minh-Tan
Publicado: (2025)
Remote Sensing ChatGPT: Solving Remote Sensing Tasks with ChatGPT and Visual Models
por: Guo, Haonan, et al.
Publicado: (2024)
por: Guo, Haonan, et al.
Publicado: (2024)
Diffusion-RSCC: Diffusion Probabilistic Model for Change Captioning in Remote Sensing Images
por: Yu, Xiaofei, et al.
Publicado: (2024)
por: Yu, Xiaofei, et al.
Publicado: (2024)
NeXt2Former-CD: Efficient Remote Sensing Change Detection with Modern Vision Architectures
por: Wang, Yufan, et al.
Publicado: (2026)
por: Wang, Yufan, et al.
Publicado: (2026)
Spiking Meets Attention: Efficient Remote Sensing Image Super-Resolution with Attention Spiking Neural Networks
por: Xiao, Yi, et al.
Publicado: (2025)
por: Xiao, Yi, et al.
Publicado: (2025)
RemoteCLIP: A Vision Language Foundation Model for Remote Sensing
por: Liu, Fan, et al.
Publicado: (2023)
por: Liu, Fan, et al.
Publicado: (2023)
AMMUNet: Multi-Scale Attention Map Merging for Remote Sensing Image Segmentation
por: Yang, Yang, et al.
Publicado: (2024)
por: Yang, Yang, et al.
Publicado: (2024)
SkyEyeGPT: Unifying Remote Sensing Vision-Language Tasks via Instruction Tuning with Large Language Model
por: Zhan, Yang, et al.
Publicado: (2024)
por: Zhan, Yang, et al.
Publicado: (2024)
VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis
por: Yin, Shicheng, et al.
Publicado: (2024)
por: Yin, Shicheng, et al.
Publicado: (2024)
A Survey of Sample-Efficient Deep Learning for Change Detection in Remote Sensing: Tasks, Strategies, and Challenges
por: Ding, Lei, et al.
Publicado: (2025)
por: Ding, Lei, et al.
Publicado: (2025)
Multi-Task Domain Adaptation for Language Grounding with 3D Objects
por: Sun, Penglei, et al.
Publicado: (2024)
por: Sun, Penglei, et al.
Publicado: (2024)
A Survey on Remote Sensing Foundation Models: From Vision to Multimodality
por: Huang, Ziyue, et al.
Publicado: (2025)
por: Huang, Ziyue, et al.
Publicado: (2025)
RS-DFM: A Remote Sensing Distributed Foundation Model for Diverse Downstream Tasks
por: Wang, Zhechao, et al.
Publicado: (2024)
por: Wang, Zhechao, et al.
Publicado: (2024)
PeftCD: Leveraging Vision Foundation Models with Parameter-Efficient Fine-Tuning for Remote Sensing Change Detection
por: Dong, Sijun, et al.
Publicado: (2025)
por: Dong, Sijun, et al.
Publicado: (2025)
Deformable Attention Mechanisms Applied to Object Detection, case of Remote Sensing
por: Boutayeb, Anasse, et al.
Publicado: (2025)
por: Boutayeb, Anasse, et al.
Publicado: (2025)
Co-Training Vision Language Models for Remote Sensing Multi-task Learning
por: Li, Qingyun, et al.
Publicado: (2025)
por: Li, Qingyun, et al.
Publicado: (2025)
RS-Agent: Automating Remote Sensing Tasks through Intelligent Agent
por: Xu, Wenjia, et al.
Publicado: (2024)
por: Xu, Wenjia, et al.
Publicado: (2024)
LeMeViT: Efficient Vision Transformer with Learnable Meta Tokens for Remote Sensing Image Interpretation
por: Jiang, Wentao, et al.
Publicado: (2024)
por: Jiang, Wentao, et al.
Publicado: (2024)
A Benchmark for Multi-Lingual Vision-Language Learning in Remote Sensing Image Captioning
por: Zhou, Qing, et al.
Publicado: (2025)
por: Zhou, Qing, et al.
Publicado: (2025)
FUSE-RSVLM: Feature Fusion Vision-Language Model for Remote Sensing
por: Dang, Yunkai, et al.
Publicado: (2025)
por: Dang, Yunkai, et al.
Publicado: (2025)
Task Specific Pretraining with Noisy Labels for Remote Sensing Image Segmentation
por: Liu, Chenying, et al.
Publicado: (2024)
por: Liu, Chenying, et al.
Publicado: (2024)
GeoGround: A Unified Large Vision-Language Model for Remote Sensing Visual Grounding
por: Zhou, Yue, et al.
Publicado: (2024)
por: Zhou, Yue, et al.
Publicado: (2024)
Continual Vision-Language Learning for Remote Sensing: Benchmarking and Analysis
por: Weng, Xingxing, et al.
Publicado: (2026)
por: Weng, Xingxing, et al.
Publicado: (2026)
Interactive Multi-Head Self-Attention with Linear Complexity
por: Kang, Hankyul, et al.
Publicado: (2024)
por: Kang, Hankyul, et al.
Publicado: (2024)
Threshold Attention Network for Semantic Segmentation of Remote Sensing Images
por: Long, Wei, et al.
Publicado: (2025)
por: Long, Wei, et al.
Publicado: (2025)
RS2-SAM2: Customized SAM2 for Referring Remote Sensing Image Segmentation
por: Rong, Fu, et al.
Publicado: (2025)
por: Rong, Fu, et al.
Publicado: (2025)
VHM: Versatile and Honest Vision Language Model for Remote Sensing Image Analysis
por: Pang, Chao, et al.
Publicado: (2024)
por: Pang, Chao, et al.
Publicado: (2024)
Demystify Mamba in Vision: A Linear Attention Perspective
por: Han, Dongchen, et al.
Publicado: (2024)
por: Han, Dongchen, et al.
Publicado: (2024)
Remote Sensing SpatioTemporal Vision-Language Models: A Comprehensive Survey
por: Liu, Chenyang, et al.
Publicado: (2024)
por: Liu, Chenyang, et al.
Publicado: (2024)
Multimodal Remote Sensing Scene Classification Using VLMs and Dual-Cross Attention Networks
por: Cai, Jinjin, et al.
Publicado: (2024)
por: Cai, Jinjin, et al.
Publicado: (2024)
Adapting Vision Foundation Models for Robust Cloud Segmentation in Remote Sensing Images
por: Zou, Xuechao, et al.
Publicado: (2024)
por: Zou, Xuechao, et al.
Publicado: (2024)
CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning
por: Kiruluta, Andrew, et al.
Publicado: (2025)
por: Kiruluta, Andrew, et al.
Publicado: (2025)
LinearSR: Unlocking Linear Attention for Stable and Efficient Image Super-Resolution
por: Li, Xiaohui, et al.
Publicado: (2025)
por: Li, Xiaohui, et al.
Publicado: (2025)
EagleVision: Object-level Attribute Multimodal LLM for Remote Sensing
por: Jiang, Hongxiang, et al.
Publicado: (2025)
por: Jiang, Hongxiang, et al.
Publicado: (2025)
Vision Mamba in Remote Sensing: A Comprehensive Survey of Techniques, Applications and Outlook
por: Bao, Muyi, et al.
Publicado: (2025)
por: Bao, Muyi, et al.
Publicado: (2025)
Ejemplares similares
-
An Efficient and Effective Encoder Model for Vision and Language Tasks in the Remote Sensing Domain
por: Silva, João Daniel, et al.
Publicado: (2025) -
Falcon: A Remote Sensing Vision-Language Foundation Model (Technical Report)
por: Yao, Kelu, et al.
Publicado: (2025) -
UniRS: Unifying Multi-temporal Remote Sensing Tasks through Vision Language Models
por: Li, Yujie, et al.
Publicado: (2024) -
SatelliteCalculator: A Multi-Task Vision Foundation Model for Quantitative Remote Sensing Inversion
por: Yu, Zhenyu, et al.
Publicado: (2025) -
LWGANet: Addressing Spatial and Channel Redundancy in Remote Sensing Visual Tasks with Light-Weight Grouped Attention
por: Lu, Wei, et al.
Publicado: (2025)