RoMA: Scaling up Mamba-based Foundation Models for Remote Sensing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Fengxiang, Wang, Yulin, Chen, Mingshuo, Zhao, Haiyan, Sun, Yangang, Wang, Shuo, Wang, Hongzhen, Wang, Di, Lan, Long, Yang, Wenjing, Zhang, Jing |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
XLRS-Bench: Could Your Multimodal LLMs Understand Extremely Large Ultra-High-Resolution Remote Sensing Imagery?
par: Wang, Fengxiang, et autres
Publié: (2025)
par: Wang, Fengxiang, et autres
Publié: (2025)
GeoLLaVA-8K: Scaling Remote-Sensing Multimodal Large Language Models to 8K Resolution
par: Wang, Fengxiang, et autres
Publié: (2025)
par: Wang, Fengxiang, et autres
Publié: (2025)
Semantic-Geometric Dual Compression: Training-Free Visual Token Reduction for Ultra-High-Resolution Remote Sensing Understanding
par: Li, Yueying, et autres
Publié: (2026)
par: Li, Yueying, et autres
Publié: (2026)
Text Before Vision: Staged Knowledge Injection Matters for Agentic RLVR in Ultra-High-Resolution Remote Sensing Understanding
par: Wang, Fengxiang, et autres
Publié: (2026)
par: Wang, Fengxiang, et autres
Publié: (2026)
GeoEyes: On-Demand Visual Focusing for Evidence-Grounded Understanding of Ultra-High-Resolution Remote Sensing Imagery
par: Wang, Fengxiang, et autres
Publié: (2026)
par: Wang, Fengxiang, et autres
Publié: (2026)
Harnessing Massive Satellite Imagery with Efficient Masked Image Modeling
par: Wang, Fengxiang, et autres
Publié: (2024)
par: Wang, Fengxiang, et autres
Publié: (2024)
RoMA: Robust Malware Attribution via Byte-level Adversarial Training with Global Perturbations and Adversarial Consistency Regularization
par: Sun, Yuxia, et autres
Publié: (2025)
par: Sun, Yuxia, et autres
Publié: (2025)
UNetMamba: An Efficient UNet-Like Mamba for Semantic Segmentation of High-Resolution Remote Sensing Images
par: Zhu, Enze, et autres
Publié: (2024)
par: Zhu, Enze, et autres
Publié: (2024)
RemoteDet-Mamba: A Hybrid Mamba-CNN Network for Multi-modal Object Detection in Remote Sensing Images
par: Ren, Kejun, et autres
Publié: (2024)
par: Ren, Kejun, et autres
Publié: (2024)
Research progress on highly conductive polymer composites based on carbon‐based nanofillers
par: Lou Guohua, et autres
Publié: (2025)
par: Lou Guohua, et autres
Publié: (2025)
TiMo: Spatiotemporal Foundation Model for Satellite Image Time Series
par: Qin, Xiaolei, et autres
Publié: (2025)
par: Qin, Xiaolei, et autres
Publié: (2025)
Efficient Prompt Tuning of Large Vision-Language Model for Fine-Grained Ship Classification
par: Lan, Long, et autres
Publié: (2024)
par: Lan, Long, et autres
Publié: (2024)
MTP: Advancing Remote Sensing Foundation Model via Multi-Task Pretraining
par: Wang, Di, et autres
Publié: (2024)
par: Wang, Di, et autres
Publié: (2024)
S5: Scalable Semi-Supervised Semantic Segmentation in Remote Sensing
par: Lv, Liang, et autres
Publié: (2025)
par: Lv, Liang, et autres
Publié: (2025)
RS-DFM: A Remote Sensing Distributed Foundation Model for Diverse Downstream Tasks
par: Wang, Zhechao, et autres
Publié: (2024)
par: Wang, Zhechao, et autres
Publié: (2024)
CSFMamba: Cross State Fusion Mamba Operator for Multimodal Remote Sensing Image Classification
par: Wang, Qingyu, et autres
Publié: (2025)
par: Wang, Qingyu, et autres
Publié: (2025)
GeoViS: Geospatially Rewarded Visual Search for Remote Sensing Visual Grounding
par: Zhang, Peirong, et autres
Publié: (2025)
par: Zhang, Peirong, et autres
Publié: (2025)
Attention-Mamba: A Mamba-Enhanced Multi-Scale Parallel Inference Network for Medical Image Segmentation
par: Zhang, Yanhua, et autres
Publié: (2024)
par: Zhang, Yanhua, et autres
Publié: (2024)
Semantic Guided Large Scale Factor Remote Sensing Image Super-resolution with Generative Diffusion Prior
par: Wang, Ce, et autres
Publié: (2024)
par: Wang, Ce, et autres
Publié: (2024)
DehazeMamba: SAR-guided Optical Remote Sensing Image Dehazing with Adaptive State Space Model
par: Zhao, Zhicheng, et autres
Publié: (2025)
par: Zhao, Zhicheng, et autres
Publié: (2025)
Any2Any: Unified Arbitrary Modality Translation for Remote Sensing
par: Chen, Haoyang, et autres
Publié: (2026)
par: Chen, Haoyang, et autres
Publié: (2026)
MambaBEV: An EV-based 3D detection model with Mamba2
par: You, Zihan, et autres
Publié: (2024)
par: You, Zihan, et autres
Publié: (2024)
FUSAR-KLIP: Towards Multimodal Foundation Models for Remote Sensing
par: Yang, Yi, et autres
Publié: (2025)
par: Yang, Yi, et autres
Publié: (2025)
PReD: An LLM-based Foundation Multimodal Model for Electromagnetic Perception, Recognition, and Decision
par: Han, Zehua, et autres
Publié: (2026)
par: Han, Zehua, et autres
Publié: (2026)
From Physics to Foundation Models: A Review of AI-Driven Quantitative Remote Sensing Inversion
par: Yu, Zhenyu, et autres
Publié: (2025)
par: Yu, Zhenyu, et autres
Publié: (2025)
RS-vHeat: Heat Conduction Guided Efficient Remote Sensing Foundation Model
par: Hu, Huiyang, et autres
Publié: (2024)
par: Hu, Huiyang, et autres
Publié: (2024)
VLRS-Bench: A Vision-Language Reasoning Benchmark for Remote Sensing
par: Luo, Zhiming, et autres
Publié: (2026)
par: Luo, Zhiming, et autres
Publié: (2026)
HyperFree: A Channel-adaptive and Tuning-free Foundation Model for Hyperspectral Remote Sensing Imagery
par: Li, Jingtao, et autres
Publié: (2025)
par: Li, Jingtao, et autres
Publié: (2025)
Co-Training Vision Language Models for Remote Sensing Multi-task Learning
par: Li, Qingyun, et autres
Publié: (2025)
par: Li, Qingyun, et autres
Publié: (2025)
Scaling Laws of RoPE-based Extrapolation
par: Liu, Xiaoran, et autres
Publié: (2023)
par: Liu, Xiaoran, et autres
Publié: (2023)
LeMeViT: Efficient Vision Transformer with Learnable Meta Tokens for Remote Sensing Image Interpretation
par: Jiang, Wentao, et autres
Publié: (2024)
par: Jiang, Wentao, et autres
Publié: (2024)
RoCo:Robust Collaborative Perception By Iterative Object Matching and Pose Adjustment
par: Huang, Zhe, et autres
Publié: (2024)
par: Huang, Zhe, et autres
Publié: (2024)
DMM: Disparity-guided Multispectral Mamba for Oriented Object Detection in Remote Sensing
par: Zhou, Minghang, et autres
Publié: (2024)
par: Zhou, Minghang, et autres
Publié: (2024)
MALoRA: Mixture of Asymmetric Low-Rank Adaptation for Enhanced Multi-Task Learning
par: Wang, Xujia, et autres
Publié: (2024)
par: Wang, Xujia, et autres
Publié: (2024)
Treat Stillness with Movement: Remote Sensing Change Detection via Coarse-grained Temporal Foregrounds Mining
par: Wang, Xixi, et autres
Publié: (2024)
par: Wang, Xixi, et autres
Publié: (2024)
MMO-IG: Multi-Class and Multi-Scale Object Image Generation for Remote Sensing
par: Yang, Chuang, et autres
Publié: (2024)
par: Yang, Chuang, et autres
Publié: (2024)
CloudMamba: An Uncertainty-Guided Dual-Scale Mamba Network for Cloud Detection in Remote Sensing Imagery
par: Yang, Jiajun, et autres
Publié: (2026)
par: Yang, Jiajun, et autres
Publié: (2026)
Semantic Localization Guiding Segment Anything Model For Reference Remote Sensing Image Segmentation
par: Li, Shuyang, et autres
Publié: (2025)
par: Li, Shuyang, et autres
Publié: (2025)
Effect of Latex Concentration on the Structure and Properties of Natural Rubber
par: Qinglong Qu, et autres
Publié: (2026)
par: Qinglong Qu, et autres
Publié: (2026)
OmniEarth-Bench: Towards Holistic Evaluation of Earth's Six Spheres and Cross-Spheres Interactions with Multimodal Observational Earth Data
par: Wang, Fengxiang, et autres
Publié: (2025)
par: Wang, Fengxiang, et autres
Publié: (2025)
Documents similaires
-
XLRS-Bench: Could Your Multimodal LLMs Understand Extremely Large Ultra-High-Resolution Remote Sensing Imagery?
par: Wang, Fengxiang, et autres
Publié: (2025) -
GeoLLaVA-8K: Scaling Remote-Sensing Multimodal Large Language Models to 8K Resolution
par: Wang, Fengxiang, et autres
Publié: (2025) -
Semantic-Geometric Dual Compression: Training-Free Visual Token Reduction for Ultra-High-Resolution Remote Sensing Understanding
par: Li, Yueying, et autres
Publié: (2026) -
Text Before Vision: Staged Knowledge Injection Matters for Agentic RLVR in Ultra-High-Resolution Remote Sensing Understanding
par: Wang, Fengxiang, et autres
Publié: (2026) -
GeoEyes: On-Demand Visual Focusing for Evidence-Grounded Understanding of Ultra-High-Resolution Remote Sensing Imagery
par: Wang, Fengxiang, et autres
Publié: (2026)