TinyRS-R1: Compact Multimodal Language Model for Remote Sensing
Fuente:
arXiv
Saved in:
| Main Authors: | Koksal, Aybora, Alatan, A. Aydin |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
SAMChat: Introducing Chain of Thought Reasoning and GRPO to a Multimodal Small Language Model for Small Scale Remote Sensing
by: Koksal, Aybora, et al.
Published: (2025)
by: Koksal, Aybora, et al.
Published: (2025)
Few-Shot Vision-Language Reasoning for Satellite Imagery via Verifiable Rewards
by: Koksal, Aybora, et al.
Published: (2025)
by: Koksal, Aybora, et al.
Published: (2025)
XoFTR: Cross-modal Feature Matching Transformer
by: Tuzcuoğlu, Önder, et al.
Published: (2024)
by: Tuzcuoğlu, Önder, et al.
Published: (2024)
IG-SLAM: Instant Gaussian SLAM
by: Sarikamis, F. Aykut, et al.
Published: (2024)
by: Sarikamis, F. Aykut, et al.
Published: (2024)
Causal Transformer for Fusion and Pose Estimation in Deep Visual Inertial Odometry
by: Kurt, Yunus Bilge, et al.
Published: (2024)
by: Kurt, Yunus Bilge, et al.
Published: (2024)
RS-TinyNet: Stage-wise Feature Fusion Network for Detecting Tiny Objects in Remote Sensing Images
by: Jiang, Xiaozheng, et al.
Published: (2025)
by: Jiang, Xiaozheng, et al.
Published: (2025)
UniRS: Unifying Multi-temporal Remote Sensing Tasks through Vision Language Models
by: Li, Yujie, et al.
Published: (2024)
by: Li, Yujie, et al.
Published: (2024)
MDE-VIO: Enhancing Visual-Inertial Odometry Using Learned Depth Priors
by: Alniak, Arda, et al.
Published: (2026)
by: Alniak, Arda, et al.
Published: (2026)
Bridging the Scale Gap: Balanced Tiny and General Object Detection in Remote Sensing Imagery
by: Zhao, Zhicheng, et al.
Published: (2025)
by: Zhao, Zhicheng, et al.
Published: (2025)
YOLO-RS: Remote Sensing Enhanced Crop Detection Methods
by: Xiao, Linlin, et al.
Published: (2025)
by: Xiao, Linlin, et al.
Published: (2025)
RS-OVC: Open-Vocabulary Counting for Remote-Sensing Data
by: Shor, Tamir, et al.
Published: (2026)
by: Shor, Tamir, et al.
Published: (2026)
RS-Mamba for Large Remote Sensing Image Dense Prediction
by: Zhao, Sijie, et al.
Published: (2024)
by: Zhao, Sijie, et al.
Published: (2024)
RS-OOD: A Vision-Language Augmented Framework for Out-of-Distribution Detection in Remote Sensing
by: Wang, Chenhao, et al.
Published: (2025)
by: Wang, Chenhao, et al.
Published: (2025)
RS-vHeat: Heat Conduction Guided Efficient Remote Sensing Foundation Model
by: Hu, Huiyang, et al.
Published: (2024)
by: Hu, Huiyang, et al.
Published: (2024)
RS-DFM: A Remote Sensing Distributed Foundation Model for Diverse Downstream Tasks
by: Wang, Zhechao, et al.
Published: (2024)
by: Wang, Zhechao, et al.
Published: (2024)
LHRS-Bot-Nova: Improved Multimodal Large Language Model for Remote Sensing Vision-Language Interpretation
by: Li, Zhenshi, et al.
Published: (2024)
by: Li, Zhenshi, et al.
Published: (2024)
FUSAR-KLIP: Towards Multimodal Foundation Models for Remote Sensing
by: Yang, Yi, et al.
Published: (2025)
by: Yang, Yi, et al.
Published: (2025)
BTCChat: Advancing Remote Sensing Bi-temporal Change Captioning with Multimodal Large Language Model
by: Li, Yujie, et al.
Published: (2025)
by: Li, Yujie, et al.
Published: (2025)
Decoding the Delta: Unifying Remote Sensing Change Detection and Understanding with Multimodal Large Language Models
by: Li, Xiaohe, et al.
Published: (2026)
by: Li, Xiaohe, et al.
Published: (2026)
RS-Agent: Automating Remote Sensing Tasks through Intelligent Agent
by: Xu, Wenjia, et al.
Published: (2024)
by: Xu, Wenjia, et al.
Published: (2024)
RemoteCLIP: A Vision Language Foundation Model for Remote Sensing
by: Liu, Fan, et al.
Published: (2023)
by: Liu, Fan, et al.
Published: (2023)
RS3Mamba: Visual State Space Model for Remote Sensing Images Semantic Segmentation
by: Ma, Xianping, et al.
Published: (2024)
by: Ma, Xianping, et al.
Published: (2024)
GeoPixel: Pixel Grounding Large Multimodal Model in Remote Sensing
by: Shabbir, Akashah, et al.
Published: (2025)
by: Shabbir, Akashah, et al.
Published: (2025)
A Survey on Remote Sensing Foundation Models: From Vision to Multimodality
by: Huang, Ziyue, et al.
Published: (2025)
by: Huang, Ziyue, et al.
Published: (2025)
Interactive Masked Image Modeling for Multimodal Object Detection in Remote Sensing
by: Vu, Minh-Duc, et al.
Published: (2024)
by: Vu, Minh-Duc, et al.
Published: (2024)
CDChat: A Large Multimodal Model for Remote Sensing Change Description
by: Noman, Mubashir, et al.
Published: (2024)
by: Noman, Mubashir, et al.
Published: (2024)
InfRS: Incremental Few-Shot Object Detection in Remote Sensing Images
by: Li, Wuzhou, et al.
Published: (2024)
by: Li, Wuzhou, et al.
Published: (2024)
FLAVARS: A Multimodal Foundational Language and Vision Alignment Model for Remote Sensing
by: Corley, Isaac, et al.
Published: (2025)
by: Corley, Isaac, et al.
Published: (2025)
Frequency-Aware Vision-Language Multimodality Generalization Network for Remote Sensing Image Classification
by: Zhang, Junjie, et al.
Published: (2025)
by: Zhang, Junjie, et al.
Published: (2025)
MapGlue: Multimodal Remote Sensing Image Matching
by: Wu, Peihao, et al.
Published: (2025)
by: Wu, Peihao, et al.
Published: (2025)
RS-Prune: Training-Free Data Pruning at High Ratios for Efficient Remote Sensing Diffusion Foundation Models
by: Wei, Fan, et al.
Published: (2025)
by: Wei, Fan, et al.
Published: (2025)
Large Language Models for Captioning and Retrieving Remote Sensing Images
by: Silva, João Daniel, et al.
Published: (2024)
by: Silva, João Daniel, et al.
Published: (2024)
Vision-Language Modeling Meets Remote Sensing: Models, Datasets and Perspectives
by: Weng, Xingxing, et al.
Published: (2025)
by: Weng, Xingxing, et al.
Published: (2025)
RS-GPT4V: A Unified Multimodal Instruction-Following Dataset for Remote Sensing Image Understanding
by: Xu, Linrui, et al.
Published: (2024)
by: Xu, Linrui, et al.
Published: (2024)
GeoLLaVA-8K: Scaling Remote-Sensing Multimodal Large Language Models to 8K Resolution
by: Wang, Fengxiang, et al.
Published: (2025)
by: Wang, Fengxiang, et al.
Published: (2025)
MONITRS: Multimodal Observations of Natural Incidents Through Remote Sensing
by: Revankar, Shreelekha, et al.
Published: (2025)
by: Revankar, Shreelekha, et al.
Published: (2025)
Balanced Diffusion-Guided Fusion for Multimodal Remote Sensing Classification
by: Liu, Hao, et al.
Published: (2025)
by: Liu, Hao, et al.
Published: (2025)
FusDreamer: Label-efficient Remote Sensing World Model for Multimodal Data Classification
by: Wang, Jinping, et al.
Published: (2025)
by: Wang, Jinping, et al.
Published: (2025)
SegChange-R1: LLM-Augmented Remote Sensing Change Detection
by: Zhou, Fei
Published: (2025)
by: Zhou, Fei
Published: (2025)
RS-YOLOX: A High Precision Detector for Object Detection in Satellite Remote Sensing Images
by: Yang, Lei, et al.
Published: (2025)
by: Yang, Lei, et al.
Published: (2025)
Similar Items
-
SAMChat: Introducing Chain of Thought Reasoning and GRPO to a Multimodal Small Language Model for Small Scale Remote Sensing
by: Koksal, Aybora, et al.
Published: (2025) -
Few-Shot Vision-Language Reasoning for Satellite Imagery via Verifiable Rewards
by: Koksal, Aybora, et al.
Published: (2025) -
XoFTR: Cross-modal Feature Matching Transformer
by: Tuzcuoğlu, Önder, et al.
Published: (2024) -
IG-SLAM: Instant Gaussian SLAM
by: Sarikamis, F. Aykut, et al.
Published: (2024) -
Causal Transformer for Fusion and Pose Estimation in Deep Visual Inertial Odometry
by: Kurt, Yunus Bilge, et al.
Published: (2024)