RSGround-R1: Rethinking Remote Sensing Visual Grounding through Spatial Reasoning
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Shiqi, He, Shuting, Wen, Bihan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ZoRI: Towards Discriminative Zero-Shot Remote Sensing Instance Segmentation
por: Huang, Shiqi, et al.
Publicado: (2024)
por: Huang, Shiqi, et al.
Publicado: (2024)
SCORE: Scene Context Matters in Open-Vocabulary Remote Sensing Instance Segmentation
por: Huang, Shiqi, et al.
Publicado: (2025)
por: Huang, Shiqi, et al.
Publicado: (2025)
GroundFlow: A Plug-in Module for Temporal Reasoning on 3D Point Cloud Sequential Grounding
por: Lin, Zijun, et al.
Publicado: (2025)
por: Lin, Zijun, et al.
Publicado: (2025)
SATGround: A Spatially-Aware Approach for Visual Grounding in Remote Sensing
por: Toker, Aysim, et al.
Publicado: (2025)
por: Toker, Aysim, et al.
Publicado: (2025)
WBCAtt+: Fine-Grained Pixel-Level Morphological Annotations for White Blood Cell Images
por: Tsutsui, Satoshi, et al.
Publicado: (2026)
por: Tsutsui, Satoshi, et al.
Publicado: (2026)
SegPoint: Segment Any Point Cloud via Large Language Model
por: He, Shuting, et al.
Publicado: (2024)
por: He, Shuting, et al.
Publicado: (2024)
On the Adversarial Vulnerabilities of Transfer Learning in Remote Sensing
por: Bai, Tao, et al.
Publicado: (2025)
por: Bai, Tao, et al.
Publicado: (2025)
Think and Answer ME: Benchmarking and Exploring Multi-Entity Reasoning Grounding in Remote Sensing
por: Lyu, Shuchang, et al.
Publicado: (2026)
por: Lyu, Shuchang, et al.
Publicado: (2026)
GeoViS: Geospatially Rewarded Visual Search for Remote Sensing Visual Grounding
por: Zhang, Peirong, et al.
Publicado: (2025)
por: Zhang, Peirong, et al.
Publicado: (2025)
Towards Faithful Reasoning in Remote Sensing: A Perceptually-Grounded GeoSpatial Chain-of-Thought for Vision-Language Models
por: Liu, Jiaqi, et al.
Publicado: (2025)
por: Liu, Jiaqi, et al.
Publicado: (2025)
Efficient Adaptation For Remote Sensing Visual Grounding
por: Moughnieh, Hasan, et al.
Publicado: (2025)
por: Moughnieh, Hasan, et al.
Publicado: (2025)
GeoGround: A Unified Large Vision-Language Model for Remote Sensing Visual Grounding
por: Zhou, Yue, et al.
Publicado: (2024)
por: Zhou, Yue, et al.
Publicado: (2024)
Ground-R1: Incentivizing Grounded Visual Reasoning via Reinforcement Learning
por: Cao, Meng, et al.
Publicado: (2025)
por: Cao, Meng, et al.
Publicado: (2025)
EvoVid: Temporal-Centric Self-Evolution for Video Large Language Models
por: Huang, Shiqi, et al.
Publicado: (2026)
por: Huang, Shiqi, et al.
Publicado: (2026)
GeoVLM-R1: Reinforcement Fine-Tuning for Improved Remote Sensing Reasoning
por: Fiaz, Mustansar, et al.
Publicado: (2025)
por: Fiaz, Mustansar, et al.
Publicado: (2025)
ProVG: Progressive Visual Grounding via Language Decoupling for Remote Sensing Imagery
por: Li, Ke, et al.
Publicado: (2026)
por: Li, Ke, et al.
Publicado: (2026)
GeoVista: Visually Grounded Active Perception for Ultra-High-Resolution Remote Sensing Understanding
por: Zhu, Jiashun, et al.
Publicado: (2026)
por: Zhu, Jiashun, et al.
Publicado: (2026)
Improving Visual Grounding in Remote Sensing via Cluster-Guided Refinement and Model Ensemble Voting
por: Shah, Panav, et al.
Publicado: (2026)
por: Shah, Panav, et al.
Publicado: (2026)
MO R-CNN: Multispectral Oriented R-CNN for Object Detection in Remote Sensing Image
por: Wang, Leiyu, et al.
Publicado: (2025)
por: Wang, Leiyu, et al.
Publicado: (2025)
Rethinking Remote Sensing Change Detection With A Mask View
por: Ma, Xiaowen, et al.
Publicado: (2024)
por: Ma, Xiaowen, et al.
Publicado: (2024)
Learning GUI Grounding with Spatial Reasoning from Visual Feedback
por: Zhao, Yu, et al.
Publicado: (2025)
por: Zhao, Yu, et al.
Publicado: (2025)
SkyNative: A Native Multimodal Framework for Remote Sensing Visual Evidence Reasoning
por: Yang, Xiao, et al.
Publicado: (2026)
por: Yang, Xiao, et al.
Publicado: (2026)
HSI-VAR: Rethinking Hyperspectral Restoration through Spatial-Spectral Visual Autoregression
por: Wang, Xiangming, et al.
Publicado: (2026)
por: Wang, Xiangming, et al.
Publicado: (2026)
UniVG-R1: Reasoning Guided Universal Visual Grounding with Reinforcement Learning
por: Bai, Sule, et al.
Publicado: (2025)
por: Bai, Sule, et al.
Publicado: (2025)
Rethinking the Key Factors for the Generalization of Remote Sensing Stereo Matching Networks
por: Jiang, Liting, et al.
Publicado: (2024)
por: Jiang, Liting, et al.
Publicado: (2024)
Rethinking Efficient Mixture-of-Experts for Remote Sensing Modality-Missing Classification
por: Gao, Qinghao, et al.
Publicado: (2025)
por: Gao, Qinghao, et al.
Publicado: (2025)
Remote Sensing ChatGPT: Solving Remote Sensing Tasks with ChatGPT and Visual Models
por: Guo, Haonan, et al.
Publicado: (2024)
por: Guo, Haonan, et al.
Publicado: (2024)
MB-ORES: A Multi-Branch Object Reasoner for Visual Grounding in Remote Sensing
por: Radouane, Karim, et al.
Publicado: (2025)
por: Radouane, Karim, et al.
Publicado: (2025)
EarthGPT-X: A Spatial MLLM for Multi-level Multi-Source Remote Sensing Imagery Understanding with Visual Prompting
por: Zhang, Wei, et al.
Publicado: (2025)
por: Zhang, Wei, et al.
Publicado: (2025)
RemoteVAR: Autoregressive Visual Modeling for Remote Sensing Change Detection
por: Korkmaz, Yilmaz, et al.
Publicado: (2026)
por: Korkmaz, Yilmaz, et al.
Publicado: (2026)
Spa3R: Predictive Spatial Field Modeling for 3D Visual Reasoning
por: Jiang, Haoyi, et al.
Publicado: (2026)
por: Jiang, Haoyi, et al.
Publicado: (2026)
LWGANet: Addressing Spatial and Channel Redundancy in Remote Sensing Visual Tasks with Light-Weight Grouped Attention
por: Lu, Wei, et al.
Publicado: (2025)
por: Lu, Wei, et al.
Publicado: (2025)
HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation
por: Lin, Weihuang, et al.
Publicado: (2025)
por: Lin, Weihuang, et al.
Publicado: (2025)
GeoPixel: Pixel Grounding Large Multimodal Model in Remote Sensing
por: Shabbir, Akashah, et al.
Publicado: (2025)
por: Shabbir, Akashah, et al.
Publicado: (2025)
L-UNet: An LSTM Network for Remote Sensing Image Change Detection
por: Sun, Shuting, et al.
Publicado: (2026)
por: Sun, Shuting, et al.
Publicado: (2026)
SpatialRGPT: Grounded Spatial Reasoning in Vision Language Models
por: Cheng, An-Chieh, et al.
Publicado: (2024)
por: Cheng, An-Chieh, et al.
Publicado: (2024)
SPAZER: Spatial-Semantic Progressive Reasoning Agent for Zero-shot 3D Visual Grounding
por: Jin, Zhao, et al.
Publicado: (2025)
por: Jin, Zhao, et al.
Publicado: (2025)
SpatialBoost: Enhancing Visual Representation through Language-Guided Reasoning
por: Jeon, Byungwoo, et al.
Publicado: (2026)
por: Jeon, Byungwoo, et al.
Publicado: (2026)
OptiSAR-Net++: A Large-Scale Benchmark and Transformer-Free Framework for Cross-Domain Remote Sensing Visual Grounding
por: Tang, Xiaoyu, et al.
Publicado: (2026)
por: Tang, Xiaoyu, et al.
Publicado: (2026)
SegChange-R1: LLM-Augmented Remote Sensing Change Detection
por: Zhou, Fei
Publicado: (2025)
por: Zhou, Fei
Publicado: (2025)
Ejemplares similares
-
ZoRI: Towards Discriminative Zero-Shot Remote Sensing Instance Segmentation
por: Huang, Shiqi, et al.
Publicado: (2024) -
SCORE: Scene Context Matters in Open-Vocabulary Remote Sensing Instance Segmentation
por: Huang, Shiqi, et al.
Publicado: (2025) -
GroundFlow: A Plug-in Module for Temporal Reasoning on 3D Point Cloud Sequential Grounding
por: Lin, Zijun, et al.
Publicado: (2025) -
SATGround: A Spatially-Aware Approach for Visual Grounding in Remote Sensing
por: Toker, Aysim, et al.
Publicado: (2025) -
WBCAtt+: Fine-Grained Pixel-Level Morphological Annotations for White Blood Cell Images
por: Tsutsui, Satoshi, et al.
Publicado: (2026)