GeoSolver: Scaling Test-Time Reasoning in Remote Sensing with Fine-Grained Process Supervision
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Lang, Fu, Ronghao, Duan, Zhuoran, Liu, Haoran, Liu, Xueyan, Yang, Bo |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GeoAlignCLIP: Enhancing Fine-Grained Vision-Language Alignment in Remote Sensing via Multi-Granular Consistency Learning
par: Yang, Xiao, et autres
Publié: (2026)
par: Yang, Xiao, et autres
Publié: (2026)
Towards Faithful Reasoning in Remote Sensing: A Perceptually-Grounded GeoSpatial Chain-of-Thought for Vision-Language Models
par: Liu, Jiaqi, et autres
Publié: (2025)
par: Liu, Jiaqi, et autres
Publié: (2025)
SkyNative: A Native Multimodal Framework for Remote Sensing Visual Evidence Reasoning
par: Yang, Xiao, et autres
Publié: (2026)
par: Yang, Xiao, et autres
Publié: (2026)
GeoDiT: A Diffusion-based Vision-Language Model for Geospatial Understanding
par: Liu, Jiaqi, et autres
Publié: (2025)
par: Liu, Jiaqi, et autres
Publié: (2025)
SkyMoE: A Vision-Language Foundation Model for Enhancing Geospatial Interpretation with Mixture of Experts
par: Liu, Jiaqi, et autres
Publié: (2025)
par: Liu, Jiaqi, et autres
Publié: (2025)
GeoVista: Visually Grounded Active Perception for Ultra-High-Resolution Remote Sensing Understanding
par: Zhu, Jiashun, et autres
Publié: (2026)
par: Zhu, Jiashun, et autres
Publié: (2026)
RescueADI: Adaptive Disaster Interpretation in Remote Sensing Images with Autonomous Agents
par: Liu, Zhuoran, et autres
Publié: (2024)
par: Liu, Zhuoran, et autres
Publié: (2024)
Knowledge Transfer and Domain Adaptation for Fine-Grained Remote Sensing Image Segmentation
par: Zhang, Shun, et autres
Publié: (2024)
par: Zhang, Shun, et autres
Publié: (2024)
Panoptic Perception: A Novel Task and Fine-grained Dataset for Universal Remote Sensing Image Interpretation
par: Zhao, Danpei, et autres
Publié: (2024)
par: Zhao, Danpei, et autres
Publié: (2024)
GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing
par: Ma, Xianzhi, et autres
Publié: (2025)
par: Ma, Xianzhi, et autres
Publié: (2025)
Continual Panoptic Perception: Towards Multi-modal Incremental Interpretation of Remote Sensing Images
par: Yuan, Bo, et autres
Publié: (2024)
par: Yuan, Bo, et autres
Publié: (2024)
MEET: A Million-Scale Dataset for Fine-Grained Geospatial Scene Classification with Zoom-Free Remote Sensing Imagery
par: Li, Yansheng, et autres
Publié: (2025)
par: Li, Yansheng, et autres
Publié: (2025)
A Large-Scale Remote Sensing Dataset and VLM-based Algorithm for Fine-Grained Road Hierarchy Classification
par: Han, Ting, et autres
Publié: (2026)
par: Han, Ting, et autres
Publié: (2026)
GeoVLM-R1: Reinforcement Fine-Tuning for Improved Remote Sensing Reasoning
par: Fiaz, Mustansar, et autres
Publié: (2025)
par: Fiaz, Mustansar, et autres
Publié: (2025)
Fine-Grained Spatiotemporal Motion Alignment for Contrastive Video Representation Learning
par: Zhu, Minghao, et autres
Publié: (2023)
par: Zhu, Minghao, et autres
Publié: (2023)
OpenEarthSensing: Large-Scale Fine-Grained Benchmark for Open-World Remote Sensing
par: Xiang, Xiang, et autres
Publié: (2025)
par: Xiang, Xiang, et autres
Publié: (2025)
CADFormer: Fine-Grained Cross-modal Alignment and Decoding Transformer for Referring Remote Sensing Image Segmentation
par: Liu, Maofu, et autres
Publié: (2025)
par: Liu, Maofu, et autres
Publié: (2025)
OmniEarth: A Benchmark for Evaluating Vision-Language Models in Geospatial Tasks
par: Fu, Ronghao, et autres
Publié: (2026)
par: Fu, Ronghao, et autres
Publié: (2026)
Hierarchical Semi-Supervised Active Learning for Remote Sensing
par: Huang, Wei, et autres
Publié: (2025)
par: Huang, Wei, et autres
Publié: (2025)
Leveraging Fine-Grained Information and Noise Decoupling for Remote Sensing Change Detection
par: Du, Qiangang, et autres
Publié: (2024)
par: Du, Qiangang, et autres
Publié: (2024)
SkySenseGPT: A Fine-Grained Instruction Tuning Dataset and Model for Remote Sensing Vision-Language Understanding
par: Luo, Junwei, et autres
Publié: (2024)
par: Luo, Junwei, et autres
Publié: (2024)
Small but Mighty: Dynamic Wavelet Expert-Guided Fine-Tuning of Large-Scale Models for Optical Remote Sensing Object Segmentation
par: Sun, Yanguang, et autres
Publié: (2026)
par: Sun, Yanguang, et autres
Publié: (2026)
FarSLIP: Discovering Effective CLIP Adaptation for Fine-Grained Remote Sensing Understanding
par: Li, Zhenshi, et autres
Publié: (2025)
par: Li, Zhenshi, et autres
Publié: (2025)
Exploring Fine-Grained Image-Text Alignment for Referring Remote Sensing Image Segmentation
par: Lei, Sen, et autres
Publié: (2024)
par: Lei, Sen, et autres
Publié: (2024)
Boosting Semi-Supervised Object Detection in Remote Sensing Images With Active Teaching
par: Zhang, Boxuan, et autres
Publié: (2024)
par: Zhang, Boxuan, et autres
Publié: (2024)
EarthView: A Large Scale Remote Sensing Dataset for Self-Supervision
par: Velazquez, Diego, et autres
Publié: (2025)
par: Velazquez, Diego, et autres
Publié: (2025)
An LLM-LVLM Driven Agent for Iterative and Fine-Grained Image Editing
par: Liang, Zihan, et autres
Publié: (2025)
par: Liang, Zihan, et autres
Publié: (2025)
A Unified Framework with Multimodal Fine-tuning for Remote Sensing Semantic Segmentation
par: Ma, Xianping, et autres
Publié: (2024)
par: Ma, Xianping, et autres
Publié: (2024)
MFDS-Net: Multi-Scale Feature Depth-Supervised Network for Remote Sensing Change Detection with Global Semantic and Detail Information
par: Huang, Zhenyang, et autres
Publié: (2024)
par: Huang, Zhenyang, et autres
Publié: (2024)
ReasonAct: Progressive Training for Fine-Grained Video Reasoning in Small Models
par: Liu, Jiaxin, et autres
Publié: (2025)
par: Liu, Jiaxin, et autres
Publié: (2025)
Visual Reasoning Agent: Robust Vision Systems in Remote Sensing via Inference-Time Scaling
par: Yu, Chung-En Johnny, et autres
Publié: (2025)
par: Yu, Chung-En Johnny, et autres
Publié: (2025)
CaptchaMind: Training CAPTCHA Solvers via Reinforcement Learning with Explicit Reasoning Supervision
par: Wang, Pengcheng, et autres
Publié: (2026)
par: Wang, Pengcheng, et autres
Publié: (2026)
Rotated Multi-Scale Interaction Network for Referring Remote Sensing Image Segmentation
par: Liu, Sihan, et autres
Publié: (2023)
par: Liu, Sihan, et autres
Publié: (2023)
PointSAM: Pointly-Supervised Segment Anything Model for Remote Sensing Images
par: Liu, Nanqing, et autres
Publié: (2024)
par: Liu, Nanqing, et autres
Publié: (2024)
MindJourney: Test-Time Scaling with World Models for Spatial Reasoning
par: Yang, Yuncong, et autres
Publié: (2025)
par: Yang, Yuncong, et autres
Publié: (2025)
Low Saturation Confidence Distribution-based Test-Time Adaptation for Cross-Domain Remote Sensing Image Classification
par: Liang, Yu, et autres
Publié: (2024)
par: Liang, Yu, et autres
Publié: (2024)
Geospatial-Reasoning-Driven Vocabulary-Agnostic Remote Sensing Semantic Segmentation
par: Zhou, Chufeng, et autres
Publié: (2026)
par: Zhou, Chufeng, et autres
Publié: (2026)
Self-Supervised Cross-Modal Text-Image Time Series Retrieval in Remote Sensing
par: Hoxha, Genc, et autres
Publié: (2025)
par: Hoxha, Genc, et autres
Publié: (2025)
TimeMachine: Fine-Grained Facial Age Editing with Identity Preservation
par: Mi, Yilin, et autres
Publié: (2025)
par: Mi, Yilin, et autres
Publié: (2025)
Toward Stable Semi-Supervised Remote Sensing Segmentation via Co-Guidance and Co-Fusion
par: Zhou, Yi, et autres
Publié: (2025)
par: Zhou, Yi, et autres
Publié: (2025)
Documents similaires
-
GeoAlignCLIP: Enhancing Fine-Grained Vision-Language Alignment in Remote Sensing via Multi-Granular Consistency Learning
par: Yang, Xiao, et autres
Publié: (2026) -
Towards Faithful Reasoning in Remote Sensing: A Perceptually-Grounded GeoSpatial Chain-of-Thought for Vision-Language Models
par: Liu, Jiaqi, et autres
Publié: (2025) -
SkyNative: A Native Multimodal Framework for Remote Sensing Visual Evidence Reasoning
par: Yang, Xiao, et autres
Publié: (2026) -
GeoDiT: A Diffusion-based Vision-Language Model for Geospatial Understanding
par: Liu, Jiaqi, et autres
Publié: (2025) -
SkyMoE: A Vision-Language Foundation Model for Enhancing Geospatial Interpretation with Mixture of Experts
par: Liu, Jiaqi, et autres
Publié: (2025)