GeoX: Mastering Geospatial Reasoning Through Self-Play and Verifiable Rewards
Fuente:
arXiv
Saved in:
| Main Authors: | Ahn, Kyeongjin, Lee, Seungeon, Gummadi, Krishna P., Cha, Meeyoung |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
LoRA on the Go: Instance-level Dynamic LoRA Selection and Merging
by: Lee, Seungeon, et al.
Published: (2025)
by: Lee, Seungeon, et al.
Published: (2025)
GeoReg: Weight-Constrained Few-Shot Regression for Socio-Economic Estimation using LLM
by: Ahn, Kyeongjin, et al.
Published: (2025)
by: Ahn, Kyeongjin, et al.
Published: (2025)
Tabular Feature Discovery With Reasoning Type Exploration
by: Han, Sungwon, et al.
Published: (2025)
by: Han, Sungwon, et al.
Published: (2025)
To Call or Not to Call: A Framework to Assess and Optimize LLM Tool Calling
by: Wu, Qinyuan, et al.
Published: (2026)
by: Wu, Qinyuan, et al.
Published: (2026)
Propose, Solve, Verify: Self-Play Through Formal Verification
by: Wilf, Alex, et al.
Published: (2025)
by: Wilf, Alex, et al.
Published: (2025)
GeoX-Bench: Benchmarking Cross-View Geo-Localization and Pose Estimation Capabilities of Large Multimodal Models
by: Zheng, Yushuo, et al.
Published: (2025)
by: Zheng, Yushuo, et al.
Published: (2025)
EconCausal: A Context-Aware Economic Reasoning Benchmark for Large Language Models
by: Lee, Donggyu, et al.
Published: (2025)
by: Lee, Donggyu, et al.
Published: (2025)
Verifiable Process Rewards for Agentic Reasoning
by: Yuan, Huining, et al.
Published: (2026)
by: Yuan, Huining, et al.
Published: (2026)
ERA: Evidence-based Reliability Alignment for Honest Retrieval-Augmented Generation
by: Shin, Sunguk, et al.
Published: (2026)
by: Shin, Sunguk, et al.
Published: (2026)
Promoting Efficient Reasoning with Verifiable Stepwise Reward
by: Yue, Chuhuai, et al.
Published: (2025)
by: Yue, Chuhuai, et al.
Published: (2025)
ANCORA: Learning to Question via Manifold-Anchored Self-Play for Verifiable Reasoning
by: Yang, Chengcao
Published: (2026)
by: Yang, Chengcao
Published: (2026)
Adversarial Style Augmentation via Large Language Model for Robust Fake News Detection
by: Park, Sungwon, et al.
Published: (2024)
by: Park, Sungwon, et al.
Published: (2024)
Trust, But Verify: A Self-Verification Approach to Reinforcement Learning with Verifiable Rewards
by: Liu, Xiaoyuan, et al.
Published: (2025)
by: Liu, Xiaoyuan, et al.
Published: (2025)
StructVRM: Aligning Multimodal Reasoning with Structured and Verifiable Reward Models
by: Zhang, Xiangxiang, et al.
Published: (2025)
by: Zhang, Xiangxiang, et al.
Published: (2025)
SPARK: Self-Play with Asymmetric Reward from Knowledge Graphs
by: Park, Hyobin, et al.
Published: (2026)
by: Park, Hyobin, et al.
Published: (2026)
Unlocking Zero-Shot Geospatial Reasoning via Indirect Rewards
by: Xu, Chenhui, et al.
Published: (2025)
by: Xu, Chenhui, et al.
Published: (2025)
Generalizable Disaster Damage Assessment via Change Detection with Vision Foundation Model
by: Ahn, Kyeongjin, et al.
Published: (2024)
by: Ahn, Kyeongjin, et al.
Published: (2024)
Random Policy Valuation is Enough for LLM Reasoning with Verifiable Rewards
by: He, Haoran, et al.
Published: (2025)
by: He, Haoran, et al.
Published: (2025)
Verifying Meta-Awareness via Predictive Rewards in Reasoning Models
by: Kim, Yoonjeon, et al.
Published: (2025)
by: Kim, Yoonjeon, et al.
Published: (2025)
Dropouts in Confidence: Moral Uncertainty in Human-LLM Alignment
by: Kwon, Jea, et al.
Published: (2025)
by: Kwon, Jea, et al.
Published: (2025)
GeoSEE: Regional Socio-Economic Estimation With a Large Language Model
by: Han, Sungwon, et al.
Published: (2024)
by: Han, Sungwon, et al.
Published: (2024)
Beyond Outcome Verification: Verifiable Process Reward Models for Structured Reasoning
by: Pronesti, Massimiliano, et al.
Published: (2026)
by: Pronesti, Massimiliano, et al.
Published: (2026)
Bilinear representation mitigates reversal curse and enables consistent model editing
by: Kim, Dong-Kyum, et al.
Published: (2025)
by: Kim, Dong-Kyum, et al.
Published: (2025)
No Verifiable Reward for Prosody: Toward Preference-Guided Prosody Learning in TTS
by: Shin, Seungyoun, et al.
Published: (2025)
by: Shin, Seungyoun, et al.
Published: (2025)
REASONING GYM: Reasoning Environments for Reinforcement Learning with Verifiable Rewards
by: Stojanovski, Zafir, et al.
Published: (2025)
by: Stojanovski, Zafir, et al.
Published: (2025)
Classifying and Tracking International Aid Contribution Towards SDGs
by: Park, Sungwon, et al.
Published: (2025)
by: Park, Sungwon, et al.
Published: (2025)
Reinforcement Learning with Verifiable Rewards Implicitly Incentivizes Correct Reasoning in Base LLMs
by: Wen, Xumeng, et al.
Published: (2025)
by: Wen, Xumeng, et al.
Published: (2025)
Semi-supervised Shelter Mapping for WASH Accessibility Assessment in Rohingya Refugee Camps
by: Ahn, Kyeongjin, et al.
Published: (2025)
by: Ahn, Kyeongjin, et al.
Published: (2025)
Learning Robust Reasoning through Guided Adversarial Self-Play
by: Li, Shuozhe, et al.
Published: (2026)
by: Li, Shuozhe, et al.
Published: (2026)
Reward Hacking Mitigation using Verifiable Composite Rewards
by: Tarek, Mirza Farhan Bin, et al.
Published: (2025)
by: Tarek, Mirza Farhan Bin, et al.
Published: (2025)
Mastering Multi-Drone Volleyball through Hierarchical Co-Self-Play Reinforcement Learning
by: Zhang, Ruize, et al.
Published: (2025)
by: Zhang, Ruize, et al.
Published: (2025)
GeoBenchX: Benchmarking LLMs in Agent Solving Multistep Geospatial Tasks
by: Krechetova, Varvara, et al.
Published: (2025)
by: Krechetova, Varvara, et al.
Published: (2025)
Seirênes: Adversarial Self-Play with Evolving Distractions for LLM Reasoning
by: Zhang, Chi, et al.
Published: (2026)
by: Zhang, Chi, et al.
Published: (2026)
Exploring Persona-dependent LLM Alignment for the Moral Machine Experiment
by: Kim, Jiseon, et al.
Published: (2025)
by: Kim, Jiseon, et al.
Published: (2025)
RLVMR: Reinforcement Learning with Verifiable Meta-Reasoning Rewards for Robust Long-Horizon Agents
by: Zhang, Zijing, et al.
Published: (2025)
by: Zhang, Zijing, et al.
Published: (2025)
Self Supervised Vision for Climate Downscaling
by: Singh, Karandeep, et al.
Published: (2024)
by: Singh, Karandeep, et al.
Published: (2024)
Retrieval Augmented Time Series Forecasting
by: Han, Sungwon, et al.
Published: (2025)
by: Han, Sungwon, et al.
Published: (2025)
How Training Data Shapes the Use of Parametric and In-Context Knowledge in Language Models
by: Kim, Minsung, et al.
Published: (2025)
by: Kim, Minsung, et al.
Published: (2025)
Masked-and-Reordered Self-Supervision for Reinforcement Learning from Verifiable Rewards
by: Wang, Zhen, et al.
Published: (2025)
by: Wang, Zhen, et al.
Published: (2025)
Reinforcement Learning with Verifiable yet Noisy Rewards under Imperfect Verifiers
by: Cai, Xin-Qiang, et al.
Published: (2025)
by: Cai, Xin-Qiang, et al.
Published: (2025)
Similar Items
-
LoRA on the Go: Instance-level Dynamic LoRA Selection and Merging
by: Lee, Seungeon, et al.
Published: (2025) -
GeoReg: Weight-Constrained Few-Shot Regression for Socio-Economic Estimation using LLM
by: Ahn, Kyeongjin, et al.
Published: (2025) -
Tabular Feature Discovery With Reasoning Type Exploration
by: Han, Sungwon, et al.
Published: (2025) -
To Call or Not to Call: A Framework to Assess and Optimize LLM Tool Calling
by: Wu, Qinyuan, et al.
Published: (2026) -
Propose, Solve, Verify: Self-Play Through Formal Verification
by: Wilf, Alex, et al.
Published: (2025)