Understanding the Geospatial Reasoning Capabilities of LLMs: A Trajectory Recovery Perspective
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Truong, Thinh Hung, Lau, Jey Han, Qi, Jianzhong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GPSBench: Do Large Language Models Understand GPS Coordinates?
par: Truong, Thinh Hung, et autres
Publié: (2026)
par: Truong, Thinh Hung, et autres
Publié: (2026)
Beyond Seen Data: Improving KBQA Generalization Through Schema-Guided Logical Form Generation
par: Gao, Shengxiang, et autres
Publié: (2025)
par: Gao, Shengxiang, et autres
Publié: (2025)
PathISE: Learning Informative Path Supervision for Knowledge Graph Question Answering
par: Gao, Shengxiang, et autres
Publié: (2026)
par: Gao, Shengxiang, et autres
Publié: (2026)
FLUKE: A Linguistically-Driven and Task-Agnostic Framework for Robustness Evaluation
par: Otmakhova, Yulia, et autres
Publié: (2025)
par: Otmakhova, Yulia, et autres
Publié: (2025)
REL: Working out is all you need
par: Simonds, Toby, et autres
Publié: (2024)
par: Simonds, Toby, et autres
Publié: (2024)
A Sentiment Consolidation Framework for Meta-Review Generation
par: Li, Miao, et autres
Publié: (2024)
par: Li, Miao, et autres
Publié: (2024)
Variational Quantum Rainbow Deep Q-Network for Optimizing Resource Allocation Problem
par: Nguyen, Truong Thanh Hung, et autres
Publié: (2025)
par: Nguyen, Truong Thanh Hung, et autres
Publié: (2025)
CMA-R:Causal Mediation Analysis for Explaining Rumour Detection
par: Tian, Lin, et autres
Publié: (2024)
par: Tian, Lin, et autres
Publié: (2024)
Evaluating Evidence Attribution in Generated Fact Checking Explanations
par: Xing, Rui, et autres
Publié: (2024)
par: Xing, Rui, et autres
Publié: (2024)
Charting New Territories: Exploring the Geographic and Geospatial Capabilities of Multimodal LLMs
par: Roberts, Jonathan, et autres
Publié: (2023)
par: Roberts, Jonathan, et autres
Publié: (2023)
Context Volume Drives Performance: Tackling Domain Shift in Extremely Low-Resource Translation via RAG
par: Setiawan, David Samuel, et autres
Publié: (2026)
par: Setiawan, David Samuel, et autres
Publié: (2026)
COMMUNITYNOTES: A Dataset for Exploring the Helpfulness of Fact-Checking Explanations
par: Xing, Rui, et autres
Publié: (2025)
par: Xing, Rui, et autres
Publié: (2025)
KALE: An Artwork Image Captioning System Augmented with Heterogeneous Graph
par: Jiang, Yanbei, et autres
Publié: (2024)
par: Jiang, Yanbei, et autres
Publié: (2024)
Foundation Models for Geospatial Reasoning: Assessing Capabilities of Large Language Models in Understanding Geometries and Topological Spatial Relations
par: Ji, Yuhan, et autres
Publié: (2025)
par: Ji, Yuhan, et autres
Publié: (2025)
Off-Trajectory Reasoning: Can LLMs Collaborate on Reasoning Trajectory?
par: Li, Aochong Oliver, et autres
Publié: (2025)
par: Li, Aochong Oliver, et autres
Publié: (2025)
Beyond Perception: Evaluating Abstract Visual Reasoning through Multi-Stage Task
par: Jiang, Yanbei, et autres
Publié: (2025)
par: Jiang, Yanbei, et autres
Publié: (2025)
Inclusion-of-Thoughts: Mitigating Preference Instability via Purifying the Decision Space
par: Madani, Mohammad Reza Ghasemi, et autres
Publié: (2026)
par: Madani, Mohammad Reza Ghasemi, et autres
Publié: (2026)
Investigating The Functional Roles of Attention Heads in Vision Language Models: Evidence for Reasoning Modules
par: Jiang, Yanbei, et autres
Publié: (2025)
par: Jiang, Yanbei, et autres
Publié: (2025)
Predicting Sentence Acceptability Judgments in Multimodal Contexts
par: Jang, Hyewon, et autres
Publié: (2026)
par: Jang, Hyewon, et autres
Publié: (2026)
Adaptive Collaboration of Arena-Based Argumentative LLMs for Explainable and Contestable Legal Reasoning
par: Cao, Hoang-Loc, et autres
Publié: (2026)
par: Cao, Hoang-Loc, et autres
Publié: (2026)
Factual Dialogue Summarization via Learning from Large Language Models
par: Zhu, Rongxin, et autres
Publié: (2024)
par: Zhu, Rongxin, et autres
Publié: (2024)
CIRCUIT: A Benchmark for Circuit Interpretation and Reasoning Capabilities of LLMs
par: Skelic, Lejla, et autres
Publié: (2025)
par: Skelic, Lejla, et autres
Publié: (2025)
Broken Chains: The Cost of Incomplete Reasoning in LLMs
par: Su, Ian, et autres
Publié: (2026)
par: Su, Ian, et autres
Publié: (2026)
Benchmarking Spatiotemporal Reasoning in LLMs and Reasoning Models: Capabilities and Challenges
par: Quan, Pengrui, et autres
Publié: (2025)
par: Quan, Pengrui, et autres
Publié: (2025)
Ko-MuSR: A Multistep Soft Reasoning Benchmark for LLMs Capable of Understanding Korean
par: Park, Chanwoo, et autres
Publié: (2025)
par: Park, Chanwoo, et autres
Publié: (2025)
InfiAlign: A Scalable and Sample-Efficient Framework for Aligning LLMs to Enhance Reasoning Capabilities
par: Cai, Shuo, et autres
Publié: (2025)
par: Cai, Shuo, et autres
Publié: (2025)
Are Your LLMs Capable of Stable Reasoning?
par: Liu, Junnan, et autres
Publié: (2024)
par: Liu, Junnan, et autres
Publié: (2024)
Geometric Analysis of Reasoning Trajectories: A Phase Space Approach to Understanding Valid and Invalid Multi-Hop Reasoning in LLMs
par: Marin, Javier
Publié: (2024)
par: Marin, Javier
Publié: (2024)
Intelligence as Trajectory-Dominant Pareto Optimization
par: Khanh, Truong Xuan, et autres
Publié: (2026)
par: Khanh, Truong Xuan, et autres
Publié: (2026)
Explore the Reasoning Capability of LLMs in the Chess Testbed
par: Wang, Shu, et autres
Publié: (2024)
par: Wang, Shu, et autres
Publié: (2024)
On Evaluating LLMs' Capabilities as Functional Approximators: A Bayesian Perspective
par: Siddiqui, Shoaib Ahmed, et autres
Publié: (2024)
par: Siddiqui, Shoaib Ahmed, et autres
Publié: (2024)
Evaluating LLMs Capabilities Towards Understanding Social Dynamics
par: Tahir, Anique, et autres
Publié: (2024)
par: Tahir, Anique, et autres
Publié: (2024)
Understanding Transformer Reasoning Capabilities via Graph Algorithms
par: Sanford, Clayton, et autres
Publié: (2024)
par: Sanford, Clayton, et autres
Publié: (2024)
Masking Matters: Unlocking the Spatial Reasoning Capabilities of LLMs for 3D Scene-Language Understanding
par: Jeon, Yerim, et autres
Publié: (2025)
par: Jeon, Yerim, et autres
Publié: (2025)
Better Call CLAUSE: A Discrepancy Benchmark for Auditing LLMs Legal Reasoning Capabilities
par: Choudhury, Manan Roy, et autres
Publié: (2025)
par: Choudhury, Manan Roy, et autres
Publié: (2025)
rSIM: Incentivizing Reasoning Capabilities of LLMs via Reinforced Strategy Injection
par: Chen, Sijia, et autres
Publié: (2025)
par: Chen, Sijia, et autres
Publié: (2025)
Beyond Linearization: Attributed Table Graphs for Table Reasoning
par: Wang, Yuxiang, et autres
Publié: (2026)
par: Wang, Yuxiang, et autres
Publié: (2026)
An Analytical Emotion Framework of Rumour Threads on Social Media
par: Xing, Rui, et autres
Publié: (2025)
par: Xing, Rui, et autres
Publié: (2025)
HiBench: Benchmarking LLMs Capability on Hierarchical Structure Reasoning
par: Jiang, Zhuohang, et autres
Publié: (2025)
par: Jiang, Zhuohang, et autres
Publié: (2025)
Deciphering Trajectory-Aided LLM Reasoning: An Optimization Perspective
par: Liu, Junnan, et autres
Publié: (2025)
par: Liu, Junnan, et autres
Publié: (2025)
Documents similaires
-
GPSBench: Do Large Language Models Understand GPS Coordinates?
par: Truong, Thinh Hung, et autres
Publié: (2026) -
Beyond Seen Data: Improving KBQA Generalization Through Schema-Guided Logical Form Generation
par: Gao, Shengxiang, et autres
Publié: (2025) -
PathISE: Learning Informative Path Supervision for Knowledge Graph Question Answering
par: Gao, Shengxiang, et autres
Publié: (2026) -
FLUKE: A Linguistically-Driven and Task-Agnostic Framework for Robustness Evaluation
par: Otmakhova, Yulia, et autres
Publié: (2025) -
REL: Working out is all you need
par: Simonds, Toby, et autres
Publié: (2024)