GPSBench: Do Large Language Models Understand GPS Coordinates?
Fuente:
arXiv
Guardado en:
| Autores principales: | Truong, Thinh Hung, Lau, Jey Han, Qi, Jianzhong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Understanding the Geospatial Reasoning Capabilities of LLMs: A Trajectory Recovery Perspective
por: Truong, Thinh Hung, et al.
Publicado: (2025)
por: Truong, Thinh Hung, et al.
Publicado: (2025)
Beyond Seen Data: Improving KBQA Generalization Through Schema-Guided Logical Form Generation
por: Gao, Shengxiang, et al.
Publicado: (2025)
por: Gao, Shengxiang, et al.
Publicado: (2025)
PathISE: Learning Informative Path Supervision for Knowledge Graph Question Answering
por: Gao, Shengxiang, et al.
Publicado: (2026)
por: Gao, Shengxiang, et al.
Publicado: (2026)
FLUKE: A Linguistically-Driven and Task-Agnostic Framework for Robustness Evaluation
por: Otmakhova, Yulia, et al.
Publicado: (2025)
por: Otmakhova, Yulia, et al.
Publicado: (2025)
Factual Dialogue Summarization via Learning from Large Language Models
por: Zhu, Rongxin, et al.
Publicado: (2024)
por: Zhu, Rongxin, et al.
Publicado: (2024)
REL: Working out is all you need
por: Simonds, Toby, et al.
Publicado: (2024)
por: Simonds, Toby, et al.
Publicado: (2024)
Variational Quantum Rainbow Deep Q-Network for Optimizing Resource Allocation Problem
por: Nguyen, Truong Thanh Hung, et al.
Publicado: (2025)
por: Nguyen, Truong Thanh Hung, et al.
Publicado: (2025)
CMA-R:Causal Mediation Analysis for Explaining Rumour Detection
por: Tian, Lin, et al.
Publicado: (2024)
por: Tian, Lin, et al.
Publicado: (2024)
Evaluating Evidence Attribution in Generated Fact Checking Explanations
por: Xing, Rui, et al.
Publicado: (2024)
por: Xing, Rui, et al.
Publicado: (2024)
A Sentiment Consolidation Framework for Meta-Review Generation
por: Li, Miao, et al.
Publicado: (2024)
por: Li, Miao, et al.
Publicado: (2024)
Context Volume Drives Performance: Tackling Domain Shift in Extremely Low-Resource Translation via RAG
por: Setiawan, David Samuel, et al.
Publicado: (2026)
por: Setiawan, David Samuel, et al.
Publicado: (2026)
COMMUNITYNOTES: A Dataset for Exploring the Helpfulness of Fact-Checking Explanations
por: Xing, Rui, et al.
Publicado: (2025)
por: Xing, Rui, et al.
Publicado: (2025)
KALE: An Artwork Image Captioning System Augmented with Heterogeneous Graph
por: Jiang, Yanbei, et al.
Publicado: (2024)
por: Jiang, Yanbei, et al.
Publicado: (2024)
Investigating The Functional Roles of Attention Heads in Vision Language Models: Evidence for Reasoning Modules
por: Jiang, Yanbei, et al.
Publicado: (2025)
por: Jiang, Yanbei, et al.
Publicado: (2025)
Inclusion-of-Thoughts: Mitigating Preference Instability via Purifying the Decision Space
por: Madani, Mohammad Reza Ghasemi, et al.
Publicado: (2026)
por: Madani, Mohammad Reza Ghasemi, et al.
Publicado: (2026)
Predicting Sentence Acceptability Judgments in Multimodal Contexts
por: Jang, Hyewon, et al.
Publicado: (2026)
por: Jang, Hyewon, et al.
Publicado: (2026)
Do Large Language Models Understand Word Senses?
por: Meconi, Domenico, et al.
Publicado: (2025)
por: Meconi, Domenico, et al.
Publicado: (2025)
Do Large Language Models (LLMs) Understand Chronology?
por: Wongchamcharoen, Pattaraphon Kenny, et al.
Publicado: (2025)
por: Wongchamcharoen, Pattaraphon Kenny, et al.
Publicado: (2025)
Multimedia Verification Through Multi-Agent Deep Research Multimodal Large Language Models
por: Le, Huy Hoan, et al.
Publicado: (2025)
por: Le, Huy Hoan, et al.
Publicado: (2025)
Do Large Language Models Understand Logic or Just Mimick Context?
por: Yan, Junbing, et al.
Publicado: (2024)
por: Yan, Junbing, et al.
Publicado: (2024)
Lost in Sequence: Do Large Language Models Understand Sequential Recommendation?
por: Kim, Sein, et al.
Publicado: (2025)
por: Kim, Sein, et al.
Publicado: (2025)
Towards Question Answering over Large Semi-structured Tables
por: Wang, Yuxiang, et al.
Publicado: (2025)
por: Wang, Yuxiang, et al.
Publicado: (2025)
Do They Understand Them? An Updated Evaluation on Nonbinary Pronoun Handling in Large Language Models
por: Tang, Xushuo, et al.
Publicado: (2025)
por: Tang, Xushuo, et al.
Publicado: (2025)
An Analytical Emotion Framework of Rumour Threads on Social Media
por: Xing, Rui, et al.
Publicado: (2025)
por: Xing, Rui, et al.
Publicado: (2025)
Understanding the Dilemma of Unlearning for Large Language Models
por: Zhang, Qingjie, et al.
Publicado: (2025)
por: Zhang, Qingjie, et al.
Publicado: (2025)
Beyond Perception: Evaluating Abstract Visual Reasoning through Multi-Stage Task
por: Jiang, Yanbei, et al.
Publicado: (2025)
por: Jiang, Yanbei, et al.
Publicado: (2025)
Can Large Language Models Adequately Perform Symbolic Reasoning Over Time Series?
por: Liu, Zewen, et al.
Publicado: (2025)
por: Liu, Zewen, et al.
Publicado: (2025)
Assessing and Understanding Creativity in Large Language Models
por: Zhao, Yunpu, et al.
Publicado: (2024)
por: Zhao, Yunpu, et al.
Publicado: (2024)
Synthesizing Tabular Data Using Selectivity Enhanced Generative Adversarial Networks
por: Zhou, Youran, et al.
Publicado: (2025)
por: Zhou, Youran, et al.
Publicado: (2025)
SimInterview: Transforming Business Education through Large Language Model-Based Simulated Multilingual Interview Training System
por: Nguyen, Truong Thanh Hung, et al.
Publicado: (2025)
por: Nguyen, Truong Thanh Hung, et al.
Publicado: (2025)
AlgBench: To What Extent Do Large Reasoning Models Understand Algorithms?
por: Sun, Henan, et al.
Publicado: (2026)
por: Sun, Henan, et al.
Publicado: (2026)
LangXAI: Integrating Large Vision Models for Generating Textual Explanations to Enhance Explainability in Visual Perception Tasks
por: Nguyen, Truong Thanh Hung, et al.
Publicado: (2024)
por: Nguyen, Truong Thanh Hung, et al.
Publicado: (2024)
Divergent-Convergent Thinking in Large Language Models for Creative Problem Generation
por: Nguyen, Manh Hung, et al.
Publicado: (2025)
por: Nguyen, Manh Hung, et al.
Publicado: (2025)
MolDA: Molecular Understanding and Generation via Large Language Diffusion Model
por: Shin, Seohyeon, et al.
Publicado: (2026)
por: Shin, Seohyeon, et al.
Publicado: (2026)
Beyond Long Tail POIs: Transition-Centered Generalization for Human Mobility Prediction
por: Lyu, Dingyang, et al.
Publicado: (2026)
por: Lyu, Dingyang, et al.
Publicado: (2026)
Do Large Language Models Mentalize When They Teach?
por: Harootonian, Sevan K., et al.
Publicado: (2026)
por: Harootonian, Sevan K., et al.
Publicado: (2026)
Large Language Models Do Not Simulate Human Psychology
por: Schröder, Sarah, et al.
Publicado: (2025)
por: Schröder, Sarah, et al.
Publicado: (2025)
Enhancing Large Language Models (LLMs) for Telecom using Dynamic Knowledge Graphs and Explainable Retrieval-Augmented Generation
por: Yuan, Dun, et al.
Publicado: (2026)
por: Yuan, Dun, et al.
Publicado: (2026)
Coordinated Pandemic Control with Large Language Model Agents as Policymaking Assistants
por: Shi, Ziyi, et al.
Publicado: (2026)
por: Shi, Ziyi, et al.
Publicado: (2026)
How Do Large Language Models Understand Graph Patterns? A Benchmark for Graph Pattern Comprehension
por: Dai, Xinnan, et al.
Publicado: (2024)
por: Dai, Xinnan, et al.
Publicado: (2024)
Ejemplares similares
-
Understanding the Geospatial Reasoning Capabilities of LLMs: A Trajectory Recovery Perspective
por: Truong, Thinh Hung, et al.
Publicado: (2025) -
Beyond Seen Data: Improving KBQA Generalization Through Schema-Guided Logical Form Generation
por: Gao, Shengxiang, et al.
Publicado: (2025) -
PathISE: Learning Informative Path Supervision for Knowledge Graph Question Answering
por: Gao, Shengxiang, et al.
Publicado: (2026) -
FLUKE: A Linguistically-Driven and Task-Agnostic Framework for Robustness Evaluation
por: Otmakhova, Yulia, et al.
Publicado: (2025) -
Factual Dialogue Summarization via Learning from Large Language Models
por: Zhu, Rongxin, et al.
Publicado: (2024)