SpatialText: A Pure-Text Cognitive Benchmark for Spatial Understanding in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Jiang, Peiyao, Qin, Zequn, Li, Xi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SpatialBench: Benchmarking Multimodal Large Language Models for Spatial Cognition
di: Xu, Peiran, et al.
Pubblicazione: (2025)
di: Xu, Peiran, et al.
Pubblicazione: (2025)
EmbSpatial-Bench: Benchmarking Spatial Understanding for Embodied Tasks with Large Vision-Language Models
di: Du, Mengfei, et al.
Pubblicazione: (2024)
di: Du, Mengfei, et al.
Pubblicazione: (2024)
BRIDGE: Benchmarking Large Language Models for Understanding Real-world Clinical Practice Text
di: Wu, Jiageng, et al.
Pubblicazione: (2025)
di: Wu, Jiageng, et al.
Pubblicazione: (2025)
Evaluating Spatial Understanding of Large Language Models
di: Yamada, Yutaro, et al.
Pubblicazione: (2023)
di: Yamada, Yutaro, et al.
Pubblicazione: (2023)
NuScenes-SpatialQA: A Spatial Understanding and Reasoning Benchmark for Vision-Language Models in Autonomous Driving
di: Tian, Kexin, et al.
Pubblicazione: (2025)
di: Tian, Kexin, et al.
Pubblicazione: (2025)
Synergistic Dual Spatial-aware Generation of Image-to-Text and Text-to-Image
di: Zhao, Yu, et al.
Pubblicazione: (2024)
di: Zhao, Yu, et al.
Pubblicazione: (2024)
Do LLMs Build World Models From Text? A Multilingual Diagnostic of Spatial Reasoning
di: Pan, Zhikai, et al.
Pubblicazione: (2026)
di: Pan, Zhikai, et al.
Pubblicazione: (2026)
JaWildText: A Benchmark for Vision-Language Models on Japanese Scene Text Understanding
di: Maeda, Koki, et al.
Pubblicazione: (2026)
di: Maeda, Koki, et al.
Pubblicazione: (2026)
Tag Map: A Text-Based Map for Spatial Reasoning and Navigation with Large Language Models
di: Zhang, Mike, et al.
Pubblicazione: (2024)
di: Zhang, Mike, et al.
Pubblicazione: (2024)
Benchmarking Pathology Foundation Models for Spatial Domain Understanding
di: Zhao, Bokai, et al.
Pubblicazione: (2026)
di: Zhao, Bokai, et al.
Pubblicazione: (2026)
Free Lunch for Unified Multimodal Models: Enhancing Generation via Reflective Rectification with Inherent Understanding
di: Jiang, Yibo, et al.
Pubblicazione: (2026)
di: Jiang, Yibo, et al.
Pubblicazione: (2026)
Multimodal Large Language Models for End-to-End Affective Computing: Benchmarking and Boosting with Generative Knowledge Prompting
di: Luo, Miaosen, et al.
Pubblicazione: (2025)
di: Luo, Miaosen, et al.
Pubblicazione: (2025)
The World is Not Mono: Enabling Spatial Understanding in Large Audio-Language Models
di: You, Yuhuan, et al.
Pubblicazione: (2026)
di: You, Yuhuan, et al.
Pubblicazione: (2026)
CityGPT: Empowering Urban Spatial Cognition of Large Language Models
di: Feng, Jie, et al.
Pubblicazione: (2024)
di: Feng, Jie, et al.
Pubblicazione: (2024)
Spatial Reasoning in Multimodal Large Language Models: A Survey of Tasks, Benchmarks and Methods
di: Liu, Weichen, et al.
Pubblicazione: (2025)
di: Liu, Weichen, et al.
Pubblicazione: (2025)
Reasoning under Vision: Understanding Visual-Spatial Cognition in Vision-Language Models for CAPTCHA
di: Song, Python, et al.
Pubblicazione: (2025)
di: Song, Python, et al.
Pubblicazione: (2025)
Multi-Source Spatial Knowledge Understanding for Immersive Visual Text-to-Speech
di: He, Shuwei, et al.
Pubblicazione: (2024)
di: He, Shuwei, et al.
Pubblicazione: (2024)
UrbanLLaVA: A Multi-modal Large Language Model for Urban Intelligence with Spatial Reasoning and Understanding
di: Feng, Jie, et al.
Pubblicazione: (2025)
di: Feng, Jie, et al.
Pubblicazione: (2025)
Cognitive Maps in Language Models: A Mechanistic Analysis of Spatial Planning
di: Baumgartner, Caroline, et al.
Pubblicazione: (2025)
di: Baumgartner, Caroline, et al.
Pubblicazione: (2025)
Fùxì: A Benchmark for Evaluating Language Models on Ancient Chinese Text Understanding and Generation
di: Zhao, Shangqing, et al.
Pubblicazione: (2025)
di: Zhao, Shangqing, et al.
Pubblicazione: (2025)
SpatialReward: Verifiable Spatial Reward Modeling for Fine-Grained Spatial Consistency in Text-to-Image Generation
di: Zhou, Sashuai, et al.
Pubblicazione: (2026)
di: Zhou, Sashuai, et al.
Pubblicazione: (2026)
The Point, the Vision and the Text: Does Point Cloud Boost Spatial Reasoning of Large Language Models? A Bias-Controlled Study
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
SpatialBench-UC: Uncertainty-Aware Evaluation of Spatial Prompt Following in Text-to-Image Generation
di: Rostane, Amine
Pubblicazione: (2026)
di: Rostane, Amine
Pubblicazione: (2026)
Beyond Text-Dominance: Understanding Modality Preference of Omni-modal Large Language Models
di: Yan, Xinru, et al.
Pubblicazione: (2026)
di: Yan, Xinru, et al.
Pubblicazione: (2026)
Multi-modal and Multi-scale Spatial Environment Understanding for Immersive Visual Text-to-Speech
di: Liu, Rui, et al.
Pubblicazione: (2024)
di: Liu, Rui, et al.
Pubblicazione: (2024)
Text2World: Benchmarking Large Language Models for Symbolic World Model Generation
di: Hu, Mengkang, et al.
Pubblicazione: (2025)
di: Hu, Mengkang, et al.
Pubblicazione: (2025)
PLUGH: A Benchmark for Spatial Understanding and Reasoning in Large Language Models
di: Tikhonov, Alexey
Pubblicazione: (2024)
di: Tikhonov, Alexey
Pubblicazione: (2024)
Unifying Text Semantics and Graph Structures for Temporal Text-attributed Graphs with Large Language Models
di: Zhang, Siwei, et al.
Pubblicazione: (2025)
di: Zhang, Siwei, et al.
Pubblicazione: (2025)
Structured Information for Improving Spatial Relationships in Text-to-Image Generation
di: Schildermans, Sander, et al.
Pubblicazione: (2025)
di: Schildermans, Sander, et al.
Pubblicazione: (2025)
Text2GQL-Bench: A Text to Graph Query Language Benchmark [Experiment, Analysis & Benchmark]
di: Lyu, Songlin, et al.
Pubblicazione: (2026)
di: Lyu, Songlin, et al.
Pubblicazione: (2026)
SPM-Bench: Benchmarking Large Language Models for Scanning Probe Microscopy
di: Xiao, Peiyao, et al.
Pubblicazione: (2026)
di: Xiao, Peiyao, et al.
Pubblicazione: (2026)
Audio-centric Video Understanding Benchmark without Text Shortcut
di: Yang, Yudong, et al.
Pubblicazione: (2025)
di: Yang, Yudong, et al.
Pubblicazione: (2025)
Large Language Models for Oral History Understanding with Text Classification and Sentiment Analysis
di: Cherukuri, Komala Subramanyam, et al.
Pubblicazione: (2025)
di: Cherukuri, Komala Subramanyam, et al.
Pubblicazione: (2025)
A Comprehensive Evaluation of Large Language Models on Benchmark Biomedical Text Processing Tasks
di: Jahan, Israt, et al.
Pubblicazione: (2023)
di: Jahan, Israt, et al.
Pubblicazione: (2023)
FABLE: A Novel Data-Flow Analysis Benchmark on Procedural Text for Large Language Model Evaluation
di: Pallagani, Vishal, et al.
Pubblicazione: (2025)
di: Pallagani, Vishal, et al.
Pubblicazione: (2025)
Benchmarking Open-Source Large Language Models on Healthcare Text Classification Tasks
di: Guo, Yuting, et al.
Pubblicazione: (2025)
di: Guo, Yuting, et al.
Pubblicazione: (2025)
A Pure Transformer Pretraining Framework on Text-attributed Graphs
di: Song, Yu, et al.
Pubblicazione: (2024)
di: Song, Yu, et al.
Pubblicazione: (2024)
MEMO-Bench: A Multiple Benchmark for Text-to-Image and Multimodal Large Language Models on Human Emotion Analysis
di: Zhou, Yingjie, et al.
Pubblicazione: (2024)
di: Zhou, Yingjie, et al.
Pubblicazione: (2024)
Spatial Context-based Self-Supervised Learning for Handwritten Text Recognition
di: Penarrubia, Carlos, et al.
Pubblicazione: (2024)
di: Penarrubia, Carlos, et al.
Pubblicazione: (2024)
Linear Spatial World Models Emerge in Large Language Models
di: Tehenan, Matthieu, et al.
Pubblicazione: (2025)
di: Tehenan, Matthieu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SpatialBench: Benchmarking Multimodal Large Language Models for Spatial Cognition
di: Xu, Peiran, et al.
Pubblicazione: (2025) -
EmbSpatial-Bench: Benchmarking Spatial Understanding for Embodied Tasks with Large Vision-Language Models
di: Du, Mengfei, et al.
Pubblicazione: (2024) -
BRIDGE: Benchmarking Large Language Models for Understanding Real-world Clinical Practice Text
di: Wu, Jiageng, et al.
Pubblicazione: (2025) -
Evaluating Spatial Understanding of Large Language Models
di: Yamada, Yutaro, et al.
Pubblicazione: (2023) -
NuScenes-SpatialQA: A Spatial Understanding and Reasoning Benchmark for Vision-Language Models in Autonomous Driving
di: Tian, Kexin, et al.
Pubblicazione: (2025)