11Plus-Bench: Demystifying Multimodal LLM Spatial Reasoning with Cognitive-Inspired Analysis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Chengzu, Wu, Wenshan, Zhang, Huanyu, Li, Qingtao, Gao, Zeyu, Xia, Yan, Hernández-Orallo, José, Vulić, Ivan, Wei, Furu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Imagine while Reasoning in Space: Multimodal Visualization-of-Thought
par: Li, Chengzu, et autres
Publié: (2025)
par: Li, Chengzu, et autres
Publié: (2025)
Latent Sketchpad: Sketching Visual Thoughts to Elicit Multimodal Reasoning in MLLMs
par: Zhang, Huanyu, et autres
Publié: (2025)
par: Zhang, Huanyu, et autres
Publié: (2025)
TopViewRS: Vision-Language Models as Top-View Spatial Reasoners
par: Li, Chengzu, et autres
Publié: (2024)
par: Li, Chengzu, et autres
Publié: (2024)
Scaling and Beyond: Advancing Spatial Reasoning in MLLMs Requires New Recipes
par: Zhang, Huanyu, et autres
Publié: (2025)
par: Zhang, Huanyu, et autres
Publié: (2025)
Mind's Eye of LLMs: Visualization-of-Thought Elicits Spatial Reasoning in Large Language Models
par: Wu, Wenshan, et autres
Publié: (2024)
par: Wu, Wenshan, et autres
Publié: (2024)
Lost in Embeddings: Information Loss in Vision-Language Models
par: Li, Wenyan, et autres
Publié: (2025)
par: Li, Wenyan, et autres
Publié: (2025)
Thinking in Frames: How Visual Context and Test-Time Scaling Empower Video Reasoning
par: Li, Chengzu, et autres
Publié: (2026)
par: Li, Chengzu, et autres
Publié: (2026)
Large Language Models are Miscalibrated In-Context Learners
par: Li, Chengzu, et autres
Publié: (2023)
par: Li, Chengzu, et autres
Publié: (2023)
Meta Reasoning for Large Language Models
par: Gao, Peizhong, et autres
Publié: (2024)
par: Gao, Peizhong, et autres
Publié: (2024)
Beyond the Final Layer: Intermediate Representations for Better Multilingual Calibration in Large Language Models
par: Zhou, Ej, et autres
Publié: (2025)
par: Zhou, Ej, et autres
Publié: (2025)
Visual Planning: Let's Think Only with Images
par: Xu, Yi, et autres
Publié: (2025)
par: Xu, Yi, et autres
Publié: (2025)
Enhancing Language Model Rationality with Bi-Directional Deliberation Reasoning
par: Zhang, Yadong, et autres
Publié: (2024)
par: Zhang, Yadong, et autres
Publié: (2024)
LLM as a Mastermind: A Survey of Strategic Reasoning with Large Language Models
par: Zhang, Yadong, et autres
Publié: (2024)
par: Zhang, Yadong, et autres
Publié: (2024)
Cognitive Science-Inspired Evaluation of Core Capabilities for Object Understanding in AI
par: Rutar, Danaja, et autres
Publié: (2025)
par: Rutar, Danaja, et autres
Publié: (2025)
ALYMPICS: LLM Agents Meet Game Theory -- Exploring Strategic Decision-Making with AI Agents
par: Mao, Shaoguang, et autres
Publié: (2023)
par: Mao, Shaoguang, et autres
Publié: (2023)
Frequency-Modulated Visual Restoration for Matryoshka Large Multimodal Models
par: Pan, Qingtao, et autres
Publié: (2026)
par: Pan, Qingtao, et autres
Publié: (2026)
Bridging Semantic Logic Gaps: A Cognition Inspired Multimodal Boundary Preserving Network for Image Manipulation Localization
par: Li, Songlin, et autres
Publié: (2025)
par: Li, Songlin, et autres
Publié: (2025)
SpatialViz-Bench: A Cognitively-Grounded Benchmark for Diagnosing Spatial Visualization in MLLMs
par: Wang, Siting, et autres
Publié: (2025)
par: Wang, Siting, et autres
Publié: (2025)
EarthSpatialBench: Benchmarking Spatial Reasoning Capabilities of Multimodal LLMs on Earth Imagery
par: Xu, Zelin, et autres
Publié: (2026)
par: Xu, Zelin, et autres
Publié: (2026)
Unleashing the Emergent Cognitive Synergy in Large Language Models: A Task-Solving Agent through Multi-Persona Self-Collaboration
par: Wang, Zhenhailong, et autres
Publié: (2023)
par: Wang, Zhenhailong, et autres
Publié: (2023)
Demystifying Reinforcement Learning in Agentic Reasoning
par: Yu, Zhaochen, et autres
Publié: (2025)
par: Yu, Zhaochen, et autres
Publié: (2025)
Enriching Patent Claim Generation with European Patent Dataset
par: Jiang, Lekang, et autres
Publié: (2025)
par: Jiang, Lekang, et autres
Publié: (2025)
CVP: Central-Peripheral Vision-Inspired Multimodal Model for Spatial Reasoning
par: Chen, Zeyuan, et autres
Publié: (2025)
par: Chen, Zeyuan, et autres
Publié: (2025)
Demystifying Video Reasoning
par: Wang, Ruisi, et autres
Publié: (2026)
par: Wang, Ruisi, et autres
Publié: (2026)
SEED-Bench-2-Plus: Benchmarking Multimodal Large Language Models with Text-Rich Visual Comprehension
par: Li, Bohao, et autres
Publié: (2024)
par: Li, Bohao, et autres
Publié: (2024)
Beyond the Black Box: Demystifying Multi-Turn LLM Reasoning with VISTA
par: Zhang, Yiran, et autres
Publié: (2025)
par: Zhang, Yiran, et autres
Publié: (2025)
Locomo-Plus: Beyond-Factual Cognitive Memory Evaluation Framework for LLM Agents
par: Li, Yifei, et autres
Publié: (2026)
par: Li, Yifei, et autres
Publié: (2026)
Low-code LLM: Graphical User Interface over Large Language Models
par: Cai, Yuzhe, et autres
Publié: (2023)
par: Cai, Yuzhe, et autres
Publié: (2023)
Self-Augmented In-Context Learning for Unsupervised Word Translation
par: Li, Yaoyiran, et autres
Publié: (2024)
par: Li, Yaoyiran, et autres
Publié: (2024)
On Bilingual Lexicon Induction with Large Language Models
par: Li, Yaoyiran, et autres
Publié: (2023)
par: Li, Yaoyiran, et autres
Publié: (2023)
Sketch-of-Thought: Efficient LLM Reasoning with Adaptive Cognitive-Inspired Sketching
par: Aytes, Simon A., et autres
Publié: (2025)
par: Aytes, Simon A., et autres
Publié: (2025)
Specialising and Analysing Instruction-Tuned and Byte-Level Language Models for Organic Reaction Prediction
par: Pang, Jiayun, et autres
Publié: (2024)
par: Pang, Jiayun, et autres
Publié: (2024)
Quantifying Language Disparities in Multilingual Large Language Models
par: Hu, Songbo, et autres
Publié: (2025)
par: Hu, Songbo, et autres
Publié: (2025)
Retrofitting Large Language Models with Dynamic Tokenization
par: Feher, Darius, et autres
Publié: (2024)
par: Feher, Darius, et autres
Publié: (2024)
DARE: Diverse Visual Question Answering with Robustness Evaluation
par: Sterz, Hannah, et autres
Publié: (2024)
par: Sterz, Hannah, et autres
Publié: (2024)
Analyzing and Adapting Large Language Models for Few-Shot Multilingual NLU: Are We There Yet?
par: Razumovskaia, Evgeniia, et autres
Publié: (2024)
par: Razumovskaia, Evgeniia, et autres
Publié: (2024)
Demystifying Reasoning Dynamics with Mutual Information: Thinking Tokens are Information Peaks in LLM Reasoning
par: Qian, Chen, et autres
Publié: (2025)
par: Qian, Chen, et autres
Publié: (2025)
Demystifying Scientific Problem-Solving in LLMs by Probing Knowledge and Reasoning
par: Li, Alan, et autres
Publié: (2025)
par: Li, Alan, et autres
Publié: (2025)
SpineBench: Benchmarking Multimodal LLMs for Spinal Pathology Analysis
par: Zhang, Chenghanyu, et autres
Publié: (2025)
par: Zhang, Chenghanyu, et autres
Publié: (2025)
On Path to Multimodal Historical Reasoning: HistBench and HistAgent
par: Qiu, Jiahao, et autres
Publié: (2025)
par: Qiu, Jiahao, et autres
Publié: (2025)
Documents similaires
-
Imagine while Reasoning in Space: Multimodal Visualization-of-Thought
par: Li, Chengzu, et autres
Publié: (2025) -
Latent Sketchpad: Sketching Visual Thoughts to Elicit Multimodal Reasoning in MLLMs
par: Zhang, Huanyu, et autres
Publié: (2025) -
TopViewRS: Vision-Language Models as Top-View Spatial Reasoners
par: Li, Chengzu, et autres
Publié: (2024) -
Scaling and Beyond: Advancing Spatial Reasoning in MLLMs Requires New Recipes
par: Zhang, Huanyu, et autres
Publié: (2025) -
Mind's Eye of LLMs: Visualization-of-Thought Elicits Spatial Reasoning in Large Language Models
par: Wu, Wenshan, et autres
Publié: (2024)