AtomWorld: A Benchmark for Evaluating Spatial Reasoning in Large Language Models on Crystalline Materials
Fuente:
arXiv
Saved in:
| Main Authors: | Lv, Taoyuze, Chen, Alexander, Xie, Fengyu, Wu, Chu, Meng, Jeffrey, Zhou, Dongzhan, Wang, Yingheng, Hoex, Bram, Zhong, Zhicheng, Xie, Tong |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Chemical-space completeness: a new strategy for crystalline materials exploration
by: Xie, Fengyu, et al.
Published: (2025)
by: Xie, Fengyu, et al.
Published: (2025)
EAC-Net: Predicting real-space charge density via equivariant atomic contributions
by: Qin, Xuejian, et al.
Published: (2025)
by: Qin, Xuejian, et al.
Published: (2025)
DARWIN 1.5: Large Language Models as Materials Science Adapted Learners
by: Xie, Tong, et al.
Published: (2024)
by: Xie, Tong, et al.
Published: (2024)
From Tokens to Materials: Leveraging Language Models for Scientific Discovery
by: Wan, Yuwei, et al.
Published: (2024)
by: Wan, Yuwei, et al.
Published: (2024)
Construction and Application of Materials Knowledge Graph in Multidisciplinary Materials Science via Large Language Model
by: Ye, Yanpeng, et al.
Published: (2024)
by: Ye, Yanpeng, et al.
Published: (2024)
MiST: Understanding the Role of Mid-Stage Scientific Training in Developing Chemical Reasoning Models
by: Bran, Andres M, et al.
Published: (2025)
by: Bran, Andres M, et al.
Published: (2025)
Uncovering coupled ionic-polaronic dynamics and interfacial enhancement in Li$_x$FePO$_4$
by: Xie, Fengyu, et al.
Published: (2025)
by: Xie, Fengyu, et al.
Published: (2025)
ByteScience: Bridging Unstructured Scientific Literature and Structured Data with Auto Fine-tuned Large Language Model in Token Granularity
by: Xie, Tong, et al.
Published: (2024)
by: Xie, Tong, et al.
Published: (2024)
DrugMCTS: a drug repurposing framework combining multi-agent, RAG and Monte Carlo Tree Search
by: Yang, Zerui, et al.
Published: (2025)
by: Yang, Zerui, et al.
Published: (2025)
SciQAG: A Framework for Auto-Generated Science Question Answering Dataset with Fine-grained Evaluation
by: Wan, Yuwei, et al.
Published: (2024)
by: Wan, Yuwei, et al.
Published: (2024)
Porous Supramolecular Crystalline Materials for Photocatalysis
by: Yun‐Nan Gong, et al.
Published: (2025)
by: Yun‐Nan Gong, et al.
Published: (2025)
Order Matters in Hallucination: Reasoning Order as Benchmark and Reflexive Prompting for Large-Language-Models
by: Xie, Zikai
Published: (2024)
by: Xie, Zikai
Published: (2024)
SketchThinker-R1: Towards Efficient Sketch-Style Reasoning in Large Multimodal Models
by: Zhang, Ruiyang, et al.
Published: (2026)
by: Zhang, Ruiyang, et al.
Published: (2026)
Reframing Spatial Reasoning Evaluation in Language Models: A Real-World Simulation Benchmark for Qualitative Reasoning
by: Li, Fangjun, et al.
Published: (2024)
by: Li, Fangjun, et al.
Published: (2024)
SpatiaLQA: A Benchmark for Evaluating Spatial Logical Reasoning in Vision-Language Models
by: Xie, Yuechen, et al.
Published: (2026)
by: Xie, Yuechen, et al.
Published: (2026)
DailyQA: A Benchmark to Evaluate Web Retrieval Augmented LLMs Based on Capturing Real-World Changes
by: Cheng, Jiehan, et al.
Published: (2025)
by: Cheng, Jiehan, et al.
Published: (2025)
AQA-Bench: An Interactive Benchmark for Evaluating LLMs' Sequential Reasoning Ability
by: Yang, Siwei, et al.
Published: (2024)
by: Yang, Siwei, et al.
Published: (2024)
SPhyR: Spatial-Physical Reasoning Benchmark on Material Distribution
by: Siedler, Philipp D.
Published: (2025)
by: Siedler, Philipp D.
Published: (2025)
Space Group Informed Transformer for Crystalline Materials Generation
by: Cao, Zhendong, et al.
Published: (2024)
by: Cao, Zhendong, et al.
Published: (2024)
Ego to World: Collaborative Spatial Reasoning in Embodied Systems via Reinforcement Learning
by: Zhou, Heng, et al.
Published: (2026)
by: Zhou, Heng, et al.
Published: (2026)
Improved carrier collection efficiency in CZTS solar cells by Li‐enhanced liquid‐phase‐assisted grain growth
by: Xiaojie Yuan, et al.
Published: (2024)
by: Xiaojie Yuan, et al.
Published: (2024)
CHBench: A Cognitive Hierarchy Benchmark for Evaluating Strategic Reasoning Capability of LLMs
by: Liu, Hongtao, et al.
Published: (2025)
by: Liu, Hongtao, et al.
Published: (2025)
AtomR: Atomic Operator-Empowered Large Language Models for Heterogeneous Knowledge Reasoning
by: Xin, Amy, et al.
Published: (2024)
by: Xin, Amy, et al.
Published: (2024)
Ordered Assembly of Natural Phenolic Building Blocks for Supramolecular Crystalline Materials
by: Qiuping Xie, et al.
Published: (2024)
by: Qiuping Xie, et al.
Published: (2024)
Hierarchical Spatial Proximity Reasoning for Vision-and-Language Navigation
by: Xu, Ming, et al.
Published: (2024)
by: Xu, Ming, et al.
Published: (2024)
Towards Expressive Zero-Shot Speech Synthesis with Hierarchical Prosody Modeling
by: Jiang, Yuepeng, et al.
Published: (2024)
by: Jiang, Yuepeng, et al.
Published: (2024)
ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition
by: Liu, Yujie, et al.
Published: (2025)
by: Liu, Yujie, et al.
Published: (2025)
MOOSE-Chem: Large Language Models for Rediscovering Unseen Chemistry Scientific Hypotheses
by: Yang, Zonglin, et al.
Published: (2024)
by: Yang, Zonglin, et al.
Published: (2024)
LAMPER: LanguAge Model and Prompt EngineeRing for zero-shot time series classification
by: Du, Zhicheng, et al.
Published: (2024)
by: Du, Zhicheng, et al.
Published: (2024)
CheMatAgent: Enhancing LLMs for Chemistry and Materials Science through Tree-Search Based Tool Learning
by: Wu, Mengsong, et al.
Published: (2025)
by: Wu, Mengsong, et al.
Published: (2025)
BAT: Learning to Reason about Spatial Sounds with Large Language Models
by: Zheng, Zhisheng, et al.
Published: (2024)
by: Zheng, Zhisheng, et al.
Published: (2024)
Component parts of the World Heat Flow Data Collection
by: Bram, K
Published: (1980)
by: Bram, K
Published: (1980)
Component parts of the World Heat Flow Data Collection
by: Bram, K
Published: (1979)
by: Bram, K
Published: (1979)
LLaMA-Berry: Pairwise Optimization for O1-like Olympiad-Level Mathematical Reasoning
by: Zhang, Di, et al.
Published: (2024)
by: Zhang, Di, et al.
Published: (2024)
Spatial-DISE: A Unified Benchmark for Evaluating Spatial Reasoning in Vision-Language Models
by: Huang, Xinmiao, et al.
Published: (2025)
by: Huang, Xinmiao, et al.
Published: (2025)
Advancing Spatial Reasoning in Large Language Models: An In-Depth Evaluation and Enhancement Using the StepGame Benchmark
by: Li, Fangjun, et al.
Published: (2024)
by: Li, Fangjun, et al.
Published: (2024)
The Quest for Reliable AI Accelerators: Cross-Layer Evaluation and Design Optimization
by: Li, Meng, et al.
Published: (2026)
by: Li, Meng, et al.
Published: (2026)
MTCMB: A Multi-Task Benchmark Framework for Evaluating LLMs on Knowledge, Reasoning, and Safety in Traditional Chinese Medicine
by: Kong, Shufeng, et al.
Published: (2025)
by: Kong, Shufeng, et al.
Published: (2025)
RoadBench: Benchmarking MLLMs on Fine-Grained Spatial Understanding and Reasoning under Urban Road Scenarios
by: Zhang, Jun, et al.
Published: (2025)
by: Zhang, Jun, et al.
Published: (2025)
Unraveling the Stability of N‐Doped Graphene Supported Single‐Atom and Dual‐Atom Catalysts From Pourbaix Diagram
by: Youyu Meng, et al.
Published: (2026)
by: Youyu Meng, et al.
Published: (2026)
Similar Items
-
Chemical-space completeness: a new strategy for crystalline materials exploration
by: Xie, Fengyu, et al.
Published: (2025) -
EAC-Net: Predicting real-space charge density via equivariant atomic contributions
by: Qin, Xuejian, et al.
Published: (2025) -
DARWIN 1.5: Large Language Models as Materials Science Adapted Learners
by: Xie, Tong, et al.
Published: (2024) -
From Tokens to Materials: Leveraging Language Models for Scientific Discovery
by: Wan, Yuwei, et al.
Published: (2024) -
Construction and Application of Materials Knowledge Graph in Multidisciplinary Materials Science via Large Language Model
by: Ye, Yanpeng, et al.
Published: (2024)