From Building Blocks to Planning: Multi-Step Spatial Reasoning in LLMs with Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tahmasbi, Amir, Majidi, Sadegh, Taram, Kazem, Bera, Aniket |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
R3-RAG: Learning Step-by-Step Reasoning and Retrieval for LLMs via Reinforcement Learning
par: Li, Yuan, et autres
Publié: (2025)
par: Li, Yuan, et autres
Publié: (2025)
Zonal RL-RRT: Integrated RL-RRT Path Planning with Collision Probability and Zone Connectivity
par: Tahmasbi, AmirMohammad, et autres
Publié: (2024)
par: Tahmasbi, AmirMohammad, et autres
Publié: (2024)
Offline Reinforcement Learning for LLM Multi-Step Reasoning
par: Wang, Huaijie, et autres
Publié: (2024)
par: Wang, Huaijie, et autres
Publié: (2024)
What Defines Good Reasoning in LLMs? Dissecting Reasoning Steps with Multi-Aspect Evaluation
par: Do, Heejin, et autres
Publié: (2025)
par: Do, Heejin, et autres
Publié: (2025)
Supervised Reinforcement Learning: From Expert Trajectories to Step-wise Reasoning
par: Deng, Yihe, et autres
Publié: (2025)
par: Deng, Yihe, et autres
Publié: (2025)
Mind the Gap Between Spatial Reasoning and Acting! Step-by-Step Evaluation of Agents With Spatial-Gym
par: Kaesberg, Lars Benedikt, et autres
Publié: (2026)
par: Kaesberg, Lars Benedikt, et autres
Publié: (2026)
StepHint: Multi-level Stepwise Hints Enhance Reinforcement Learning to Reason
par: Zhang, Kaiyi, et autres
Publié: (2025)
par: Zhang, Kaiyi, et autres
Publié: (2025)
Step-by-Step Reasoning to Solve Grid Puzzles: Where do LLMs Falter?
par: Tyagi, Nemika, et autres
Publié: (2024)
par: Tyagi, Nemika, et autres
Publié: (2024)
Emergent Hierarchical Reasoning in LLMs through Reinforcement Learning
par: Wang, Haozhe, et autres
Publié: (2025)
par: Wang, Haozhe, et autres
Publié: (2025)
CRISP: Complex Reasoning with Interpretable Step-based Plans
par: Vetzler, Matan, et autres
Publié: (2025)
par: Vetzler, Matan, et autres
Publié: (2025)
Plan Then Action:High-Level Planning Guidance Reinforcement Learning for LLM Reasoning
par: Dou, Zhihao, et autres
Publié: (2025)
par: Dou, Zhihao, et autres
Publié: (2025)
Cross-lingual Few-shot Learning for Persian Sentiment Analysis with Incremental Adaptation
par: Majidi, Farideh, et autres
Publié: (2025)
par: Majidi, Farideh, et autres
Publié: (2025)
SuperCLUE-Math6: Graded Multi-Step Math Reasoning Benchmark for LLMs in Chinese
par: Xu, Liang, et autres
Publié: (2024)
par: Xu, Liang, et autres
Publié: (2024)
Tracking the Limits of Knowledge Propagation: How LLMs Fail at Multi-Step Reasoning with Conflicting Knowledge
par: Feng, Yiyang, et autres
Publié: (2026)
par: Feng, Yiyang, et autres
Publié: (2026)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
par: Chen, Mingyang, et autres
Publié: (2025)
par: Chen, Mingyang, et autres
Publié: (2025)
Unleashing Embodied Task Planning Ability in LLMs via Reinforcement Learning
par: Fei, Zhaoye, et autres
Publié: (2025)
par: Fei, Zhaoye, et autres
Publié: (2025)
Do LLMs Really Think Step-by-step In Implicit Reasoning?
par: Yu, Yijiong
Publié: (2024)
par: Yu, Yijiong
Publié: (2024)
From Human Cognition to Neural Activations: Probing the Computational Primitives of Spatial Reasoning in LLMs
par: An, Jiyuan, et autres
Publié: (2026)
par: An, Jiyuan, et autres
Publié: (2026)
MedReason: Eliciting Factual Medical Reasoning Steps in LLMs via Knowledge Graphs
par: Wu, Juncheng, et autres
Publié: (2025)
par: Wu, Juncheng, et autres
Publié: (2025)
YouTube Comments Decoded: Leveraging LLMs for Low Resource Language Classification
par: Deroy, Aniket, et autres
Publié: (2024)
par: Deroy, Aniket, et autres
Publié: (2024)
Generative Floor Plan Design with LLMs via Reinforcement Learning with Verifiable Rewards
par: Lara, Luis, et autres
Publié: (2026)
par: Lara, Luis, et autres
Publié: (2026)
From Query to Logic: Ontology-Driven Multi-Hop Reasoning in LLMs
par: Bian, Haonan, et autres
Publié: (2025)
par: Bian, Haonan, et autres
Publié: (2025)
RuPLaR : Efficient Latent Compression of LLM Reasoning Chains with Rule-Based Priors From Multi-Step to One-Step
par: Luo, Xiaocheng, et autres
Publié: (2026)
par: Luo, Xiaocheng, et autres
Publié: (2026)
R1-Code-Interpreter: LLMs Reason with Code via Supervised and Multi-stage Reinforcement Learning
par: Chen, Yongchao, et autres
Publié: (2025)
par: Chen, Yongchao, et autres
Publié: (2025)
Reinforcement Learning with Verifiable Rewards Implicitly Incentivizes Correct Reasoning in Base LLMs
par: Wen, Xumeng, et autres
Publié: (2025)
par: Wen, Xumeng, et autres
Publié: (2025)
From Roots to Rewards: Dynamic Tree Reasoning with Reinforcement Learning
par: Bahloul, Ahmed, et autres
Publié: (2025)
par: Bahloul, Ahmed, et autres
Publié: (2025)
Reinforced Context Order Recovery for Adaptive Reasoning and Planning
par: Ma, Long, et autres
Publié: (2025)
par: Ma, Long, et autres
Publié: (2025)
Teaching LLMs for Step-Level Automatic Math Correction via Reinforcement Learning
par: Li, Junsong, et autres
Publié: (2025)
par: Li, Junsong, et autres
Publié: (2025)
Reinforcement Learning for Diffusion LLMs with Entropy-Guided Step Selection and Stepwise Advantages
par: Kunde, Vishnu Teja, et autres
Publié: (2026)
par: Kunde, Vishnu Teja, et autres
Publié: (2026)
Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs
par: Lai, Xin, et autres
Publié: (2024)
par: Lai, Xin, et autres
Publié: (2024)
Collaborative Multi-Agent Test-Time Reinforcement Learning for Reasoning
par: Hu, Zhiyuan, et autres
Publié: (2026)
par: Hu, Zhiyuan, et autres
Publié: (2026)
Discovering Process-Outcome Credit in Multi-Step LLM Reasoning
par: Wang, Xiangwei, et autres
Publié: (2026)
par: Wang, Xiangwei, et autres
Publié: (2026)
LLM-BABYBENCH: Understanding and Evaluating Grounded Planning and Reasoning in LLMs
par: Choukrani, Omar, et autres
Publié: (2025)
par: Choukrani, Omar, et autres
Publié: (2025)
From Pixels to Policies: Reinforcing Spatial Reasoning in Language Models for Content-Aware Layout Design
par: Li, Sha, et autres
Publié: (2026)
par: Li, Sha, et autres
Publié: (2026)
Ring-lite: Scalable Reasoning via C3PO-Stabilized Reinforcement Learning for LLMs
par: Ling Team, et autres
Publié: (2025)
par: Ling Team, et autres
Publié: (2025)
KG-Hopper: Empowering Compact Open LLMs with Knowledge Graph Reasoning via Reinforcement Learning
par: Wang, Shuai, et autres
Publié: (2026)
par: Wang, Shuai, et autres
Publié: (2026)
Dspy-based Neural-Symbolic Pipeline to Enhance Spatial Reasoning in LLMs
par: Wang, Rong, et autres
Publié: (2024)
par: Wang, Rong, et autres
Publié: (2024)
SpatialThinker: Reinforcing 3D Reasoning in Multimodal LLMs via Spatial Rewards
par: Batra, Hunar, et autres
Publié: (2025)
par: Batra, Hunar, et autres
Publié: (2025)
Unlocking Reasoning Capabilities in LLMs via Reinforcement Learning Exploration
par: Deng, Wenhao, et autres
Publié: (2025)
par: Deng, Wenhao, et autres
Publié: (2025)
PLAN-TUNING: Post-Training Language Models to Learn Step-by-Step Planning for Complex Problem Solving
par: Parmar, Mihir, et autres
Publié: (2025)
par: Parmar, Mihir, et autres
Publié: (2025)
Documents similaires
-
R3-RAG: Learning Step-by-Step Reasoning and Retrieval for LLMs via Reinforcement Learning
par: Li, Yuan, et autres
Publié: (2025) -
Zonal RL-RRT: Integrated RL-RRT Path Planning with Collision Probability and Zone Connectivity
par: Tahmasbi, AmirMohammad, et autres
Publié: (2024) -
Offline Reinforcement Learning for LLM Multi-Step Reasoning
par: Wang, Huaijie, et autres
Publié: (2024) -
What Defines Good Reasoning in LLMs? Dissecting Reasoning Steps with Multi-Aspect Evaluation
par: Do, Heejin, et autres
Publié: (2025) -
Supervised Reinforcement Learning: From Expert Trajectories to Step-wise Reasoning
par: Deng, Yihe, et autres
Publié: (2025)