Policy-Guided Search on Tree-of-Thoughts for Efficient Problem Solving with Bounded Language Model Queries
Fuente:
arXiv
Saved in:
| Main Authors: | Pendurkar, Sumedh, Sharon, Guni |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Tree of Thoughts as a Classical Heuristic Search Problem: Formal Foundations and Design Patterns
by: Sharon, Guni
Published: (2026)
by: Sharon, Guni
Published: (2026)
Graph of Thoughts: Solving Elaborate Problems with Large Language Models
by: Besta, Maciej, et al.
Published: (2023)
by: Besta, Maciej, et al.
Published: (2023)
Boosting of Thoughts: Trial-and-Error Problem Solving with Large Language Models
by: Chen, Sijia, et al.
Published: (2024)
by: Chen, Sijia, et al.
Published: (2024)
Value-Guided Search for Efficient Chain-of-Thought Reasoning
by: Wang, Kaiwen, et al.
Published: (2025)
by: Wang, Kaiwen, et al.
Published: (2025)
Policy Guided Tree Search for Enhanced LLM Reasoning
by: Li, Yang
Published: (2025)
by: Li, Yang
Published: (2025)
Efficient Graph Understanding with LLMs via Structured Context Injection
by: Waghmare, Govind, et al.
Published: (2025)
by: Waghmare, Govind, et al.
Published: (2025)
Solving Probabilistic Verification Problems of Neural Networks using Branch and Bound
by: Boetius, David, et al.
Published: (2024)
by: Boetius, David, et al.
Published: (2024)
Edge-Selector Model Applied for Local Search Neighborhood for Solving Vehicle Routing Problems
by: Herdianto, Bachtiar, et al.
Published: (2025)
by: Herdianto, Bachtiar, et al.
Published: (2025)
Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models
by: Cui, Yingqian, et al.
Published: (2025)
by: Cui, Yingqian, et al.
Published: (2025)
Offline Model-Based Optimization via Policy-Guided Gradient Search
by: Chemingui, Yassine, et al.
Published: (2024)
by: Chemingui, Yassine, et al.
Published: (2024)
Synthesizing Programmatic Reinforcement Learning Policies with Large Language Model Guided Search
by: Liu, Max, et al.
Published: (2024)
by: Liu, Max, et al.
Published: (2024)
OR-Toolformer: Modeling and Solving Operations Research Problems with Tool Augmented Large Language Models
by: Zhang, Jianzhang, et al.
Published: (2025)
by: Zhang, Jianzhang, et al.
Published: (2025)
Creative Problem Solving in Large Language and Vision Models -- What Would it Take?
by: Nair, Lakshmi, et al.
Published: (2024)
by: Nair, Lakshmi, et al.
Published: (2024)
The DeepXube Software Package for Solving Pathfinding Problems with Learned Heuristic Functions and Search
by: Agostinelli, Forest
Published: (2026)
by: Agostinelli, Forest
Published: (2026)
ORION: Teaching Language Models to Reason Efficiently in the Language of Thought
by: Tanmay, Kumar, et al.
Published: (2025)
by: Tanmay, Kumar, et al.
Published: (2025)
Learning Solution-Aware Transformers for Efficiently Solving Quadratic Assignment Problem
by: Tan, Zhentao, et al.
Published: (2024)
by: Tan, Zhentao, et al.
Published: (2024)
Retrieval-of-Thought: Efficient Reasoning via Reusing Thoughts
by: Ahmed, Ammar, et al.
Published: (2025)
by: Ahmed, Ammar, et al.
Published: (2025)
Efficient Perplexity Bound and Ratio Matching in Discrete Diffusion Language Models
by: Haxholli, Etrit, et al.
Published: (2025)
by: Haxholli, Etrit, et al.
Published: (2025)
Synergy-of-Thoughts: Eliciting Efficient Reasoning in Hybrid Language Models
by: Shang, Yu, et al.
Published: (2024)
by: Shang, Yu, et al.
Published: (2024)
In Search of Trees: Decision-Tree Policy Synthesis for Black-Box Systems via Search
by: Demirović, Emir, et al.
Published: (2024)
by: Demirović, Emir, et al.
Published: (2024)
Continuous Optimization for Feature Selection with Permutation-Invariant Embedding and Policy-Guided Search
by: Liu, Rui, et al.
Published: (2025)
by: Liu, Rui, et al.
Published: (2025)
Success Conditioning as Policy Improvement: The Optimization Problem Solved by Imitating Success
by: Russo, Daniel
Published: (2026)
by: Russo, Daniel
Published: (2026)
Pass@K Policy Optimization: Solving Harder Reinforcement Learning Problems
by: Walder, Christian, et al.
Published: (2025)
by: Walder, Christian, et al.
Published: (2025)
Position: Rethinking Post-Hoc Search-Based Neural Approaches for Solving Large-Scale Traveling Salesman Problems
by: Xia, Yifan, et al.
Published: (2024)
by: Xia, Yifan, et al.
Published: (2024)
Regret-Guided Search Control for Efficient Learning in AlphaZero
by: Tsai, Yun-Jui, et al.
Published: (2026)
by: Tsai, Yun-Jui, et al.
Published: (2026)
Towards Learning Foundation Models for Heuristic Functions to Solve Pathfinding Problems
by: Khandelwal, Vedant, et al.
Published: (2024)
by: Khandelwal, Vedant, et al.
Published: (2024)
Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training
by: Feng, Xidong, et al.
Published: (2023)
by: Feng, Xidong, et al.
Published: (2023)
Rethinking the Potential of Multimodality in Collaborative Problem Solving Diagnosis with Large Language Models
by: Wong, K., et al.
Published: (2025)
by: Wong, K., et al.
Published: (2025)
BIPEFT: Budget-Guided Iterative Search for Parameter Efficient Fine-Tuning of Large Pretrained Language Models
by: Chang, Aofei, et al.
Published: (2024)
by: Chang, Aofei, et al.
Published: (2024)
Solving for X and Beyond: Can Large Language Models Solve Complex Math Problems with More-Than-Two Unknowns?
by: Kao, Kuei-Chun, et al.
Published: (2024)
by: Kao, Kuei-Chun, et al.
Published: (2024)
Knowledge Graph Modeling-Driven Large Language Model Operating System (LLM OS) for Task Automation in Process Engineering Problem-Solving
by: Srinivas, Sakhinana Sagar, et al.
Published: (2024)
by: Srinivas, Sakhinana Sagar, et al.
Published: (2024)
Matching Problems to Solutions: An Explainable Way of Solving Machine Learning Problems
by: Saleh, Lokman, et al.
Published: (2024)
by: Saleh, Lokman, et al.
Published: (2024)
Unsupervised Learning for Solving the Travelling Salesman Problem
by: Min, Yimeng, et al.
Published: (2023)
by: Min, Yimeng, et al.
Published: (2023)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
by: Ye, Jiacheng, et al.
Published: (2024)
by: Ye, Jiacheng, et al.
Published: (2024)
Assessing Large Language Models for Automated Feedback Generation in Learning Programming Problem Solving
by: Silva, Priscylla, et al.
Published: (2025)
by: Silva, Priscylla, et al.
Published: (2025)
Do Language Models Exhibit the Same Cognitive Biases in Problem Solving as Human Learners?
by: Opedal, Andreas, et al.
Published: (2024)
by: Opedal, Andreas, et al.
Published: (2024)
Variance-Aware Prior-Based Tree Policies for Monte Carlo Tree Search
by: Weichart, Maximilian
Published: (2025)
by: Weichart, Maximilian
Published: (2025)
An Efficient Reconstructed Differential Evolution Variant by Some of the Current State-of-the-art Strategies for Solving Single Objective Bound Constrained Problems
by: Tao, Sichen, et al.
Published: (2024)
by: Tao, Sichen, et al.
Published: (2024)
CORL: Reinforcement Learning of MILP Policies Solved via Branch and Bound
by: Anand, Akhil S, et al.
Published: (2025)
by: Anand, Akhil S, et al.
Published: (2025)
Limits of PRM-Guided Tree Search for Mathematical Reasoning with LLMs
by: Cinquin, Tristan, et al.
Published: (2025)
by: Cinquin, Tristan, et al.
Published: (2025)
Similar Items
-
Tree of Thoughts as a Classical Heuristic Search Problem: Formal Foundations and Design Patterns
by: Sharon, Guni
Published: (2026) -
Graph of Thoughts: Solving Elaborate Problems with Large Language Models
by: Besta, Maciej, et al.
Published: (2023) -
Boosting of Thoughts: Trial-and-Error Problem Solving with Large Language Models
by: Chen, Sijia, et al.
Published: (2024) -
Value-Guided Search for Efficient Chain-of-Thought Reasoning
by: Wang, Kaiwen, et al.
Published: (2025) -
Policy Guided Tree Search for Enhanced LLM Reasoning
by: Li, Yang
Published: (2025)