Iterative Deepening Sampling as Efficient Test-Time Scaling
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Weizhe, Koenig, Sven, Dilkina, Bistra |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RePrompt: Planning by Automatic Prompt Engineering for Large Language Models Agents
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
LSPO: Length-aware Dynamic Sampling for Policy Optimization in LLM Reasoning
di: Chen, Weizhe, et al.
Pubblicazione: (2025)
di: Chen, Weizhe, et al.
Pubblicazione: (2025)
Why Solving Multi-agent Path Finding with Large Language Model has not Succeeded Yet
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
MARL-LNS: Cooperative Multi-agent Reinforcement Learning via Large Neighborhoods Search
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
TrimR: Verifier-based Training-Free Thinking Compression for Efficient Test-Time Scaling
di: Lin, Weizhe, et al.
Pubblicazione: (2025)
di: Lin, Weizhe, et al.
Pubblicazione: (2025)
On the Role of Temperature Sampling in Test-Time Scaling
di: Wu, Yuheng, et al.
Pubblicazione: (2025)
di: Wu, Yuheng, et al.
Pubblicazione: (2025)
Learning Backdoors for Mixed Integer Linear Programs with Contrastive Learning
di: Cai, Junyang, et al.
Pubblicazione: (2024)
di: Cai, Junyang, et al.
Pubblicazione: (2024)
Balans: Multi-Armed Bandits-based Adaptive Large Neighborhood Search for Mixed-Integer Programming Problem
di: Cai, Junyang, et al.
Pubblicazione: (2024)
di: Cai, Junyang, et al.
Pubblicazione: (2024)
Multi-task Representation Learning for Mixed Integer Linear Programming
di: Cai, Junyang, et al.
Pubblicazione: (2024)
di: Cai, Junyang, et al.
Pubblicazione: (2024)
Efficient Test-Time Scaling via Self-Calibration
di: Huang, Chengsong, et al.
Pubblicazione: (2025)
di: Huang, Chengsong, et al.
Pubblicazione: (2025)
ParBalans: Parallel Multi-Armed Bandits-based Adaptive Large Neighborhood Search
di: Yilmaz, Alican, et al.
Pubblicazione: (2025)
di: Yilmaz, Alican, et al.
Pubblicazione: (2025)
Adaptive Anytime Multi-Agent Path Finding Using Bandit-Based Large Neighborhood Search
di: Phan, Thomy, et al.
Pubblicazione: (2023)
di: Phan, Thomy, et al.
Pubblicazione: (2023)
MetaScale: Test-Time Scaling with Evolving Meta-Thoughts
di: Liu, Qin, et al.
Pubblicazione: (2025)
di: Liu, Qin, et al.
Pubblicazione: (2025)
Mode-Conditioning Unlocks Superior Test-Time Scaling
di: Wu, Chen Henry, et al.
Pubblicazione: (2025)
di: Wu, Chen Henry, et al.
Pubblicazione: (2025)
DynScaling: Efficient Verifier-free Inference Scaling via Dynamic and Integrated Sampling
di: Wang, Fei, et al.
Pubblicazione: (2025)
di: Wang, Fei, et al.
Pubblicazione: (2025)
StructEval: Deepen and Broaden Large Language Model Assessment via Structured Evaluation
di: Cao, Boxi, et al.
Pubblicazione: (2024)
di: Cao, Boxi, et al.
Pubblicazione: (2024)
Revisiting the Test-Time Scaling of o1-like Models: Do they Truly Possess Test-Time Scaling Capabilities?
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2025)
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2025)
It's Not That Simple. An Analysis of Simple Test-Time Scaling
di: Wu, Guojun
Pubblicazione: (2025)
di: Wu, Guojun
Pubblicazione: (2025)
Crosslingual Reasoning through Test-Time Scaling
di: Yong, Zheng-Xin, et al.
Pubblicazione: (2025)
di: Yong, Zheng-Xin, et al.
Pubblicazione: (2025)
Reinforcement Learning Teachers of Test Time Scaling
di: Cetin, Edoardo, et al.
Pubblicazione: (2025)
di: Cetin, Edoardo, et al.
Pubblicazione: (2025)
Provable Scaling Laws for the Test-Time Compute of Large Language Models
di: Chen, Yanxi, et al.
Pubblicazione: (2024)
di: Chen, Yanxi, et al.
Pubblicazione: (2024)
Log-Augmented Generation: Scaling Test-Time Reasoning with Reusable Computation
di: Chen, Peter Baile, et al.
Pubblicazione: (2025)
di: Chen, Peter Baile, et al.
Pubblicazione: (2025)
Scaling over Scaling: Exploring Test-Time Scaling Plateau in Large Reasoning Models
di: Wang, Jian, et al.
Pubblicazione: (2025)
di: Wang, Jian, et al.
Pubblicazione: (2025)
Parallel Test-Time Scaling for Latent Reasoning Models
di: You, Runyang, et al.
Pubblicazione: (2025)
di: You, Runyang, et al.
Pubblicazione: (2025)
Atom of Thoughts for Markov LLM Test-Time Scaling
di: Teng, Fengwei, et al.
Pubblicazione: (2025)
di: Teng, Fengwei, et al.
Pubblicazione: (2025)
Entropy Centroids as Intrinsic Rewards for Test-Time Scaling
di: Zhao, Wenshuo, et al.
Pubblicazione: (2026)
di: Zhao, Wenshuo, et al.
Pubblicazione: (2026)
Revisiting the Effectiveness of LLM Pruning for Test-Time Scaling
di: Monjur, Ocean, et al.
Pubblicazione: (2026)
di: Monjur, Ocean, et al.
Pubblicazione: (2026)
Flaming-hot Initiation with Regular Execution Sampling for Large Language Models
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
Rethinking the Unsolvable: When In-Context Search Meets Test-Time Scaling
di: Xia, Fanzeng, et al.
Pubblicazione: (2025)
di: Xia, Fanzeng, et al.
Pubblicazione: (2025)
$\texttt{SPECS}$: Faster Test-Time Scaling through Speculative Drafts
di: Cemri, Mert, et al.
Pubblicazione: (2025)
di: Cemri, Mert, et al.
Pubblicazione: (2025)
Strategic Scaling of Test-Time Compute: A Bandit Learning Approach
di: Zuo, Bowen, et al.
Pubblicazione: (2025)
di: Zuo, Bowen, et al.
Pubblicazione: (2025)
Less Diverse, Less Safe: The Indirect But Pervasive Risk of Test-Time Scaling in Large Language Models
di: Nahin, Shahriar Kabir, et al.
Pubblicazione: (2025)
di: Nahin, Shahriar Kabir, et al.
Pubblicazione: (2025)
Test-Time Scaling in Reasoning Models Is Not Effective for Knowledge-Intensive Tasks Yet
di: Zhao, James Xu, et al.
Pubblicazione: (2025)
di: Zhao, James Xu, et al.
Pubblicazione: (2025)
Prompting Test-Time Scaling Is A Strong LLM Reasoning Data Augmentation
di: Bsharat, Sondos Mahmoud, et al.
Pubblicazione: (2025)
di: Bsharat, Sondos Mahmoud, et al.
Pubblicazione: (2025)
Sample-Efficient Alignment for LLMs
di: Liu, Zichen, et al.
Pubblicazione: (2024)
di: Liu, Zichen, et al.
Pubblicazione: (2024)
Scaling Test-Time Compute for Agentic Coding
di: Kim, Joongwon, et al.
Pubblicazione: (2026)
di: Kim, Joongwon, et al.
Pubblicazione: (2026)
Scaling Test-Time Compute to Achieve IOI Gold Medal with Open-Weight Models
di: Samadi, Mehrzad, et al.
Pubblicazione: (2025)
di: Samadi, Mehrzad, et al.
Pubblicazione: (2025)
TaTToo: Tool-Grounded Thinking PRM for Test-Time Scaling in Tabular Reasoning
di: Zou, Jiaru, et al.
Pubblicazione: (2025)
di: Zou, Jiaru, et al.
Pubblicazione: (2025)
Duel-Evolve: Reward-Free Test-Time Scaling via LLM Self-Preferences
di: Karlekar, Sweta, et al.
Pubblicazione: (2026)
di: Karlekar, Sweta, et al.
Pubblicazione: (2026)
Aligning Tree-Search Policies with Fixed Token Budgets in Test-Time Scaling of LLMs
di: Miyamoto, Sora, et al.
Pubblicazione: (2026)
di: Miyamoto, Sora, et al.
Pubblicazione: (2026)
Documenti analoghi
-
RePrompt: Planning by Automatic Prompt Engineering for Large Language Models Agents
di: Chen, Weizhe, et al.
Pubblicazione: (2024) -
LSPO: Length-aware Dynamic Sampling for Policy Optimization in LLM Reasoning
di: Chen, Weizhe, et al.
Pubblicazione: (2025) -
Why Solving Multi-agent Path Finding with Large Language Model has not Succeeded Yet
di: Chen, Weizhe, et al.
Pubblicazione: (2024) -
MARL-LNS: Cooperative Multi-agent Reinforcement Learning via Large Neighborhoods Search
di: Chen, Weizhe, et al.
Pubblicazione: (2024) -
TrimR: Verifier-based Training-Free Thinking Compression for Efficient Test-Time Scaling
di: Lin, Weizhe, et al.
Pubblicazione: (2025)