Towards Thinking-Optimal Scaling of Test-Time Compute for LLM Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Wenkai, Ma, Shuming, Lin, Yankai, Wei, Furu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LongReasonArena: A Long Reasoning Benchmark for Large Language Models
di: Ding, Jiayu, et al.
Pubblicazione: (2025)
di: Ding, Jiayu, et al.
Pubblicazione: (2025)
Auto-ICL: In-Context Learning without Human Supervision
di: Yang, Jinghan, et al.
Pubblicazione: (2023)
di: Yang, Jinghan, et al.
Pubblicazione: (2023)
Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM Reasoning
di: Bi, Zhenni, et al.
Pubblicazione: (2024)
di: Bi, Zhenni, et al.
Pubblicazione: (2024)
Exploring Backdoor Vulnerabilities of Chat Models
di: Hao, Yunzhuo, et al.
Pubblicazione: (2024)
di: Hao, Yunzhuo, et al.
Pubblicazione: (2024)
MatryoshkaThinking: Recursive Test-Time Scaling Enables Efficient Reasoning
di: Chen, Hongwei, et al.
Pubblicazione: (2025)
di: Chen, Hongwei, et al.
Pubblicazione: (2025)
DARC: Decoupled Asymmetric Reasoning Curriculum for LLM Evolution
di: Fan, Shengda, et al.
Pubblicazione: (2026)
di: Fan, Shengda, et al.
Pubblicazione: (2026)
Does Thinking More always Help? Mirage of Test-Time Scaling in Reasoning Models
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2025)
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2025)
Thinking Long, but Short: Stable Sequential Test-Time Scaling for Large Reasoning Models
di: Metel, Michael R., et al.
Pubblicazione: (2026)
di: Metel, Michael R., et al.
Pubblicazione: (2026)
Examining False Positives under Inference Scaling for Mathematical Reasoning
di: Wang, Yu, et al.
Pubblicazione: (2025)
di: Wang, Yu, et al.
Pubblicazione: (2025)
Watch Out for Your Agents! Investigating Backdoor Threats to LLM-Based Agents
di: Yang, Wenkai, et al.
Pubblicazione: (2024)
di: Yang, Wenkai, et al.
Pubblicazione: (2024)
ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute
di: Wen, Hao, et al.
Pubblicazione: (2025)
di: Wen, Hao, et al.
Pubblicazione: (2025)
MathScale: Scaling Instruction Tuning for Mathematical Reasoning
di: Tang, Zhengyang, et al.
Pubblicazione: (2024)
di: Tang, Zhengyang, et al.
Pubblicazione: (2024)
Thinking Slow, Fast: Scaling Inference Compute with Distilled Reasoners
di: Paliotta, Daniele, et al.
Pubblicazione: (2025)
di: Paliotta, Daniele, et al.
Pubblicazione: (2025)
DeepCritic: Deliberate Critique with Large Language Models
di: Yang, Wenkai, et al.
Pubblicazione: (2025)
di: Yang, Wenkai, et al.
Pubblicazione: (2025)
Multiplex Thinking: Reasoning via Token-wise Branch-and-Merge
di: Tang, Yao, et al.
Pubblicazione: (2026)
di: Tang, Yao, et al.
Pubblicazione: (2026)
Thinking by Subtraction: Confidence-Driven Contrastive Decoding for LLM Reasoning
di: Tang, Lexiang, et al.
Pubblicazione: (2026)
di: Tang, Lexiang, et al.
Pubblicazione: (2026)
Scaling Up, Speeding Up: A Benchmark of Speculative Decoding for Efficient LLM Test-Time Scaling
di: Sun, Shengyin, et al.
Pubblicazione: (2025)
di: Sun, Shengyin, et al.
Pubblicazione: (2025)
ThinkPilot: Steering Reasoning Models via Automated Think-prefixes Optimization
di: Li, Sunzhu, et al.
Pubblicazione: (2025)
di: Li, Sunzhu, et al.
Pubblicazione: (2025)
TaTToo: Tool-Grounded Thinking PRM for Test-Time Scaling in Tabular Reasoning
di: Zou, Jiaru, et al.
Pubblicazione: (2025)
di: Zou, Jiaru, et al.
Pubblicazione: (2025)
Inverse Scaling in Test-Time Compute
di: Gema, Aryo Pradipta, et al.
Pubblicazione: (2025)
di: Gema, Aryo Pradipta, et al.
Pubblicazione: (2025)
Scaling Optimal LR Across Token Horizons
di: Bjorck, Johan, et al.
Pubblicazione: (2024)
di: Bjorck, Johan, et al.
Pubblicazione: (2024)
Log-Augmented Generation: Scaling Test-Time Reasoning with Reusable Computation
di: Chen, Peter Baile, et al.
Pubblicazione: (2025)
di: Chen, Peter Baile, et al.
Pubblicazione: (2025)
Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation
di: Yang, Wenkai, et al.
Pubblicazione: (2026)
di: Yang, Wenkai, et al.
Pubblicazione: (2026)
Thinking on the Fly: Test-Time Reasoning Enhancement via Latent Thought Policy Optimization
di: Ye, Wengao, et al.
Pubblicazione: (2025)
di: Ye, Wengao, et al.
Pubblicazione: (2025)
Less is More: Improving LLM Reasoning with Minimal Test-Time Intervention
di: Yang, Zhen, et al.
Pubblicazione: (2025)
di: Yang, Zhen, et al.
Pubblicazione: (2025)
MarkovScale: Towards Optimal Sequential Scaling at Inference Time
di: Wang, Youkang, et al.
Pubblicazione: (2026)
di: Wang, Youkang, et al.
Pubblicazione: (2026)
Adaptive Rectification Sampling for Test-Time Compute Scaling
di: Tan, Zhendong, et al.
Pubblicazione: (2025)
di: Tan, Zhendong, et al.
Pubblicazione: (2025)
Benchmark Test-Time Scaling of General LLM Agents
di: Li, Xiaochuan, et al.
Pubblicazione: (2026)
di: Li, Xiaochuan, et al.
Pubblicazione: (2026)
Timely Machine: Awareness of Time Makes Test-Time Scaling Agentic
di: Ma, Yichuan, et al.
Pubblicazione: (2026)
di: Ma, Yichuan, et al.
Pubblicazione: (2026)
BEST-Route: Adaptive LLM Routing with Test-Time Optimal Compute
di: Ding, Dujian, et al.
Pubblicazione: (2025)
di: Ding, Dujian, et al.
Pubblicazione: (2025)
Prompting Test-Time Scaling Is A Strong LLM Reasoning Data Augmentation
di: Bsharat, Sondos Mahmoud, et al.
Pubblicazione: (2025)
di: Bsharat, Sondos Mahmoud, et al.
Pubblicazione: (2025)
Super(ficial)-alignment: Strong Models May Deceive Weak Models in Weak-to-Strong Generalization
di: Yang, Wenkai, et al.
Pubblicazione: (2024)
di: Yang, Wenkai, et al.
Pubblicazione: (2024)
Logical Reasoning with Outcome Reward Models for Test-Time Scaling
di: Thatikonda, Ramya Keerthy, et al.
Pubblicazione: (2025)
di: Thatikonda, Ramya Keerthy, et al.
Pubblicazione: (2025)
TrimR: Verifier-based Training-Free Thinking Compression for Efficient Test-Time Scaling
di: Lin, Weizhe, et al.
Pubblicazione: (2025)
di: Lin, Weizhe, et al.
Pubblicazione: (2025)
Think Again! The Effect of Test-Time Compute on Preferences, Opinions, and Beliefs of Large Language Models
di: Kour, George, et al.
Pubblicazione: (2025)
di: Kour, George, et al.
Pubblicazione: (2025)
TestNUC: Enhancing Test-Time Computing Approaches and Scaling through Neighboring Unlabeled Data Consistency
di: Zou, Henry Peng, et al.
Pubblicazione: (2025)
di: Zou, Henry Peng, et al.
Pubblicazione: (2025)
Thinking in Frames: How Visual Context and Test-Time Scaling Empower Video Reasoning
di: Li, Chengzu, et al.
Pubblicazione: (2026)
di: Li, Chengzu, et al.
Pubblicazione: (2026)
MiniLLM: On-Policy Distillation of Large Language Models
di: Gu, Yuxian, et al.
Pubblicazione: (2023)
di: Gu, Yuxian, et al.
Pubblicazione: (2023)
Thinking Fast, Thinking Wrong: Intuitiveness Modulates LLM Counterfactual Reasoning in Policy Evaluation
di: He, Yanjie
Pubblicazione: (2026)
di: He, Yanjie
Pubblicazione: (2026)
Compute Optimal Scaling of Skills: Knowledge vs Reasoning
di: Roberts, Nicholas, et al.
Pubblicazione: (2025)
di: Roberts, Nicholas, et al.
Pubblicazione: (2025)
Documenti analoghi
-
LongReasonArena: A Long Reasoning Benchmark for Large Language Models
di: Ding, Jiayu, et al.
Pubblicazione: (2025) -
Auto-ICL: In-Context Learning without Human Supervision
di: Yang, Jinghan, et al.
Pubblicazione: (2023) -
Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM Reasoning
di: Bi, Zhenni, et al.
Pubblicazione: (2024) -
Exploring Backdoor Vulnerabilities of Chat Models
di: Hao, Yunzhuo, et al.
Pubblicazione: (2024) -
MatryoshkaThinking: Recursive Test-Time Scaling Enables Efficient Reasoning
di: Chen, Hongwei, et al.
Pubblicazione: (2025)