Atom of Thoughts for Markov LLM Test-Time Scaling
Fuente:
arXiv
Salvato in:
| Autori principali: | Teng, Fengwei, Shi, Quan, Yu, Zhaoyang, Zhang, Jiayi, Luo, Yuyu, Wu, Chenglin, Guo, Zhijiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Self-Supervised Prompt Optimization
di: Xiang, Jinyu, et al.
Pubblicazione: (2025)
di: Xiang, Jinyu, et al.
Pubblicazione: (2025)
AFlow: Automating Agentic Workflow Generation
di: Zhang, Jiayi, et al.
Pubblicazione: (2024)
di: Zhang, Jiayi, et al.
Pubblicazione: (2024)
ReCode: Unify Plan and Action for Universal Granularity Control
di: Yu, Zhaoyang, et al.
Pubblicazione: (2025)
di: Yu, Zhaoyang, et al.
Pubblicazione: (2025)
MetaScale: Test-Time Scaling with Evolving Meta-Thoughts
di: Liu, Qin, et al.
Pubblicazione: (2025)
di: Liu, Qin, et al.
Pubblicazione: (2025)
Scalable Environments Drive Generalizable Agents
di: Zhang, Jiayi, et al.
Pubblicazione: (2026)
di: Zhang, Jiayi, et al.
Pubblicazione: (2026)
AutoEnv: Automated Environments for Measuring Cross-Environment Agent Learning
di: Zhang, Jiayi, et al.
Pubblicazione: (2025)
di: Zhang, Jiayi, et al.
Pubblicazione: (2025)
Long-Document QA with Chain-of-Structured-Thought and Fine-Tuned SLMs
di: Liang, Zhuowen, et al.
Pubblicazione: (2026)
di: Liang, Zhuowen, et al.
Pubblicazione: (2026)
Co-Evolution of Policy and Internal Reward for Language Agents
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
ReasonFlux: Hierarchical LLM Reasoning via Scaling Thought Templates
di: Yang, Ling, et al.
Pubblicazione: (2025)
di: Yang, Ling, et al.
Pubblicazione: (2025)
Revisiting the Effectiveness of LLM Pruning for Test-Time Scaling
di: Monjur, Ocean, et al.
Pubblicazione: (2026)
di: Monjur, Ocean, et al.
Pubblicazione: (2026)
Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM Reasoning
di: Bi, Zhenni, et al.
Pubblicazione: (2024)
di: Bi, Zhenni, et al.
Pubblicazione: (2024)
It's Not That Simple. An Analysis of Simple Test-Time Scaling
di: Wu, Guojun
Pubblicazione: (2025)
di: Wu, Guojun
Pubblicazione: (2025)
CodeScaler: Scaling Code LLM Training and Test-Time Inference via Reward Models
di: Zhu, Xiao, et al.
Pubblicazione: (2026)
di: Zhu, Xiao, et al.
Pubblicazione: (2026)
AOrchestra: Automating Sub-Agent Creation for Agentic Orchestration
di: Ruan, Jianhao, et al.
Pubblicazione: (2026)
di: Ruan, Jianhao, et al.
Pubblicazione: (2026)
MarkovScale: Towards Optimal Sequential Scaling at Inference Time
di: Wang, Youkang, et al.
Pubblicazione: (2026)
di: Wang, Youkang, et al.
Pubblicazione: (2026)
Duel-Evolve: Reward-Free Test-Time Scaling via LLM Self-Preferences
di: Karlekar, Sweta, et al.
Pubblicazione: (2026)
di: Karlekar, Sweta, et al.
Pubblicazione: (2026)
On the Role of Temperature Sampling in Test-Time Scaling
di: Wu, Yuheng, et al.
Pubblicazione: (2025)
di: Wu, Yuheng, et al.
Pubblicazione: (2025)
Prompting Test-Time Scaling Is A Strong LLM Reasoning Data Augmentation
di: Bsharat, Sondos Mahmoud, et al.
Pubblicazione: (2025)
di: Bsharat, Sondos Mahmoud, et al.
Pubblicazione: (2025)
Mode-Conditioning Unlocks Superior Test-Time Scaling
di: Wu, Chen Henry, et al.
Pubblicazione: (2025)
di: Wu, Chen Henry, et al.
Pubblicazione: (2025)
VisJudge-Bench: Aesthetics and Quality Assessment of Visualizations
di: Xie, Yupeng, et al.
Pubblicazione: (2025)
di: Xie, Yupeng, et al.
Pubblicazione: (2025)
Enhancing LLM Reasoning via Critique Models with Test-Time and Training-Time Supervision
di: Xi, Zhiheng, et al.
Pubblicazione: (2024)
di: Xi, Zhiheng, et al.
Pubblicazione: (2024)
Rethinking the Unsolvable: When In-Context Search Meets Test-Time Scaling
di: Xia, Fanzeng, et al.
Pubblicazione: (2025)
di: Xia, Fanzeng, et al.
Pubblicazione: (2025)
Trainable Dynamic Mask Sparse Attention
di: Shi, Jingze, et al.
Pubblicazione: (2025)
di: Shi, Jingze, et al.
Pubblicazione: (2025)
SmartSwitch: Advancing LLM Reasoning by Overcoming Underthinking via Promoting Deeper Thought Exploration
di: Zhang, Xichen, et al.
Pubblicazione: (2025)
di: Zhang, Xichen, et al.
Pubblicazione: (2025)
Rethinking the Role of Prompting Strategies in LLM Test-Time Scaling: A Perspective of Probability Theory
di: Liu, Yexiang, et al.
Pubblicazione: (2025)
di: Liu, Yexiang, et al.
Pubblicazione: (2025)
Crosslingual Reasoning through Test-Time Scaling
di: Yong, Zheng-Xin, et al.
Pubblicazione: (2025)
di: Yong, Zheng-Xin, et al.
Pubblicazione: (2025)
Revisiting the Test-Time Scaling of o1-like Models: Do they Truly Possess Test-Time Scaling Capabilities?
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2025)
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2025)
Reinforcement Learning Teachers of Test Time Scaling
di: Cetin, Edoardo, et al.
Pubblicazione: (2025)
di: Cetin, Edoardo, et al.
Pubblicazione: (2025)
Self-Improving LLM Agents at Test-Time
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2025)
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2025)
In-Place Test-Time Training
di: Feng, Guhao, et al.
Pubblicazione: (2026)
di: Feng, Guhao, et al.
Pubblicazione: (2026)
Scaling over Scaling: Exploring Test-Time Scaling Plateau in Large Reasoning Models
di: Wang, Jian, et al.
Pubblicazione: (2025)
di: Wang, Jian, et al.
Pubblicazione: (2025)
Log-Augmented Generation: Scaling Test-Time Reasoning with Reusable Computation
di: Chen, Peter Baile, et al.
Pubblicazione: (2025)
di: Chen, Peter Baile, et al.
Pubblicazione: (2025)
RedStar: Does Scaling Long-CoT Data Unlock Better Slow-Reasoning Systems?
di: Xu, Haotian, et al.
Pubblicazione: (2025)
di: Xu, Haotian, et al.
Pubblicazione: (2025)
Online Reasoning Calibration: Test-Time Training Enables Generalizable Conformal LLM Reasoning
di: Zhou, Cai, et al.
Pubblicazione: (2026)
di: Zhou, Cai, et al.
Pubblicazione: (2026)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
di: Ye, Jiacheng, et al.
Pubblicazione: (2024)
di: Ye, Jiacheng, et al.
Pubblicazione: (2024)
Entropy Centroids as Intrinsic Rewards for Test-Time Scaling
di: Zhao, Wenshuo, et al.
Pubblicazione: (2026)
di: Zhao, Wenshuo, et al.
Pubblicazione: (2026)
Parallel Test-Time Scaling for Latent Reasoning Models
di: You, Runyang, et al.
Pubblicazione: (2025)
di: You, Runyang, et al.
Pubblicazione: (2025)
Iterative Deepening Sampling as Efficient Test-Time Scaling
di: Chen, Weizhe, et al.
Pubblicazione: (2025)
di: Chen, Weizhe, et al.
Pubblicazione: (2025)
Efficient Test-Time Scaling via Self-Calibration
di: Huang, Chengsong, et al.
Pubblicazione: (2025)
di: Huang, Chengsong, et al.
Pubblicazione: (2025)
Dynamic Experts Search: Enhancing Reasoning in Mixture-of-Experts LLMs at Test Time
di: Han, Yixuan, et al.
Pubblicazione: (2025)
di: Han, Yixuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Self-Supervised Prompt Optimization
di: Xiang, Jinyu, et al.
Pubblicazione: (2025) -
AFlow: Automating Agentic Workflow Generation
di: Zhang, Jiayi, et al.
Pubblicazione: (2024) -
ReCode: Unify Plan and Action for Universal Granularity Control
di: Yu, Zhaoyang, et al.
Pubblicazione: (2025) -
MetaScale: Test-Time Scaling with Evolving Meta-Thoughts
di: Liu, Qin, et al.
Pubblicazione: (2025) -
Scalable Environments Drive Generalizable Agents
di: Zhang, Jiayi, et al.
Pubblicazione: (2026)