It's Not That Simple. An Analysis of Simple Test-Time Scaling
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Wu, Guojun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ScaLearn: Simple and Highly Parameter-Efficient Task Transfer by Learning to Scale
par: Frohmann, Markus, et autres
Publié: (2023)
par: Frohmann, Markus, et autres
Publié: (2023)
Always Learning, Always Mixing: Efficient and Simple Data Mixing All The Time
par: Hu, Michael Y., et autres
Publié: (2026)
par: Hu, Michael Y., et autres
Publié: (2026)
SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling
par: Kim, Dahyun, et autres
Publié: (2023)
par: Kim, Dahyun, et autres
Publié: (2023)
On the Role of Temperature Sampling in Test-Time Scaling
par: Wu, Yuheng, et autres
Publié: (2025)
par: Wu, Yuheng, et autres
Publié: (2025)
s1: Simple test-time scaling
par: Muennighoff, Niklas, et autres
Publié: (2025)
par: Muennighoff, Niklas, et autres
Publié: (2025)
Can LLMs Follow Simple Rules?
par: Mu, Norman, et autres
Publié: (2023)
par: Mu, Norman, et autres
Publié: (2023)
SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning
par: Li, Haozhan, et autres
Publié: (2025)
par: Li, Haozhan, et autres
Publié: (2025)
Mode-Conditioning Unlocks Superior Test-Time Scaling
par: Wu, Chen Henry, et autres
Publié: (2025)
par: Wu, Chen Henry, et autres
Publié: (2025)
Simple and Effective Masked Diffusion Language Models
par: Sahoo, Subham Sekhar, et autres
Publié: (2024)
par: Sahoo, Subham Sekhar, et autres
Publié: (2024)
dLLM: Simple Diffusion Language Modeling
par: Zhou, Zhanhui, et autres
Publié: (2026)
par: Zhou, Zhanhui, et autres
Publié: (2026)
Atom of Thoughts for Markov LLM Test-Time Scaling
par: Teng, Fengwei, et autres
Publié: (2025)
par: Teng, Fengwei, et autres
Publié: (2025)
An Embarrassingly Simple Defense Against LLM Abliteration Attacks
par: Shairah, Harethah Abu, et autres
Publié: (2025)
par: Shairah, Harethah Abu, et autres
Publié: (2025)
No Mean Feat: Simple, Strong Baselines for Context Compression
par: Feldman, Yair, et autres
Publié: (2025)
par: Feldman, Yair, et autres
Publié: (2025)
Frontier LLMs Still Struggle with Simple Reasoning Tasks
par: Malek, Alan, et autres
Publié: (2025)
par: Malek, Alan, et autres
Publié: (2025)
Simple Policy Gradients for Reasoning with Diffusion Language Models
par: Zhan, Anthony
Publié: (2025)
par: Zhan, Anthony
Publié: (2025)
AIMA at SemEval-2024 Task 3: Simple Yet Powerful Emotion Cause Pair Analysis
par: Kure, Alireza Ghahramani, et autres
Publié: (2025)
par: Kure, Alireza Ghahramani, et autres
Publié: (2025)
Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes
par: Fu, Yuqian, et autres
Publié: (2026)
par: Fu, Yuqian, et autres
Publié: (2026)
A Simple and Effective Pruning Approach for Large Language Models
par: Sun, Mingjie, et autres
Publié: (2023)
par: Sun, Mingjie, et autres
Publié: (2023)
A Simple Attention-Based Mechanism for Bimodal Emotion Classification
par: Elabd, Mazen, et autres
Publié: (2024)
par: Elabd, Mazen, et autres
Publié: (2024)
SPA: A Simple but Tough-to-Beat Baseline for Knowledge Injection
par: Tang, Kexian, et autres
Publié: (2026)
par: Tang, Kexian, et autres
Publié: (2026)
Revisiting the Test-Time Scaling of o1-like Models: Do they Truly Possess Test-Time Scaling Capabilities?
par: Zeng, Zhiyuan, et autres
Publié: (2025)
par: Zeng, Zhiyuan, et autres
Publié: (2025)
MetaScale: Test-Time Scaling with Evolving Meta-Thoughts
par: Liu, Qin, et autres
Publié: (2025)
par: Liu, Qin, et autres
Publié: (2025)
Crosslingual Reasoning through Test-Time Scaling
par: Yong, Zheng-Xin, et autres
Publié: (2025)
par: Yong, Zheng-Xin, et autres
Publié: (2025)
Reinforcement Learning Teachers of Test Time Scaling
par: Cetin, Edoardo, et autres
Publié: (2025)
par: Cetin, Edoardo, et autres
Publié: (2025)
SSR-Zero: Simple Self-Rewarding Reinforcement Learning for Machine Translation
par: Yang, Wenjie, et autres
Publié: (2025)
par: Yang, Wenjie, et autres
Publié: (2025)
SiLQ: Simple Large Language Model Quantization-Aware Training
par: Esser, Steven K., et autres
Publié: (2025)
par: Esser, Steven K., et autres
Publié: (2025)
Simple and Scalable Strategies to Continually Pre-train Large Language Models
par: Ibrahim, Adam, et autres
Publié: (2024)
par: Ibrahim, Adam, et autres
Publié: (2024)
Incorporating Exponential Smoothing into MLP: A Simple but Effective Sequence Model
par: Chu, Jiqun, et autres
Publié: (2024)
par: Chu, Jiqun, et autres
Publié: (2024)
Towards Data-Centric RLHF: Simple Metrics for Preference Dataset Comparison
par: Shen, Judy Hanwen, et autres
Publié: (2024)
par: Shen, Judy Hanwen, et autres
Publié: (2024)
Scaling over Scaling: Exploring Test-Time Scaling Plateau in Large Reasoning Models
par: Wang, Jian, et autres
Publié: (2025)
par: Wang, Jian, et autres
Publié: (2025)
Information Gain-based Policy Optimization: A Simple and Effective Approach for Multi-Turn Search Agents
par: Wang, Guoqing, et autres
Publié: (2025)
par: Wang, Guoqing, et autres
Publié: (2025)
Parallel Test-Time Scaling for Latent Reasoning Models
par: You, Runyang, et autres
Publié: (2025)
par: You, Runyang, et autres
Publié: (2025)
Iterative Deepening Sampling as Efficient Test-Time Scaling
par: Chen, Weizhe, et autres
Publié: (2025)
par: Chen, Weizhe, et autres
Publié: (2025)
Efficient Test-Time Scaling via Self-Calibration
par: Huang, Chengsong, et autres
Publié: (2025)
par: Huang, Chengsong, et autres
Publié: (2025)
Entropy Centroids as Intrinsic Rewards for Test-Time Scaling
par: Zhao, Wenshuo, et autres
Publié: (2026)
par: Zhao, Wenshuo, et autres
Publié: (2026)
Revisiting the Effectiveness of LLM Pruning for Test-Time Scaling
par: Monjur, Ocean, et autres
Publié: (2026)
par: Monjur, Ocean, et autres
Publié: (2026)
Simple Yet Effective: An Information-Theoretic Approach to Multi-LLM Uncertainty Quantification
par: Kruse, Maya, et autres
Publié: (2025)
par: Kruse, Maya, et autres
Publié: (2025)
Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators
par: Dubois, Yann, et autres
Publié: (2024)
par: Dubois, Yann, et autres
Publié: (2024)
Linear Model Merging Unlocks Simple and Scalable Multimodal Data Mixture Optimization
par: Berasi, Davide, et autres
Publié: (2026)
par: Berasi, Davide, et autres
Publié: (2026)
Trajectory Bellman Residual Minimization: A Simple Value-Based Method for LLM Reasoning
par: Yuan, Yurun, et autres
Publié: (2025)
par: Yuan, Yurun, et autres
Publié: (2025)
Documents similaires
-
ScaLearn: Simple and Highly Parameter-Efficient Task Transfer by Learning to Scale
par: Frohmann, Markus, et autres
Publié: (2023) -
Always Learning, Always Mixing: Efficient and Simple Data Mixing All The Time
par: Hu, Michael Y., et autres
Publié: (2026) -
SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling
par: Kim, Dahyun, et autres
Publié: (2023) -
On the Role of Temperature Sampling in Test-Time Scaling
par: Wu, Yuheng, et autres
Publié: (2025) -
s1: Simple test-time scaling
par: Muennighoff, Niklas, et autres
Publié: (2025)