Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Yangzhen, Sun, Zhiqing, Li, Shanda, Welleck, Sean, Yang, Yiming |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Optimizing Temperature for Language Models with Multi-Sample Inference
por: Du, Weihua, et al.
Publicado: (2025)
por: Du, Weihua, et al.
Publicado: (2025)
Lean-STaR: Learning to Interleave Thinking and Proving
por: Lin, Haohan, et al.
Publicado: (2024)
por: Lin, Haohan, et al.
Publicado: (2024)
CO-Bench: Benchmarking Language Model Agents in Algorithm Search for Combinatorial Optimization
por: Sun, Weiwei, et al.
Publicado: (2025)
por: Sun, Weiwei, et al.
Publicado: (2025)
Easy-to-Hard Generalization: Scalable Alignment Beyond Human Supervision
por: Sun, Zhiqing, et al.
Publicado: (2024)
por: Sun, Zhiqing, et al.
Publicado: (2024)
CodePDE: An Inference Framework for LLM-driven PDE Solver Generation
por: Li, Shanda, et al.
Publicado: (2025)
por: Li, Shanda, et al.
Publicado: (2025)
GradAlign: Gradient-Aligned Data Selection for LLM Reinforcement Learning
por: Yang, Ningyuan, et al.
Publicado: (2026)
por: Yang, Ningyuan, et al.
Publicado: (2026)
Agentic-R1: Distilled Dual-Strategy Reasoning
por: Du, Weihua, et al.
Publicado: (2025)
por: Du, Weihua, et al.
Publicado: (2025)
L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning
por: Aggarwal, Pranjal, et al.
Publicado: (2025)
por: Aggarwal, Pranjal, et al.
Publicado: (2025)
Reasoning Language Model Inference Serving Unveiled: An Empirical Study
por: Li, Qi, et al.
Publicado: (2025)
por: Li, Qi, et al.
Publicado: (2025)
CoMind: Towards Community-Driven Agents for Machine Learning Engineering
por: Li, Sijie, et al.
Publicado: (2025)
por: Li, Sijie, et al.
Publicado: (2025)
Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models
por: Vaidhya, Tejas, et al.
Publicado: (2025)
por: Vaidhya, Tejas, et al.
Publicado: (2025)
A Simple Model of Inference Scaling Laws
por: Levi, Noam
Publicado: (2024)
por: Levi, Noam
Publicado: (2024)
Solve-Detect-Verify: Inference-Time Scaling with Flexible Generative Verifier
por: Zhong, Jianyuan, et al.
Publicado: (2025)
por: Zhong, Jianyuan, et al.
Publicado: (2025)
miniCodeProps: a Minimal Benchmark for Proving Code Properties
por: Lohn, Evan, et al.
Publicado: (2024)
por: Lohn, Evan, et al.
Publicado: (2024)
Model Merging Scaling Laws in Large Language Models
por: Wang, Yuanyi, et al.
Publicado: (2025)
por: Wang, Yuanyi, et al.
Publicado: (2025)
Scaling LLM Inference with Optimized Sample Compute Allocation
por: Zhang, Kexun, et al.
Publicado: (2024)
por: Zhang, Kexun, et al.
Publicado: (2024)
Scaling Laws Meet Model Architecture: Toward Inference-Efficient LLMs
por: Bian, Song, et al.
Publicado: (2025)
por: Bian, Song, et al.
Publicado: (2025)
Large Language Monkeys: Scaling Inference Compute with Repeated Sampling
por: Brown, Bradley, et al.
Publicado: (2024)
por: Brown, Bradley, et al.
Publicado: (2024)
Inference Scaling vs Reasoning: An Empirical Analysis of Compute-Optimal LLM Problem-Solving
por: AbdElhameed, Marwan, et al.
Publicado: (2024)
por: AbdElhameed, Marwan, et al.
Publicado: (2024)
Self-Play Preference Optimization for Language Model Alignment
por: Wu, Yue, et al.
Publicado: (2024)
por: Wu, Yue, et al.
Publicado: (2024)
Sample Complexity and Representation Ability of Test-time Scaling Paradigms
por: Huang, Baihe, et al.
Publicado: (2025)
por: Huang, Baihe, et al.
Publicado: (2025)
Propose, Solve, Verify: Self-Play Through Formal Verification
por: Wilf, Alex, et al.
Publicado: (2025)
por: Wilf, Alex, et al.
Publicado: (2025)
AlphaVerus: Bootstrapping Formally Verified Code Generation through Self-Improving Translation and Treefinement
por: Aggarwal, Pranjal, et al.
Publicado: (2024)
por: Aggarwal, Pranjal, et al.
Publicado: (2024)
Gym-Anything: Turn any Software into an Agent Environment
por: Aggarwal, Pranjal, et al.
Publicado: (2026)
por: Aggarwal, Pranjal, et al.
Publicado: (2026)
Agent RL Scaling Law: Agent RL with Spontaneous Code Execution for Mathematical Problem Solving
por: Mai, Xinji, et al.
Publicado: (2025)
por: Mai, Xinji, et al.
Publicado: (2025)
Scaling Inference-Efficient Language Models
por: Bian, Song, et al.
Publicado: (2025)
por: Bian, Song, et al.
Publicado: (2025)
Physics-Informed Inference Time Scaling for Solving High-Dimensional PDE via Defect Correction
por: Fan, Zexi, et al.
Publicado: (2025)
por: Fan, Zexi, et al.
Publicado: (2025)
Efficient Inference and Computation of Optimal Alternatives for Preference Languages Based On Lexicographic Models
por: Wilson, Nic, et al.
Publicado: (2024)
por: Wilson, Nic, et al.
Publicado: (2024)
MarkovScale: Towards Optimal Sequential Scaling at Inference Time
por: Wang, Youkang, et al.
Publicado: (2026)
por: Wang, Youkang, et al.
Publicado: (2026)
Inference-Time Scaling for Generalist Reward Modeling
por: Liu, Zijun, et al.
Publicado: (2025)
por: Liu, Zijun, et al.
Publicado: (2025)
Multi-step Problem Solving Through a Verifier: An Empirical Analysis on Model-induced Process Supervision
por: Wang, Zihan, et al.
Publicado: (2024)
por: Wang, Zihan, et al.
Publicado: (2024)
OptScale: Probabilistic Optimality for Inference-time Scaling
por: Wang, Youkang, et al.
Publicado: (2025)
por: Wang, Youkang, et al.
Publicado: (2025)
An Empirical Study on Cross-lingual Vocabulary Adaptation for Efficient Language Model Inference
por: Yamaguchi, Atsuki, et al.
Publicado: (2024)
por: Yamaguchi, Atsuki, et al.
Publicado: (2024)
miniCTX: Neural Theorem Proving with (Long-)Contexts
por: Hu, Jiewen, et al.
Publicado: (2024)
por: Hu, Jiewen, et al.
Publicado: (2024)
A Survey of Slow Thinking-based Reasoning LLMs using Reinforced Learning and Inference-time Scaling Law
por: Pan, Qianjun, et al.
Publicado: (2025)
por: Pan, Qianjun, et al.
Publicado: (2025)
Successive Refinement in Large-Scale Computation: Advancing Model Inference Applications
por: Esfahanizadeh, Homa, et al.
Publicado: (2024)
por: Esfahanizadeh, Homa, et al.
Publicado: (2024)
ProbeScale: Probing Analysis to Optimize Neural Scaling Laws for Efficient Small Language Model Inference
por: Das, Sourav
Publicado: (2026)
por: Das, Sourav
Publicado: (2026)
DIRCR: Dual-Inference Rule-Contrastive Reasoning for Solving RAVENs
por: Zhang, Jiachen, et al.
Publicado: (2026)
por: Zhang, Jiachen, et al.
Publicado: (2026)
Thinking Slow, Fast: Scaling Inference Compute with Distilled Reasoners
por: Paliotta, Daniele, et al.
Publicado: (2025)
por: Paliotta, Daniele, et al.
Publicado: (2025)
BitHydra: Towards Bit-flip Inference Cost Attack against Large Language Models
por: Yan, Xiaobei, et al.
Publicado: (2025)
por: Yan, Xiaobei, et al.
Publicado: (2025)
Ejemplares similares
-
Optimizing Temperature for Language Models with Multi-Sample Inference
por: Du, Weihua, et al.
Publicado: (2025) -
Lean-STaR: Learning to Interleave Thinking and Proving
por: Lin, Haohan, et al.
Publicado: (2024) -
CO-Bench: Benchmarking Language Model Agents in Algorithm Search for Combinatorial Optimization
por: Sun, Weiwei, et al.
Publicado: (2025) -
Easy-to-Hard Generalization: Scalable Alignment Beyond Human Supervision
por: Sun, Zhiqing, et al.
Publicado: (2024) -
CodePDE: An Inference Framework for LLM-driven PDE Solver Generation
por: Li, Shanda, et al.
Publicado: (2025)