Guardado en:
| Autores principales: | Zhao, Eric, Awasthi, Pranjal, Gollapudi, Sreenivas |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2502.01839 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Sample-Efficient Optimization over Generative Priors via Coarse Learnability
por: Awasthi, Pranjal, et al.
Publicado: (2025)
por: Awasthi, Pranjal, et al.
Publicado: (2025)
The Limits of Preference Data for Post-Training
por: Zhao, Eric, et al.
Publicado: (2025)
por: Zhao, Eric, et al.
Publicado: (2025)
The Unreasonable Effectiveness of Eccentric Automatic Prompts
por: Battle, Rick, et al.
Publicado: (2024)
por: Battle, Rick, et al.
Publicado: (2024)
Adaptive Inference-Time Scaling via Cyclic Diffusion Search
por: Lee, Gyubin, et al.
Publicado: (2025)
por: Lee, Gyubin, et al.
Publicado: (2025)
Improving LLM Reasoning through Scaling Inference Computation with Collaborative Verification
por: Liang, Zhenwen, et al.
Publicado: (2024)
por: Liang, Zhenwen, et al.
Publicado: (2024)
Large Language Monkeys: Scaling Inference Compute with Repeated Sampling
por: Brown, Bradley, et al.
Publicado: (2024)
por: Brown, Bradley, et al.
Publicado: (2024)
Rethinking Optimal Verification Granularity for Compute-Efficient Test-Time Scaling
por: Chen, Hao Mark, et al.
Publicado: (2025)
por: Chen, Hao Mark, et al.
Publicado: (2025)
MarkovScale: Towards Optimal Sequential Scaling at Inference Time
por: Wang, Youkang, et al.
Publicado: (2026)
por: Wang, Youkang, et al.
Publicado: (2026)
Diversified Scaling Inference in Time Series Foundation Models
por: Hua, Ruijin, et al.
Publicado: (2026)
por: Hua, Ruijin, et al.
Publicado: (2026)
Thermodynamic Focusing for Inference-Time Search: Practical Methods for Target-Conditioned Sampling and Prompted Inference
por: Zhang, Zhan
Publicado: (2025)
por: Zhang, Zhan
Publicado: (2025)
DynScaling: Efficient Verifier-free Inference Scaling via Dynamic and Integrated Sampling
por: Wang, Fei, et al.
Publicado: (2025)
por: Wang, Fei, et al.
Publicado: (2025)
Position Coupling: Improving Length Generalization of Arithmetic Transformers Using Task Structure
por: Cho, Hanseul, et al.
Publicado: (2024)
por: Cho, Hanseul, et al.
Publicado: (2024)
Inference-Time Scaling for Generalist Reward Modeling
por: Liu, Zijun, et al.
Publicado: (2025)
por: Liu, Zijun, et al.
Publicado: (2025)
Inference-Time Scaling in Diffusion Models through Iterative Partial Refinement
por: Kang, Taegu, et al.
Publicado: (2026)
por: Kang, Taegu, et al.
Publicado: (2026)
$S^3$: Stratified Scaling Search for Test-Time in Diffusion Language Models
por: Bilal, Ahsan, et al.
Publicado: (2026)
por: Bilal, Ahsan, et al.
Publicado: (2026)
Effective Test-Time Scaling of Discrete Diffusion through Iterative Refinement
por: Lee, Sanghyun, et al.
Publicado: (2025)
por: Lee, Sanghyun, et al.
Publicado: (2025)
On the Role of Temperature Sampling in Test-Time Scaling
por: Wu, Yuheng, et al.
Publicado: (2025)
por: Wu, Yuheng, et al.
Publicado: (2025)
STEER: Inference-Time Risk Control via Constrained Quality-Diversity Search
por: Yang, Eric, et al.
Publicado: (2026)
por: Yang, Eric, et al.
Publicado: (2026)
Test-Time Scaling in Reasoning Models Is Not Effective for Knowledge-Intensive Tasks Yet
por: Zhao, James Xu, et al.
Publicado: (2025)
por: Zhao, James Xu, et al.
Publicado: (2025)
Lookahead Sample Reward Guidance for Test-Time Scaling of Diffusion Models
por: Kim, Yeongmin, et al.
Publicado: (2026)
por: Kim, Yeongmin, et al.
Publicado: (2026)
Revisiting the Effectiveness of LLM Pruning for Test-Time Scaling
por: Monjur, Ocean, et al.
Publicado: (2026)
por: Monjur, Ocean, et al.
Publicado: (2026)
Demystifying LLM-as-a-Judge: Analytically Tractable Model for Inference-Time Scaling
por: Halder, Indranil, et al.
Publicado: (2025)
por: Halder, Indranil, et al.
Publicado: (2025)
Is Best-of-N the Best of Them? Coverage, Scaling, and Optimality in Inference-Time Alignment
por: Huang, Audrey, et al.
Publicado: (2025)
por: Huang, Audrey, et al.
Publicado: (2025)
Geometric Scaling of Bayesian Inference in LLMs
por: Agarwal, Naman, et al.
Publicado: (2025)
por: Agarwal, Naman, et al.
Publicado: (2025)
The Limits of Inference Scaling Through Resampling
por: Stroebl, Benedikt, et al.
Publicado: (2024)
por: Stroebl, Benedikt, et al.
Publicado: (2024)
Scrutinize What We Ignore: Reining In Task Representation Shift Of Context-Based Offline Meta Reinforcement Learning
por: Zhang, Hai, et al.
Publicado: (2024)
por: Zhang, Hai, et al.
Publicado: (2024)
Iterative Deepening Sampling as Efficient Test-Time Scaling
por: Chen, Weizhe, et al.
Publicado: (2025)
por: Chen, Weizhe, et al.
Publicado: (2025)
Echo: Decoupling Inference and Training for Large-Scale RL Alignment on Heterogeneous Swarms
por: Xiao, Jie, et al.
Publicado: (2025)
por: Xiao, Jie, et al.
Publicado: (2025)
Scaling Up Bayesian DAG Sampling
por: Nikzad, Daniele, et al.
Publicado: (2025)
por: Nikzad, Daniele, et al.
Publicado: (2025)
OptScale: Probabilistic Optimality for Inference-time Scaling
por: Wang, Youkang, et al.
Publicado: (2025)
por: Wang, Youkang, et al.
Publicado: (2025)
Beyond Model Collapse: Scaling Up with Synthesized Data Requires Verification
por: Feng, Yunzhen, et al.
Publicado: (2024)
por: Feng, Yunzhen, et al.
Publicado: (2024)
Structure-Adaptive Conformal Inference for Large-Scale Out-of-Distribution Testing
por: Sun, Rongyi, et al.
Publicado: (2026)
por: Sun, Rongyi, et al.
Publicado: (2026)
CodeScaler: Scaling Code LLM Training and Test-Time Inference via Reward Models
por: Zhu, Xiao, et al.
Publicado: (2026)
por: Zhu, Xiao, et al.
Publicado: (2026)
Revisiting Multi-Agent Debate as Test-Time Scaling: A Systematic Study of Conditional Effectiveness
por: Yang, Yongjin, et al.
Publicado: (2025)
por: Yang, Yongjin, et al.
Publicado: (2025)
IsoCompute Playbook: Optimally Scaling Sampling Compute for LLM RL
por: Cheng, Zhoujun, et al.
Publicado: (2026)
por: Cheng, Zhoujun, et al.
Publicado: (2026)
Rollout Roulette: A Probabilistic Inference Approach to Inference-Time Scaling of LLMs using Particle-Based Monte Carlo Methods
por: Puri, Isha, et al.
Publicado: (2025)
por: Puri, Isha, et al.
Publicado: (2025)
Navigating the Exploration-Exploitation Tradeoff in Inference-Time Scaling of Diffusion Models
por: Su, Xun, et al.
Publicado: (2025)
por: Su, Xun, et al.
Publicado: (2025)
Sketch-and-Verify: Structured Inference-Time Scaling via Program Sketching
por: Jiang, Shan, et al.
Publicado: (2026)
por: Jiang, Shan, et al.
Publicado: (2026)
NuTime: Numerically Multi-Scaled Embedding for Large-Scale Time-Series Pretraining
por: Lin, Chenguo, et al.
Publicado: (2023)
por: Lin, Chenguo, et al.
Publicado: (2023)
Rethinking the Unsolvable: When In-Context Search Meets Test-Time Scaling
por: Xia, Fanzeng, et al.
Publicado: (2025)
por: Xia, Fanzeng, et al.
Publicado: (2025)
Ejemplares similares
-
Sample-Efficient Optimization over Generative Priors via Coarse Learnability
por: Awasthi, Pranjal, et al.
Publicado: (2025) -
The Limits of Preference Data for Post-Training
por: Zhao, Eric, et al.
Publicado: (2025) -
The Unreasonable Effectiveness of Eccentric Automatic Prompts
por: Battle, Rick, et al.
Publicado: (2024) -
Adaptive Inference-Time Scaling via Cyclic Diffusion Search
por: Lee, Gyubin, et al.
Publicado: (2025) -
Improving LLM Reasoning through Scaling Inference Computation with Collaborative Verification
por: Liang, Zhenwen, et al.
Publicado: (2024)