Bag of Tricks for Inference-time Computation of LLM Reasoning
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Fan, Chao, Wenshuo, Tan, Naiqiang, Liu, Hao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Bag of Tricks: Benchmarking of Jailbreak Attacks on LLMs
por: Xu, Zhao, et al.
Publicado: (2024)
por: Xu, Zhao, et al.
Publicado: (2024)
Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs
por: Liu, Chris Yuhao, et al.
Publicado: (2024)
por: Liu, Chris Yuhao, et al.
Publicado: (2024)
Not All Thoughts are Generated Equal: Efficient LLM Reasoning via Multi-Turn Reinforcement Learning
por: Ning, Yansong, et al.
Publicado: (2025)
por: Ning, Yansong, et al.
Publicado: (2025)
Agent-Omit: Adaptive Context Omission for Efficient LLM Agents
por: Ning, Yansong, et al.
Publicado: (2026)
por: Ning, Yansong, et al.
Publicado: (2026)
LLM Reasoning Is Latent, Not the Chain of Thought
por: Wang, Wenshuo
Publicado: (2026)
por: Wang, Wenshuo
Publicado: (2026)
Large Language Model Enhanced Hard Sample Identification for Denoising Recommendation
por: Song, Tianrui, et al.
Publicado: (2024)
por: Song, Tianrui, et al.
Publicado: (2024)
PP-DocBee: Improving Multimodal Document Understanding Through a Bag of Tricks
por: Ni, Feng, et al.
Publicado: (2025)
por: Ni, Feng, et al.
Publicado: (2025)
Breaking Scale Anchoring: Frequency Representation Learning for Accurate High-Resolution Inference from Low-Resolution Training
por: Wang, Wenshuo, et al.
Publicado: (2025)
por: Wang, Wenshuo, et al.
Publicado: (2025)
RL of Thoughts: Navigating LLM Reasoning with Inference-time Reinforcement Learning
por: Hao, Qianyue, et al.
Publicado: (2025)
por: Hao, Qianyue, et al.
Publicado: (2025)
Alleviating Choice Supportive Bias in LLM with Reasoning Dependency Generation
por: Zhuang, Nan, et al.
Publicado: (2025)
por: Zhuang, Nan, et al.
Publicado: (2025)
Improving LLM Reasoning through Scaling Inference Computation with Collaborative Verification
por: Liang, Zhenwen, et al.
Publicado: (2024)
por: Liang, Zhenwen, et al.
Publicado: (2024)
System-Anchored Knee Estimation for Low-Cost Context Window Selection in PDE Forecasting
por: Wang, Wenshuo, et al.
Publicado: (2026)
por: Wang, Wenshuo, et al.
Publicado: (2026)
Tricking LLM-Based NPCs into Spilling Secrets
por: Shiomi, Kyohei, et al.
Publicado: (2025)
por: Shiomi, Kyohei, et al.
Publicado: (2025)
Enhancing LLM Evaluations: The Garbling Trick
por: Bradley, William F.
Publicado: (2024)
por: Bradley, William F.
Publicado: (2024)
Mitigating Safety Tax via Distribution-Grounded Refinement in Large Reasoning Models
por: Xie, Yingsha, et al.
Publicado: (2026)
por: Xie, Yingsha, et al.
Publicado: (2026)
DeepTravel: An End-to-End Agentic Reinforcement Learning Framework for Autonomous Travel Planning Agents
por: Ning, Yansong, et al.
Publicado: (2025)
por: Ning, Yansong, et al.
Publicado: (2025)
A Bag of Tricks for Scaling CPU-based Deep FFMs to more than 300m Predictions per Second
por: Škrlj, Blaž, et al.
Publicado: (2024)
por: Škrlj, Blaž, et al.
Publicado: (2024)
Domain-Contextualized Inference: A Computable Graph Architecture for Explicit-Domain Reasoning
por: Li, Chao, et al.
Publicado: (2026)
por: Li, Chao, et al.
Publicado: (2026)
Ada-R1: Hybrid-CoT via Bi-Level Adaptive Reasoning Optimization
por: Luo, Haotian, et al.
Publicado: (2025)
por: Luo, Haotian, et al.
Publicado: (2025)
Reasoning as Data: Representation-Computation Unity and Its Implementation in a Domain-Algebraic Inference Engine
por: Li, Chao, et al.
Publicado: (2026)
por: Li, Chao, et al.
Publicado: (2026)
Gradient-Informed Temporal Sampling Improves Rollout Accuracy in PDE Surrogate Training
por: Wang, Wenshuo, et al.
Publicado: (2026)
por: Wang, Wenshuo, et al.
Publicado: (2026)
Derived Fields Preserve Fine-Scale Detail in Budgeted Neural Simulators
por: Wang, Wenshuo, et al.
Publicado: (2026)
por: Wang, Wenshuo, et al.
Publicado: (2026)
Posterior-First Neural PDE Simulation: Inferring Hidden Problem State from a Single Field
por: Wang, Wenshuo, et al.
Publicado: (2026)
por: Wang, Wenshuo, et al.
Publicado: (2026)
Fast On-device LLM Inference with NPUs
por: Xu, Daliang, et al.
Publicado: (2024)
por: Xu, Daliang, et al.
Publicado: (2024)
ROI-Reasoning: Rational Optimization for Inference via Pre-Computation Meta-Cognition
por: Zhao, Muyang, et al.
Publicado: (2026)
por: Zhao, Muyang, et al.
Publicado: (2026)
LLMs Should Not Yet Be Credited with Decision Explanation
por: Wang, Wenshuo
Publicado: (2026)
por: Wang, Wenshuo
Publicado: (2026)
Inference-Time Computations for LLM Reasoning and Planning: A Benchmark and Insights
por: Parashar, Shubham, et al.
Publicado: (2025)
por: Parashar, Shubham, et al.
Publicado: (2025)
LLM Self Defense: By Self Examination, LLMs Know They Are Being Tricked
por: Phute, Mansi, et al.
Publicado: (2023)
por: Phute, Mansi, et al.
Publicado: (2023)
ODAR: Principled Adaptive Routing for LLM Reasoning via Active Inference
por: Ma, Siyuan, et al.
Publicado: (2026)
por: Ma, Siyuan, et al.
Publicado: (2026)
CHESS: Context-aware Hierarchical Efficient Semantic Selection for Long-Context LLM Inference
por: Fei, Chao, et al.
Publicado: (2026)
por: Fei, Chao, et al.
Publicado: (2026)
Scaling Test-time Compute for LLM Agents
por: Zhu, King, et al.
Publicado: (2025)
por: Zhu, King, et al.
Publicado: (2025)
SafeThinker: Reasoning about Risk to Deepen Safety Beyond Shallow Alignment
por: Fang, Xianya, et al.
Publicado: (2026)
por: Fang, Xianya, et al.
Publicado: (2026)
Knowledge Distillation Must Account for What It Loses
por: Wang, Wenshuo
Publicado: (2026)
por: Wang, Wenshuo
Publicado: (2026)
A Cross-View Hierarchical Graph Learning Hypernetwork for Skill Demand-Supply Joint Prediction
por: Chao, Wenshuo, et al.
Publicado: (2024)
por: Chao, Wenshuo, et al.
Publicado: (2024)
Steering LLM Thinking with Budget Guidance
por: Li, Junyan, et al.
Publicado: (2025)
por: Li, Junyan, et al.
Publicado: (2025)
ClimAgent: LLM as Agents for Autonomous Open-ended Climate Science Analysis
por: Wang, Hao, et al.
Publicado: (2026)
por: Wang, Hao, et al.
Publicado: (2026)
LLMs Enable Bag-of-Texts Representations for Short-Text Clustering
por: Lin, I-Fan, et al.
Publicado: (2025)
por: Lin, I-Fan, et al.
Publicado: (2025)
MedCoG: Maximizing LLM Inference Density in Medical Reasoning via Meta-Cognitive Regulation
por: Zhao, Yu, et al.
Publicado: (2026)
por: Zhao, Yu, et al.
Publicado: (2026)
ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute
por: Wen, Hao, et al.
Publicado: (2025)
por: Wen, Hao, et al.
Publicado: (2025)
Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM Reasoning
por: Bi, Zhenni, et al.
Publicado: (2024)
por: Bi, Zhenni, et al.
Publicado: (2024)
Ejemplares similares
-
Bag of Tricks: Benchmarking of Jailbreak Attacks on LLMs
por: Xu, Zhao, et al.
Publicado: (2024) -
Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs
por: Liu, Chris Yuhao, et al.
Publicado: (2024) -
Not All Thoughts are Generated Equal: Efficient LLM Reasoning via Multi-Turn Reinforcement Learning
por: Ning, Yansong, et al.
Publicado: (2025) -
Agent-Omit: Adaptive Context Omission for Efficient LLM Agents
por: Ning, Yansong, et al.
Publicado: (2026) -
LLM Reasoning Is Latent, Not the Chain of Thought
por: Wang, Wenshuo
Publicado: (2026)