Accelerating Large Language Model Reasoning via Speculative Search
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Zhihai, Wang, Jie, Pan, Jilai, Xia, Xilin, Zhen, Huiling, Yuan, Mingxuan, Hao, Jianye, Wu, Feng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HyperTree Planning: Enhancing LLM Reasoning via Hierarchical Thinking
par: Gui, Runquan, et autres
Publié: (2025)
par: Gui, Runquan, et autres
Publié: (2025)
Short Chains, Deep Thoughts: Balancing Reasoning Efficiency and Intra-Segment Capability via Split-Merge Optimization
par: Gui, Runquan, et autres
Publié: (2026)
par: Gui, Runquan, et autres
Publié: (2026)
SpecExit: Accelerating Large Reasoning Model via Speculative Exit
par: Yang, Rubing, et autres
Publié: (2025)
par: Yang, Rubing, et autres
Publié: (2025)
Brainstorming Brings Power to Large Language Models of Knowledge Reasoning
par: Qin, Zining, et autres
Publié: (2024)
par: Qin, Zining, et autres
Publié: (2024)
FR-Spec: Accelerating Large-Vocabulary Language Models via Frequency-Ranked Speculative Sampling
par: Zhao, Weilin, et autres
Publié: (2025)
par: Zhao, Weilin, et autres
Publié: (2025)
Process Supervision via Verbal Critique Improves Reasoning in Large Language Models
par: Chen, Hao-Yuan
Publié: (2026)
par: Chen, Hao-Yuan
Publié: (2026)
Who Reasons in the Large Language Models?
par: Shao, Jie, et autres
Publié: (2025)
par: Shao, Jie, et autres
Publié: (2025)
HADES: Hardware Accelerated Decoding for Efficient Speculation in Large Language Models
par: Yang, Ze, et autres
Publié: (2024)
par: Yang, Ze, et autres
Publié: (2024)
Guiding Clinical Reasoning with Large Language Models via Knowledge Seeds
par: WU, Jiageng, et autres
Publié: (2024)
par: WU, Jiageng, et autres
Publié: (2024)
Enigmata: Scaling Logical Reasoning in Large Language Models with Synthetic Verifiable Puzzles
par: Chen, Jiangjie, et autres
Publié: (2025)
par: Chen, Jiangjie, et autres
Publié: (2025)
Why Attention Patterns Exist: A Unifying Temporal Perspective Analysis
par: Yang, Qingyue, et autres
Publié: (2026)
par: Yang, Qingyue, et autres
Publié: (2026)
Speculative Thinking: Enhancing Small-Model Reasoning with Large Model Guidance at Inference Time
par: Yang, Wang, et autres
Publié: (2025)
par: Yang, Wang, et autres
Publié: (2025)
Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning
par: Luo, Linhao, et autres
Publié: (2023)
par: Luo, Linhao, et autres
Publié: (2023)
Behavioral Fingerprinting of Large Language Models
par: Pei, Zehua, et autres
Publié: (2025)
par: Pei, Zehua, et autres
Publié: (2025)
OThink-SRR1: Search, Refine and Reasoning with Reinforced Learning for Large Language Models
par: Liang, Haijian, et autres
Publié: (2026)
par: Liang, Haijian, et autres
Publié: (2026)
MONICA: Real-Time Monitoring and Calibration of Chain-of-Thought Sycophancy in Large Reasoning Models
par: Hu, Jingyu, et autres
Publié: (2025)
par: Hu, Jingyu, et autres
Publié: (2025)
Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models
par: Xu, Fengli, et autres
Publié: (2025)
par: Xu, Fengli, et autres
Publié: (2025)
Beyond the Speculative Game: A Survey of Speculative Execution in Large Language Models
par: Zhang, Chen, et autres
Publié: (2024)
par: Zhang, Chen, et autres
Publié: (2024)
ARS: Automatic Routing Solver with Large Language Models
par: Li, Kai, et autres
Publié: (2025)
par: Li, Kai, et autres
Publié: (2025)
S$^4$C: Speculative Sampling with Syntactic and Semantic Coherence for Efficient Inference of Large Language Models
par: He, Tao, et autres
Publié: (2025)
par: He, Tao, et autres
Publié: (2025)
Beyond Speedup -- Utilizing KV Cache for Sampling and Reasoning
par: Xing, Zeyu, et autres
Publié: (2026)
par: Xing, Zeyu, et autres
Publié: (2026)
Fast Large Language Model Collaborative Decoding via Speculation
par: Fu, Jiale, et autres
Publié: (2025)
par: Fu, Jiale, et autres
Publié: (2025)
RASD: Retrieval-Augmented Speculative Decoding
par: Quan, Guofeng, et autres
Publié: (2025)
par: Quan, Guofeng, et autres
Publié: (2025)
SemEval-2026 Task 12: Abductive Event Reasoning: Towards Real-World Event Causal Inference for Large Language Models
par: Cao, Pengfei, et autres
Publié: (2026)
par: Cao, Pengfei, et autres
Publié: (2026)
Efficient Reasoning for LLMs through Speculative Chain-of-Thought
par: Wang, Jikai, et autres
Publié: (2025)
par: Wang, Jikai, et autres
Publié: (2025)
Knowledge Reasoning Language Model: Unifying Knowledge and Language for Inductive Knowledge Graph Reasoning
par: Zhuo, Xingrui, et autres
Publié: (2025)
par: Zhuo, Xingrui, et autres
Publié: (2025)
Mitigating Overthinking in Large Reasoning Language Models via Reasoning Path Deviation Monitoring
par: Guan, Weixin, et autres
Publié: (2026)
par: Guan, Weixin, et autres
Publié: (2026)
Sens-Merging: Sensitivity-Guided Parameter Balancing for Merging Large Language Models
par: Liu, Shuqi, et autres
Publié: (2025)
par: Liu, Shuqi, et autres
Publié: (2025)
DiffuSpec: Unlocking Diffusion Language Models for Speculative Decoding
par: Li, Guanghao, et autres
Publié: (2025)
par: Li, Guanghao, et autres
Publié: (2025)
LLM Reasoners: New Evaluation, Library, and Analysis of Step-by-Step Reasoning with Large Language Models
par: Hao, Shibo, et autres
Publié: (2024)
par: Hao, Shibo, et autres
Publié: (2024)
Mitigating Hallucinations in Large Language Models via Causal Reasoning
par: Li, Yuangang, et autres
Publié: (2025)
par: Li, Yuangang, et autres
Publié: (2025)
Efficient Adaptive Rejection Sampling for Accelerating Speculative Decoding in Large Language Models
par: Sun, Chendong, et autres
Publié: (2025)
par: Sun, Chendong, et autres
Publié: (2025)
Fuzzing: Randomness? Reasoning! Efficient Directed Fuzzing via Large Language Models
par: Feng, Xiaotao, et autres
Publié: (2025)
par: Feng, Xiaotao, et autres
Publié: (2025)
SightSound-R1: Cross-Modal Reasoning Distillation from Vision to Audio Language Models
par: Wang, Qiaolin, et autres
Publié: (2025)
par: Wang, Qiaolin, et autres
Publié: (2025)
Speculative Decoding with CTC-based Draft Model for LLM Inference Acceleration
par: Wen, Zhuofan, et autres
Publié: (2024)
par: Wen, Zhuofan, et autres
Publié: (2024)
On Speculative Decoding for Multimodal Large Language Models
par: Gagrani, Mukul, et autres
Publié: (2024)
par: Gagrani, Mukul, et autres
Publié: (2024)
Weak-to-Strong Search: Align Large Language Models via Searching over Small Language Models
par: Zhou, Zhanhui, et autres
Publié: (2024)
par: Zhou, Zhanhui, et autres
Publié: (2024)
SEKI: Self-Evolution and Knowledge Inspiration based Neural Architecture Search via Large Language Models
par: Cai, Zicheng, et autres
Publié: (2025)
par: Cai, Zicheng, et autres
Publié: (2025)
Diverse Human Value Alignment for Large Language Models via Ethical Reasoning
par: Wang, Jiahao, et autres
Publié: (2025)
par: Wang, Jiahao, et autres
Publié: (2025)
Speculative Decoding for Multi-Sample Inference
par: Li, Yiwei, et autres
Publié: (2025)
par: Li, Yiwei, et autres
Publié: (2025)
Documents similaires
-
HyperTree Planning: Enhancing LLM Reasoning via Hierarchical Thinking
par: Gui, Runquan, et autres
Publié: (2025) -
Short Chains, Deep Thoughts: Balancing Reasoning Efficiency and Intra-Segment Capability via Split-Merge Optimization
par: Gui, Runquan, et autres
Publié: (2026) -
SpecExit: Accelerating Large Reasoning Model via Speculative Exit
par: Yang, Rubing, et autres
Publié: (2025) -
Brainstorming Brings Power to Large Language Models of Knowledge Reasoning
par: Qin, Zining, et autres
Publié: (2024) -
FR-Spec: Accelerating Large-Vocabulary Language Models via Frequency-Ranked Speculative Sampling
par: Zhao, Weilin, et autres
Publié: (2025)