Hybrid Verified Decoding: Learning to Allocate Verification in Speculative Decoding
Fuente:
arXiv
Salvato in:
| Autori principali: | Su, Xin, Majchrowski, Dawid, Yu, Fangyuan, Shah, Vanshil Atul, Rogawski, Sebastian, Morkisz, Pawel, Bhiwandiwalla, Anahita, Howard, Phillip |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Making Every Verified Token Count: Adaptive Verification for MoE Speculative Decoding
di: Pan, Lehan, et al.
Pubblicazione: (2026)
di: Pan, Lehan, et al.
Pubblicazione: (2026)
Speculative Verification: Exploiting Information Gain to Refine Speculative Decoding
di: Kim, Sungkyun, et al.
Pubblicazione: (2025)
di: Kim, Sungkyun, et al.
Pubblicazione: (2025)
Accelerate Speculative Decoding with Sparse Computation in Verification
di: Wang, Jikai, et al.
Pubblicazione: (2025)
di: Wang, Jikai, et al.
Pubblicazione: (2025)
Traversal Verification for Speculative Tree Decoding
di: Weng, Yepeng, et al.
Pubblicazione: (2025)
di: Weng, Yepeng, et al.
Pubblicazione: (2025)
Block Verification Accelerates Speculative Decoding
di: Sun, Ziteng, et al.
Pubblicazione: (2024)
di: Sun, Ziteng, et al.
Pubblicazione: (2024)
Decoding Speculative Decoding
di: Yan, Minghao, et al.
Pubblicazione: (2024)
di: Yan, Minghao, et al.
Pubblicazione: (2024)
Alignment-Augmented Speculative Decoding with Alignment Sampling and Conditional Verification
di: Wang, Jikai, et al.
Pubblicazione: (2025)
di: Wang, Jikai, et al.
Pubblicazione: (2025)
Speculative Decoding with a Speculative Vocabulary
di: Williams, Miles, et al.
Pubblicazione: (2026)
di: Williams, Miles, et al.
Pubblicazione: (2026)
Learning to Draft: Adaptive Speculative Decoding with Reinforcement Learning
di: Zhang, Jiebin, et al.
Pubblicazione: (2026)
di: Zhang, Jiebin, et al.
Pubblicazione: (2026)
Dynamic Depth Decoding: Faster Speculative Decoding for LLMs
di: Brown, Oscar, et al.
Pubblicazione: (2024)
di: Brown, Oscar, et al.
Pubblicazione: (2024)
Speculative Contrastive Decoding
di: Yuan, Hongyi, et al.
Pubblicazione: (2023)
di: Yuan, Hongyi, et al.
Pubblicazione: (2023)
Speculative Decoding: Performance or Illusion?
di: Liu, Xiaoxuan, et al.
Pubblicazione: (2025)
di: Liu, Xiaoxuan, et al.
Pubblicazione: (2025)
Improving Multi-candidate Speculative Decoding
di: Lu, Xiaofan, et al.
Pubblicazione: (2024)
di: Lu, Xiaofan, et al.
Pubblicazione: (2024)
SpecTr-GBV: Multi-Draft Block Verification Accelerating Speculative Decoding
di: Lin, Yijun, et al.
Pubblicazione: (2026)
di: Lin, Yijun, et al.
Pubblicazione: (2026)
Draft & Verify: Lossless Large Language Model Acceleration via Self-Speculative Decoding
di: Zhang, Jun, et al.
Pubblicazione: (2023)
di: Zhang, Jun, et al.
Pubblicazione: (2023)
Multi-Candidate Speculative Decoding
di: Yang, Sen, et al.
Pubblicazione: (2024)
di: Yang, Sen, et al.
Pubblicazione: (2024)
3-Model Speculative Decoding
di: Byun, Sanghyun, et al.
Pubblicazione: (2025)
di: Byun, Sanghyun, et al.
Pubblicazione: (2025)
Graph-Structured Speculative Decoding
di: Gong, Zhuocheng, et al.
Pubblicazione: (2024)
di: Gong, Zhuocheng, et al.
Pubblicazione: (2024)
Online Speculative Decoding
di: Liu, Xiaoxuan, et al.
Pubblicazione: (2023)
di: Liu, Xiaoxuan, et al.
Pubblicazione: (2023)
SelfJudge: Faster Speculative Decoding via Self-Supervised Judge Verification
di: Yoon, Kanghoon, et al.
Pubblicazione: (2025)
di: Yoon, Kanghoon, et al.
Pubblicazione: (2025)
DIVERSED: Relaxed Speculative Decoding via Dynamic Ensemble Verification
di: Wang, Ziyi, et al.
Pubblicazione: (2026)
di: Wang, Ziyi, et al.
Pubblicazione: (2026)
From Tokens to Steps: Verification-Aware Speculative Decoding for Efficient Multi-Step Reasoning
di: Purohit, Kiran, et al.
Pubblicazione: (2026)
di: Purohit, Kiran, et al.
Pubblicazione: (2026)
Uncovering Bias in Large Vision-Language Models at Scale with Counterfactuals
di: Howard, Phillip, et al.
Pubblicazione: (2024)
di: Howard, Phillip, et al.
Pubblicazione: (2024)
Uncovering Bias in Large Vision-Language Models with Counterfactuals
di: Howard, Phillip, et al.
Pubblicazione: (2024)
di: Howard, Phillip, et al.
Pubblicazione: (2024)
The Disparate Impacts of Speculative Decoding
di: Sandler, Jameson, et al.
Pubblicazione: (2025)
di: Sandler, Jameson, et al.
Pubblicazione: (2025)
Constrained Decoding with Speculative Lookaheads
di: Nakshatri, Nishanth, et al.
Pubblicazione: (2024)
di: Nakshatri, Nishanth, et al.
Pubblicazione: (2024)
Speculative Decoding Across Languages
di: Paudel, Nirajan, et al.
Pubblicazione: (2026)
di: Paudel, Nirajan, et al.
Pubblicazione: (2026)
Scaling Laws for Speculative Decoding
di: Yan, Siyuan, et al.
Pubblicazione: (2025)
di: Yan, Siyuan, et al.
Pubblicazione: (2025)
Cross-Attention Speculative Decoding
di: Zhong, Wei, et al.
Pubblicazione: (2025)
di: Zhong, Wei, et al.
Pubblicazione: (2025)
Mamba Drafters for Speculative Decoding
di: Choi, Daewon, et al.
Pubblicazione: (2025)
di: Choi, Daewon, et al.
Pubblicazione: (2025)
Performance-Driven Policy Optimization for Speculative Decoding with Adaptive Windowing
di: Jiang, Jie, et al.
Pubblicazione: (2026)
di: Jiang, Jie, et al.
Pubblicazione: (2026)
Entropy-Aware Speculative Decoding Toward Improved LLM Reasoning
di: Su, Tiancheng, et al.
Pubblicazione: (2025)
di: Su, Tiancheng, et al.
Pubblicazione: (2025)
LongSpec: Long-Context Lossless Speculative Decoding with Efficient Drafting and Verification
di: Yang, Penghui, et al.
Pubblicazione: (2025)
di: Yang, Penghui, et al.
Pubblicazione: (2025)
SAM Decoding: Speculative Decoding via Suffix Automaton
di: Hu, Yuxuan, et al.
Pubblicazione: (2024)
di: Hu, Yuxuan, et al.
Pubblicazione: (2024)
p-less Sampling: A Robust Hyperparameter-Free Approach for LLM Decoding
di: Tan, Runyan, et al.
Pubblicazione: (2025)
di: Tan, Runyan, et al.
Pubblicazione: (2025)
Mixture of Attentions For Speculative Decoding
di: Zimmer, Matthieu, et al.
Pubblicazione: (2024)
di: Zimmer, Matthieu, et al.
Pubblicazione: (2024)
Component-Aware Self-Speculative Decoding in Hybrid Language Models
di: Borobia, Hector, et al.
Pubblicazione: (2026)
di: Borobia, Hector, et al.
Pubblicazione: (2026)
RAPID: Long-Context Inference with Retrieval-Augmented Speculative Decoding
di: Chen, Guanzheng, et al.
Pubblicazione: (2025)
di: Chen, Guanzheng, et al.
Pubblicazione: (2025)
OPT-Tree: Speculative Decoding with Adaptive Draft Tree Structure
di: Wang, Jikai, et al.
Pubblicazione: (2024)
di: Wang, Jikai, et al.
Pubblicazione: (2024)
Speculative Pipeline Decoding: Higher-Accruacy and Zero-Bubble Speculation via Pipeline Parallelism
di: Yu, Yijiong, et al.
Pubblicazione: (2026)
di: Yu, Yijiong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Making Every Verified Token Count: Adaptive Verification for MoE Speculative Decoding
di: Pan, Lehan, et al.
Pubblicazione: (2026) -
Speculative Verification: Exploiting Information Gain to Refine Speculative Decoding
di: Kim, Sungkyun, et al.
Pubblicazione: (2025) -
Accelerate Speculative Decoding with Sparse Computation in Verification
di: Wang, Jikai, et al.
Pubblicazione: (2025) -
Traversal Verification for Speculative Tree Decoding
di: Weng, Yepeng, et al.
Pubblicazione: (2025) -
Block Verification Accelerates Speculative Decoding
di: Sun, Ziteng, et al.
Pubblicazione: (2024)