UniVer: A Unified Perspective for Multi-step and Multi-draft Speculative Decoding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Weng, Yepeng, Hu, Qiao, Yairi, Takehisa |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Traversal Verification for Speculative Tree Decoding
par: Weng, Yepeng, et autres
Publié: (2025)
par: Weng, Yepeng, et autres
Publié: (2025)
CORAL: Learning Consistent Representations across Multi-step Training with Lighter Speculative Drafter
par: Weng, Yepeng, et autres
Publié: (2025)
par: Weng, Yepeng, et autres
Publié: (2025)
Estimating Central, Peripheral, and Temporal Visual Contributions to Human Decision Making in Atari Games
par: Krauss, Henrik, et autres
Publié: (2026)
par: Krauss, Henrik, et autres
Publié: (2026)
Revealing Human Attention Patterns from Gameplay Analysis for Reinforcement Learning
par: Krauss, Henrik, et autres
Publié: (2025)
par: Krauss, Henrik, et autres
Publié: (2025)
Towards Optimal Multi-draft Speculative Decoding
par: Hu, Zhengmian, et autres
Publié: (2025)
par: Hu, Zhengmian, et autres
Publié: (2025)
Decoding Speculative Decoding
par: Yan, Minghao, et autres
Publié: (2024)
par: Yan, Minghao, et autres
Publié: (2024)
A Theoretical Perspective for Speculative Decoding Algorithm
par: Yin, Ming, et autres
Publié: (2024)
par: Yin, Ming, et autres
Publié: (2024)
A Temporal Difference Method for Stochastic Continuous Dynamics
par: Settai, Haruki, et autres
Publié: (2025)
par: Settai, Haruki, et autres
Publié: (2025)
Forecast Sports Outcomes under Efficient Market Hypothesis: Theoretical and Experimental Analysis of Odds-Only and Generalised Linear Models
par: Goto, Kaito, et autres
Publié: (2026)
par: Goto, Kaito, et autres
Publié: (2026)
Online Speculative Decoding
par: Liu, Xiaoxuan, et autres
Publié: (2023)
par: Liu, Xiaoxuan, et autres
Publié: (2023)
AMUSD: Asynchronous Multi-Device Speculative Decoding for LLM Acceleration
par: McDanel, Bradley
Publié: (2024)
par: McDanel, Bradley
Publié: (2024)
Speculative Decoding Across Languages
par: Paudel, Nirajan, et autres
Publié: (2026)
par: Paudel, Nirajan, et autres
Publié: (2026)
ML-SpecQD: Multi-Level Speculative Decoding with Quantized Drafts
par: Georganas, Evangelos, et autres
Publié: (2025)
par: Georganas, Evangelos, et autres
Publié: (2025)
SuffixDecoding: Extreme Speculative Decoding for Emerging AI Applications
par: Oliaro, Gabriele, et autres
Publié: (2024)
par: Oliaro, Gabriele, et autres
Publié: (2024)
Scaling Speculative Decoding with Lookahead Reasoning
par: Fu, Yichao, et autres
Publié: (2025)
par: Fu, Yichao, et autres
Publié: (2025)
Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE
par: Huang, Haiduo, et autres
Publié: (2025)
par: Huang, Haiduo, et autres
Publié: (2025)
Out-of-Vocabulary Sampling Boosts Speculative Decoding
par: Timor, Nadav, et autres
Publié: (2025)
par: Timor, Nadav, et autres
Publié: (2025)
Mixture of Attentions For Speculative Decoding
par: Zimmer, Matthieu, et autres
Publié: (2024)
par: Zimmer, Matthieu, et autres
Publié: (2024)
Mistletoe: Stealthy Acceleration-Collapse Attacks on Speculative Decoding
par: Sun, Shuoyang, et autres
Publié: (2026)
par: Sun, Shuoyang, et autres
Publié: (2026)
ParallelSpec: Parallel Drafter for Efficient Speculative Decoding
par: Xiao, Zilin, et autres
Publié: (2024)
par: Xiao, Zilin, et autres
Publié: (2024)
VOCABTRIM: Vocabulary Pruning for Efficient Speculative Decoding in LLMs
par: Goel, Raghavv, et autres
Publié: (2025)
par: Goel, Raghavv, et autres
Publié: (2025)
Towards More Accurate US Presidential Election via Multi-step Reasoning with Large Language Models
par: Yu, Chenxiao, et autres
Publié: (2024)
par: Yu, Chenxiao, et autres
Publié: (2024)
AdaSPEC: Selective Knowledge Distillation for Efficient Speculative Decoders
par: Hu, Yuezhou, et autres
Publié: (2025)
par: Hu, Yuezhou, et autres
Publié: (2025)
Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning
par: Beutel, Alex, et autres
Publié: (2024)
par: Beutel, Alex, et autres
Publié: (2024)
DualDiffusion: A Speculative Decoding Strategy for Masked Diffusion Models
par: Goyal, Satyam, et autres
Publié: (2026)
par: Goyal, Satyam, et autres
Publié: (2026)
TapOut: A Bandit-Based Approach to Dynamic Speculative Decoding
par: Sridhar, Aditya, et autres
Publié: (2025)
par: Sridhar, Aditya, et autres
Publié: (2025)
LK Losses: Direct Acceptance Rate Optimization for Speculative Decoding
par: Samarin, Alexander, et autres
Publié: (2026)
par: Samarin, Alexander, et autres
Publié: (2026)
Speculative Diffusion Decoding: Accelerating Language Generation through Diffusion
par: Christopher, Jacob K, et autres
Publié: (2024)
par: Christopher, Jacob K, et autres
Publié: (2024)
Reject Only Critical Tokens: Pivot-Aware Speculative Decoding
par: Ziashahabi, Amir, et autres
Publié: (2025)
par: Ziashahabi, Amir, et autres
Publié: (2025)
Recurrent Drafter for Fast Speculative Decoding in Large Language Models
par: Cheng, Yunfei, et autres
Publié: (2024)
par: Cheng, Yunfei, et autres
Publié: (2024)
Faster Cascades via Speculative Decoding
par: Narasimhan, Harikrishna, et autres
Publié: (2024)
par: Narasimhan, Harikrishna, et autres
Publié: (2024)
Learning Visually Interpretable Oscillator Networks for Soft Continuum Robots from Video
par: Krauss, Henrik, et autres
Publié: (2025)
par: Krauss, Henrik, et autres
Publié: (2025)
Calibrated Speculative Decoding: Frequency-Guided Candidate Selection for Efficient Inference
par: Zhou, Xuwen, et autres
Publié: (2026)
par: Zhou, Xuwen, et autres
Publié: (2026)
Kangaroo: Lossless Self-Speculative Decoding via Double Early Exiting
par: Liu, Fangcheng, et autres
Publié: (2024)
par: Liu, Fangcheng, et autres
Publié: (2024)
Narrative Consolidation: Formulating a New Task for Unifying Multi-Perspective Accounts
par: Finger, Roger A., et autres
Publié: (2025)
par: Finger, Roger A., et autres
Publié: (2025)
AdaServe: Accelerating Multi-SLO LLM Serving with SLO-Customized Speculative Decoding
par: Li, Zikun, et autres
Publié: (2025)
par: Li, Zikun, et autres
Publié: (2025)
Benchmarking the Energy Savings with Speculative Decoding Strategies
par: Dutta, Rohit, et autres
Publié: (2026)
par: Dutta, Rohit, et autres
Publié: (2026)
On Speculative Decoding for Multimodal Large Language Models
par: Gagrani, Mukul, et autres
Publié: (2024)
par: Gagrani, Mukul, et autres
Publié: (2024)
HiSpec: Hierarchical Speculative Decoding for LLMs
par: Kumar, Avinash, et autres
Publié: (2025)
par: Kumar, Avinash, et autres
Publié: (2025)
OmniDraft: A Cross-vocabulary, Online Adaptive Drafter for On-device Speculative Decoding
par: Ramakrishnan, Ramchalam Kinattinkara, et autres
Publié: (2025)
par: Ramakrishnan, Ramchalam Kinattinkara, et autres
Publié: (2025)
Documents similaires
-
Traversal Verification for Speculative Tree Decoding
par: Weng, Yepeng, et autres
Publié: (2025) -
CORAL: Learning Consistent Representations across Multi-step Training with Lighter Speculative Drafter
par: Weng, Yepeng, et autres
Publié: (2025) -
Estimating Central, Peripheral, and Temporal Visual Contributions to Human Decision Making in Atari Games
par: Krauss, Henrik, et autres
Publié: (2026) -
Revealing Human Attention Patterns from Gameplay Analysis for Reinforcement Learning
par: Krauss, Henrik, et autres
Publié: (2025) -
Towards Optimal Multi-draft Speculative Decoding
par: Hu, Zhengmian, et autres
Publié: (2025)