Speculative Decoding Across Languages
Fuente:
arXiv
Guardado en:
| Autores principales: | Paudel, Nirajan, Ginn, Michael, De Nardi, Luc, Palmer, Alexis |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Robust Generalization Strategies for Morpheme Glossing in an Endangered Language Documentation Context
por: Ginn, Michael, et al.
Publicado: (2023)
por: Ginn, Michael, et al.
Publicado: (2023)
Decoding Speculative Decoding
por: Yan, Minghao, et al.
Publicado: (2024)
por: Yan, Minghao, et al.
Publicado: (2024)
Speculative Diffusion Decoding: Accelerating Language Generation through Diffusion
por: Christopher, Jacob K, et al.
Publicado: (2024)
por: Christopher, Jacob K, et al.
Publicado: (2024)
Recurrent Drafter for Fast Speculative Decoding in Large Language Models
por: Cheng, Yunfei, et al.
Publicado: (2024)
por: Cheng, Yunfei, et al.
Publicado: (2024)
On Speculative Decoding for Multimodal Large Language Models
por: Gagrani, Mukul, et al.
Publicado: (2024)
por: Gagrani, Mukul, et al.
Publicado: (2024)
Scaling Speculative Decoding with Lookahead Reasoning
por: Fu, Yichao, et al.
Publicado: (2025)
por: Fu, Yichao, et al.
Publicado: (2025)
Online Speculative Decoding
por: Liu, Xiaoxuan, et al.
Publicado: (2023)
por: Liu, Xiaoxuan, et al.
Publicado: (2023)
Can Perplexity Predict Fine-tuning Performance? An Investigation of Tokenization Effects on Sequential Language Models for Nepali
por: Luitel, Nishant, et al.
Publicado: (2024)
por: Luitel, Nishant, et al.
Publicado: (2024)
Confidence-Modulated Speculative Decoding for Large Language Models
por: Sen, Jaydip, et al.
Publicado: (2025)
por: Sen, Jaydip, et al.
Publicado: (2025)
Out-of-Vocabulary Sampling Boosts Speculative Decoding
por: Timor, Nadav, et al.
Publicado: (2025)
por: Timor, Nadav, et al.
Publicado: (2025)
Mixture of Attentions For Speculative Decoding
por: Zimmer, Matthieu, et al.
Publicado: (2024)
por: Zimmer, Matthieu, et al.
Publicado: (2024)
Mistletoe: Stealthy Acceleration-Collapse Attacks on Speculative Decoding
por: Sun, Shuoyang, et al.
Publicado: (2026)
por: Sun, Shuoyang, et al.
Publicado: (2026)
ParallelSpec: Parallel Drafter for Efficient Speculative Decoding
por: Xiao, Zilin, et al.
Publicado: (2024)
por: Xiao, Zilin, et al.
Publicado: (2024)
VOCABTRIM: Vocabulary Pruning for Efficient Speculative Decoding in LLMs
por: Goel, Raghavv, et al.
Publicado: (2025)
por: Goel, Raghavv, et al.
Publicado: (2025)
Fast Large Language Model Collaborative Decoding via Speculation
por: Fu, Jiale, et al.
Publicado: (2025)
por: Fu, Jiale, et al.
Publicado: (2025)
LK Losses: Direct Acceptance Rate Optimization for Speculative Decoding
por: Samarin, Alexander, et al.
Publicado: (2026)
por: Samarin, Alexander, et al.
Publicado: (2026)
Reject Only Critical Tokens: Pivot-Aware Speculative Decoding
por: Ziashahabi, Amir, et al.
Publicado: (2025)
por: Ziashahabi, Amir, et al.
Publicado: (2025)
Traversal Verification for Speculative Tree Decoding
por: Weng, Yepeng, et al.
Publicado: (2025)
por: Weng, Yepeng, et al.
Publicado: (2025)
Faster Cascades via Speculative Decoding
por: Narasimhan, Harikrishna, et al.
Publicado: (2024)
por: Narasimhan, Harikrishna, et al.
Publicado: (2024)
Calibrated Speculative Decoding: Frequency-Guided Candidate Selection for Efficient Inference
por: Zhou, Xuwen, et al.
Publicado: (2026)
por: Zhou, Xuwen, et al.
Publicado: (2026)
DualDiffusion: A Speculative Decoding Strategy for Masked Diffusion Models
por: Goyal, Satyam, et al.
Publicado: (2026)
por: Goyal, Satyam, et al.
Publicado: (2026)
TapOut: A Bandit-Based Approach to Dynamic Speculative Decoding
por: Sridhar, Aditya, et al.
Publicado: (2025)
por: Sridhar, Aditya, et al.
Publicado: (2025)
Kangaroo: Lossless Self-Speculative Decoding via Double Early Exiting
por: Liu, Fangcheng, et al.
Publicado: (2024)
por: Liu, Fangcheng, et al.
Publicado: (2024)
Benchmarking the Energy Savings with Speculative Decoding Strategies
por: Dutta, Rohit, et al.
Publicado: (2026)
por: Dutta, Rohit, et al.
Publicado: (2026)
HiSpec: Hierarchical Speculative Decoding for LLMs
por: Kumar, Avinash, et al.
Publicado: (2025)
por: Kumar, Avinash, et al.
Publicado: (2025)
A Theoretical Perspective for Speculative Decoding Algorithm
por: Yin, Ming, et al.
Publicado: (2024)
por: Yin, Ming, et al.
Publicado: (2024)
Accelerating RL Post-Training Rollouts via System-Integrated Speculative Decoding
por: Iso, Hayate, et al.
Publicado: (2026)
por: Iso, Hayate, et al.
Publicado: (2026)
TABED: Test-Time Adaptive Ensemble Drafting for Robust Speculative Decoding in LVLMs
por: Lee, Minjae, et al.
Publicado: (2026)
por: Lee, Minjae, et al.
Publicado: (2026)
ConfLayers: Adaptive Confidence-based Layer Skipping for Self-Speculative Decoding
por: Amer, Walaa, et al.
Publicado: (2026)
por: Amer, Walaa, et al.
Publicado: (2026)
SlimSpec: Low-Rank Draft LM-Head for Accelerated Speculative Decoding
por: Plaksin, Anton, et al.
Publicado: (2026)
por: Plaksin, Anton, et al.
Publicado: (2026)
Boosting Lossless Speculative Decoding via Feature Sampling and Partial Alignment Distillation
por: Gui, Lujun, et al.
Publicado: (2024)
por: Gui, Lujun, et al.
Publicado: (2024)
Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment
por: Bachmann, Gregor, et al.
Publicado: (2025)
por: Bachmann, Gregor, et al.
Publicado: (2025)
DEL: Context-Aware Dynamic Exit Layer for Efficient Self-Speculative Decoding
por: Zarch, Hossein Entezari, et al.
Publicado: (2025)
por: Zarch, Hossein Entezari, et al.
Publicado: (2025)
RAD: Redundancy-Aware Distillation for Hybrid Models via Self-Speculative Decoding
por: Hoshino, Yuichiro, et al.
Publicado: (2025)
por: Hoshino, Yuichiro, et al.
Publicado: (2025)
Reviving Any-Subset Autoregressive Models with Principled Parallel Sampling and Speculative Decoding
por: Guo, Gabe, et al.
Publicado: (2025)
por: Guo, Gabe, et al.
Publicado: (2025)
TriForce: Lossless Acceleration of Long Sequence Generation with Hierarchical Speculative Decoding
por: Sun, Hanshi, et al.
Publicado: (2024)
por: Sun, Hanshi, et al.
Publicado: (2024)
Neural Induction of Finite-State Transducers
por: Ginn, Michael, et al.
Publicado: (2026)
por: Ginn, Michael, et al.
Publicado: (2026)
Self-Speculative Biased Decoding for Faster Re-Translation
por: Zeng, Linxiao, et al.
Publicado: (2025)
por: Zeng, Linxiao, et al.
Publicado: (2025)
Clover: Regressive Lightweight Speculative Decoding with Sequential Knowledge
por: Xiao, Bin, et al.
Publicado: (2024)
por: Xiao, Bin, et al.
Publicado: (2024)
Speculative Decoding for Verilog: Speed and Quality, All in One
por: Xu, Changran, et al.
Publicado: (2025)
por: Xu, Changran, et al.
Publicado: (2025)
Ejemplares similares
-
Robust Generalization Strategies for Morpheme Glossing in an Endangered Language Documentation Context
por: Ginn, Michael, et al.
Publicado: (2023) -
Decoding Speculative Decoding
por: Yan, Minghao, et al.
Publicado: (2024) -
Speculative Diffusion Decoding: Accelerating Language Generation through Diffusion
por: Christopher, Jacob K, et al.
Publicado: (2024) -
Recurrent Drafter for Fast Speculative Decoding in Large Language Models
por: Cheng, Yunfei, et al.
Publicado: (2024) -
On Speculative Decoding for Multimodal Large Language Models
por: Gagrani, Mukul, et al.
Publicado: (2024)