Speculative Contrastive Decoding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yuan, Hongyi, Lu, Keming, Huang, Fei, Yuan, Zheng, Zhou, Chang |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Predicting Rewards Alongside Tokens: Non-disruptive Parameter Insertion for Efficient Inference Intervention in Large Language Model
par: Yuan, Chenhan, et autres
Publié: (2024)
par: Yuan, Chenhan, et autres
Publié: (2024)
MuggleMath: Assessing the Impact of Query and Response Augmentation on Math Reasoning
par: Li, Chengpeng, et autres
Publié: (2023)
par: Li, Chengpeng, et autres
Publié: (2023)
Factorization-Error-Free Discrete Diffusion Language Model via Speculative Decoding
par: Fang, Xun, et autres
Publié: (2026)
par: Fang, Xun, et autres
Publié: (2026)
Speculative Pipeline Decoding: Higher-Accruacy and Zero-Bubble Speculation via Pipeline Parallelism
par: Yu, Yijiong, et autres
Publié: (2026)
par: Yu, Yijiong, et autres
Publié: (2026)
How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition
par: Dong, Guanting, et autres
Publié: (2023)
par: Dong, Guanting, et autres
Publié: (2023)
Multi-Candidate Speculative Decoding
par: Yang, Sen, et autres
Publié: (2024)
par: Yang, Sen, et autres
Publié: (2024)
Speculative Decoding with a Speculative Vocabulary
par: Williams, Miles, et autres
Publié: (2026)
par: Williams, Miles, et autres
Publié: (2026)
Improving Multi-candidate Speculative Decoding
par: Lu, Xiaofan, et autres
Publié: (2024)
par: Lu, Xiaofan, et autres
Publié: (2024)
Decoding Speculative Decoding
par: Yan, Minghao, et autres
Publié: (2024)
par: Yan, Minghao, et autres
Publié: (2024)
Speculative Decoding for Multi-Sample Inference
par: Li, Yiwei, et autres
Publié: (2025)
par: Li, Yiwei, et autres
Publié: (2025)
Speculate Deep and Accurate: Lossless and Training-Free Acceleration for Offloaded LLMs via Substitute Speculative Decoding
par: Wang, Pei-Shuo, et autres
Publié: (2025)
par: Wang, Pei-Shuo, et autres
Publié: (2025)
VOCABTRIM: Vocabulary Pruning for Efficient Speculative Decoding in LLMs
par: Goel, Raghavv, et autres
Publié: (2025)
par: Goel, Raghavv, et autres
Publié: (2025)
Efficient Speculative Decoding for Llama at Scale: Challenges and Solutions
par: Tang, Bangsheng, et autres
Publié: (2025)
par: Tang, Bangsheng, et autres
Publié: (2025)
Online Merging Optimizers for Boosting Rewards and Mitigating Tax in Alignment
par: Lu, Keming, et autres
Publié: (2024)
par: Lu, Keming, et autres
Publié: (2024)
Delta -- Contrastive Decoding Mitigates Text Hallucinations in Large Language Models
par: Huang, Cheng Peng, et autres
Publié: (2025)
par: Huang, Cheng Peng, et autres
Publié: (2025)
GRIFFIN: Effective Token Alignment for Faster Speculative Decoding
par: Hu, Shijing, et autres
Publié: (2025)
par: Hu, Shijing, et autres
Publié: (2025)
3-Model Speculative Decoding
par: Byun, Sanghyun, et autres
Publié: (2025)
par: Byun, Sanghyun, et autres
Publié: (2025)
Graph-Structured Speculative Decoding
par: Gong, Zhuocheng, et autres
Publié: (2024)
par: Gong, Zhuocheng, et autres
Publié: (2024)
Speculative Verification: Exploiting Information Gain to Refine Speculative Decoding
par: Kim, Sungkyun, et autres
Publié: (2025)
par: Kim, Sungkyun, et autres
Publié: (2025)
DiffuSpec: Unlocking Diffusion Language Models for Speculative Decoding
par: Li, Guanghao, et autres
Publié: (2025)
par: Li, Guanghao, et autres
Publié: (2025)
Bridging Draft Policy Misalignment: Group Tree Optimization for Speculative Decoding
par: Hu, Shijing, et autres
Publié: (2025)
par: Hu, Shijing, et autres
Publié: (2025)
Large Language Models are Superpositions of All Characters: Attaining Arbitrary Role-play via Self-Alignment
par: Lu, Keming, et autres
Publié: (2024)
par: Lu, Keming, et autres
Publié: (2024)
Towards Optimal Multi-draft Speculative Decoding
par: Hu, Zhengmian, et autres
Publié: (2025)
par: Hu, Zhengmian, et autres
Publié: (2025)
Calibrated Speculative Decoding: Frequency-Guided Candidate Selection for Efficient Inference
par: Zhou, Xuwen, et autres
Publié: (2026)
par: Zhou, Xuwen, et autres
Publié: (2026)
Dynamic Speculation Lookahead Accelerates Speculative Decoding of Large Language Models
par: Mamou, Jonathan, et autres
Publié: (2024)
par: Mamou, Jonathan, et autres
Publié: (2024)
Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding
par: Chen, Zhuoming, et autres
Publié: (2024)
par: Chen, Zhuoming, et autres
Publié: (2024)
Learning to Draft: Adaptive Speculative Decoding with Reinforcement Learning
par: Zhang, Jiebin, et autres
Publié: (2026)
par: Zhang, Jiebin, et autres
Publié: (2026)
PSD: Pushing the Pareto Frontier of Diffusion LLMs via Parallel Speculative Decoding
par: Sun, Shengyin, et autres
Publié: (2026)
par: Sun, Shengyin, et autres
Publié: (2026)
Towards Fast Multilingual LLM Inference: Speculative Decoding and Specialized Drafters
par: Yi, Euiin, et autres
Publié: (2024)
par: Yi, Euiin, et autres
Publié: (2024)
Language Confusion Gate: Language-Aware Decoding Through Model Self-Distillation
par: Zhang, Collin, et autres
Publié: (2025)
par: Zhang, Collin, et autres
Publié: (2025)
Speculative Decoding for Verilog: Speed and Quality, All in One
par: Xu, Changran, et autres
Publié: (2025)
par: Xu, Changran, et autres
Publié: (2025)
SpecBlock: Block-Iterative Speculative Decoding with Dynamic Tree Drafting
par: Shi, Weijie, et autres
Publié: (2026)
par: Shi, Weijie, et autres
Publié: (2026)
The Disparate Impacts of Speculative Decoding
par: Sandler, Jameson, et autres
Publié: (2025)
par: Sandler, Jameson, et autres
Publié: (2025)
Constrained Decoding with Speculative Lookaheads
par: Nakshatri, Nishanth, et autres
Publié: (2024)
par: Nakshatri, Nishanth, et autres
Publié: (2024)
Speculative Decoding Across Languages
par: Paudel, Nirajan, et autres
Publié: (2026)
par: Paudel, Nirajan, et autres
Publié: (2026)
Scaling Laws for Speculative Decoding
par: Yan, Siyuan, et autres
Publié: (2025)
par: Yan, Siyuan, et autres
Publié: (2025)
Cross-Attention Speculative Decoding
par: Zhong, Wei, et autres
Publié: (2025)
par: Zhong, Wei, et autres
Publié: (2025)
Speculative Decoding: Performance or Illusion?
par: Liu, Xiaoxuan, et autres
Publié: (2025)
par: Liu, Xiaoxuan, et autres
Publié: (2025)
Mamba Drafters for Speculative Decoding
par: Choi, Daewon, et autres
Publié: (2025)
par: Choi, Daewon, et autres
Publié: (2025)
Draft on the Fly: Adaptive Self-Speculative Decoding using Cosine Similarity
par: Metel, Michael R., et autres
Publié: (2024)
par: Metel, Michael R., et autres
Publié: (2024)
Documents similaires
-
Predicting Rewards Alongside Tokens: Non-disruptive Parameter Insertion for Efficient Inference Intervention in Large Language Model
par: Yuan, Chenhan, et autres
Publié: (2024) -
MuggleMath: Assessing the Impact of Query and Response Augmentation on Math Reasoning
par: Li, Chengpeng, et autres
Publié: (2023) -
Factorization-Error-Free Discrete Diffusion Language Model via Speculative Decoding
par: Fang, Xun, et autres
Publié: (2026) -
Speculative Pipeline Decoding: Higher-Accruacy and Zero-Bubble Speculation via Pipeline Parallelism
par: Yu, Yijiong, et autres
Publié: (2026) -
How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition
par: Dong, Guanting, et autres
Publié: (2023)