The Disparate Impacts of Speculative Decoding
Fuente:
arXiv
Salvato in:
| Autori principali: | Sandler, Jameson, Üstün, Ahmet, Romanelli, Marco, Hooker, Sara, Fioretto, Ferdinando |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond Jailbreaking: Auditing Contextual Privacy in LLM Agents
di: Das, Saswat, et al.
Pubblicazione: (2025)
di: Das, Saswat, et al.
Pubblicazione: (2025)
SpecDiff-2: Scaling Diffusion Drafter Alignment For Faster Speculative Decoding
di: Sandler, Jameson, et al.
Pubblicazione: (2025)
di: Sandler, Jameson, et al.
Pubblicazione: (2025)
Nexus: Specialization meets Adaptability for Efficiently Training Mixture of Experts
di: Gritsch, Nikolas, et al.
Pubblicazione: (2024)
di: Gritsch, Nikolas, et al.
Pubblicazione: (2024)
Low-rank finetuning for LLMs: A fairness perspective
di: Das, Saswat, et al.
Pubblicazione: (2024)
di: Das, Saswat, et al.
Pubblicazione: (2024)
NeuroFilter: Privacy Guardrails for Conversational LLM Agents
di: Das, Saswat, et al.
Pubblicazione: (2026)
di: Das, Saswat, et al.
Pubblicazione: (2026)
RLHF Can Speak Many Languages: Unlocking Multilingual Preference Optimization for LLMs
di: Dang, John, et al.
Pubblicazione: (2024)
di: Dang, John, et al.
Pubblicazione: (2024)
Disparate Impact on Group Accuracy of Linearization for Private Inference
di: Das, Saswat, et al.
Pubblicazione: (2024)
di: Das, Saswat, et al.
Pubblicazione: (2024)
On The Fairness Impacts of Hardware Selection in Machine Learning
di: Nelaturu, Sree Harsha, et al.
Pubblicazione: (2023)
di: Nelaturu, Sree Harsha, et al.
Pubblicazione: (2023)
Scaling Laws for Speculative Decoding
di: Yan, Siyuan, et al.
Pubblicazione: (2025)
di: Yan, Siyuan, et al.
Pubblicazione: (2025)
Cross-Attention Speculative Decoding
di: Zhong, Wei, et al.
Pubblicazione: (2025)
di: Zhong, Wei, et al.
Pubblicazione: (2025)
Speculative Decoding: Performance or Illusion?
di: Liu, Xiaoxuan, et al.
Pubblicazione: (2025)
di: Liu, Xiaoxuan, et al.
Pubblicazione: (2025)
Mamba Drafters for Speculative Decoding
di: Choi, Daewon, et al.
Pubblicazione: (2025)
di: Choi, Daewon, et al.
Pubblicazione: (2025)
Constrained Decoding with Speculative Lookaheads
di: Nakshatri, Nishanth, et al.
Pubblicazione: (2024)
di: Nakshatri, Nishanth, et al.
Pubblicazione: (2024)
Goose: Anisotropic Speculation Trees for Training-Free Speculative Decoding
di: Jin, Tao, et al.
Pubblicazione: (2026)
di: Jin, Tao, et al.
Pubblicazione: (2026)
A Post-trainer's Guide to Multilingual Training Data: Uncovering Cross-lingual Transfer Dynamics
di: Shimabucoro, Luisa, et al.
Pubblicazione: (2025)
di: Shimabucoro, Luisa, et al.
Pubblicazione: (2025)
Dynamic Depth Decoding: Faster Speculative Decoding for LLMs
di: Brown, Oscar, et al.
Pubblicazione: (2024)
di: Brown, Oscar, et al.
Pubblicazione: (2024)
Batch Speculative Decoding Done Right
di: Zhang, Ranran Haoran, et al.
Pubblicazione: (2025)
di: Zhang, Ranran Haoran, et al.
Pubblicazione: (2025)
RASD: Retrieval-Augmented Speculative Decoding
di: Quan, Guofeng, et al.
Pubblicazione: (2025)
di: Quan, Guofeng, et al.
Pubblicazione: (2025)
Cacheback: Speculative Decoding With Nothing But Cache
di: Ma, Zhiyao, et al.
Pubblicazione: (2025)
di: Ma, Zhiyao, et al.
Pubblicazione: (2025)
Speculative Decoding for Multi-Sample Inference
di: Li, Yiwei, et al.
Pubblicazione: (2025)
di: Li, Yiwei, et al.
Pubblicazione: (2025)
The Multilingual Divide and Its Impact on Global AI Safety
di: Peppin, Aidan, et al.
Pubblicazione: (2025)
di: Peppin, Aidan, et al.
Pubblicazione: (2025)
Hybrid Verified Decoding: Learning to Allocate Verification in Speculative Decoding
di: Su, Xin, et al.
Pubblicazione: (2026)
di: Su, Xin, et al.
Pubblicazione: (2026)
Online Speculative Decoding
di: Liu, Xiaoxuan, et al.
Pubblicazione: (2023)
di: Liu, Xiaoxuan, et al.
Pubblicazione: (2023)
On the Limitations of Compute Thresholds as a Governance Strategy
di: Hooker, Sara
Pubblicazione: (2024)
di: Hooker, Sara
Pubblicazione: (2024)
Mixture of Attentions For Speculative Decoding
di: Zimmer, Matthieu, et al.
Pubblicazione: (2024)
di: Zimmer, Matthieu, et al.
Pubblicazione: (2024)
GRIFFIN: Effective Token Alignment for Faster Speculative Decoding
di: Hu, Shijing, et al.
Pubblicazione: (2025)
di: Hu, Shijing, et al.
Pubblicazione: (2025)
Reward-Guided Speculative Decoding for Efficient LLM Reasoning
di: Liao, Baohao, et al.
Pubblicazione: (2025)
di: Liao, Baohao, et al.
Pubblicazione: (2025)
RACER: Retrieval-Augmented Contextual Rapid Speculative Decoding
di: Zhang, Zihong, et al.
Pubblicazione: (2026)
di: Zhang, Zihong, et al.
Pubblicazione: (2026)
Acceptance Dynamics Across Cognitive Domains in Speculative Decoding
di: Mahmoud, Saif
Pubblicazione: (2026)
di: Mahmoud, Saif
Pubblicazione: (2026)
When Personalization Meets Reality: A Multi-Faceted Analysis of Personalized Preference Learning
di: Dong, Yijiang River, et al.
Pubblicazione: (2025)
di: Dong, Yijiang River, et al.
Pubblicazione: (2025)
TETRIS: Optimal Draft Token Selection for Batch Speculative Decoding
di: Wu, Zhaoxuan, et al.
Pubblicazione: (2025)
di: Wu, Zhaoxuan, et al.
Pubblicazione: (2025)
DiffuSpec: Unlocking Diffusion Language Models for Speculative Decoding
di: Li, Guanghao, et al.
Pubblicazione: (2025)
di: Li, Guanghao, et al.
Pubblicazione: (2025)
When, What, and How: Rethinking Retrieval-Enhanced Speculative Decoding
di: Fang, Min, et al.
Pubblicazione: (2025)
di: Fang, Min, et al.
Pubblicazione: (2025)
Entropy-Aware Speculative Decoding Toward Improved LLM Reasoning
di: Su, Tiancheng, et al.
Pubblicazione: (2025)
di: Su, Tiancheng, et al.
Pubblicazione: (2025)
Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding
di: Wang, Ziyao, et al.
Pubblicazione: (2025)
di: Wang, Ziyao, et al.
Pubblicazione: (2025)
PACER: Blockwise Pre-verification for Speculative Decoding with Adaptive Length
di: Zhang, Situo, et al.
Pubblicazione: (2026)
di: Zhang, Situo, et al.
Pubblicazione: (2026)
SpecHub: Provable Acceleration to Multi-Draft Speculative Decoding
di: Sun, Ryan, et al.
Pubblicazione: (2024)
di: Sun, Ryan, et al.
Pubblicazione: (2024)
Traversal Verification for Speculative Tree Decoding
di: Weng, Yepeng, et al.
Pubblicazione: (2025)
di: Weng, Yepeng, et al.
Pubblicazione: (2025)
Faster Cascades via Speculative Decoding
di: Narasimhan, Harikrishna, et al.
Pubblicazione: (2024)
di: Narasimhan, Harikrishna, et al.
Pubblicazione: (2024)
Bridging Draft Policy Misalignment: Group Tree Optimization for Speculative Decoding
di: Hu, Shijing, et al.
Pubblicazione: (2025)
di: Hu, Shijing, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Beyond Jailbreaking: Auditing Contextual Privacy in LLM Agents
di: Das, Saswat, et al.
Pubblicazione: (2025) -
SpecDiff-2: Scaling Diffusion Drafter Alignment For Faster Speculative Decoding
di: Sandler, Jameson, et al.
Pubblicazione: (2025) -
Nexus: Specialization meets Adaptability for Efficiently Training Mixture of Experts
di: Gritsch, Nikolas, et al.
Pubblicazione: (2024) -
Low-rank finetuning for LLMs: A fairness perspective
di: Das, Saswat, et al.
Pubblicazione: (2024) -
NeuroFilter: Privacy Guardrails for Conversational LLM Agents
di: Das, Saswat, et al.
Pubblicazione: (2026)