Speculate Deep and Accurate: Lossless and Training-Free Acceleration for Offloaded LLMs via Substitute Speculative Decoding

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Wang, Pei-Shuo, Chen, Jian-Jia, Yang, Chun-Che, Chang, Chi-Chih, Huang, Ning-Chi, Abdelfattah, Mohamed S., Wu, Kai-Chiang
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!