Accelerating Time Series Foundation Models with Speculative Decoding
Fuente:
arXiv
Salvato in:
| Autori principali: | Subbaraman, Pranav, Sun, Fang, Yao, Yue, Tang, Huacong, Luo, Xiao, Sun, Yizhou |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Graph Fourier Neural ODEs: Modeling Spatial-temporal Multi-scales in Molecular Dynamics
di: Sun, Fang, et al.
Pubblicazione: (2024)
di: Sun, Fang, et al.
Pubblicazione: (2024)
Mistletoe: Stealthy Acceleration-Collapse Attacks on Speculative Decoding
di: Sun, Shuoyang, et al.
Pubblicazione: (2026)
di: Sun, Shuoyang, et al.
Pubblicazione: (2026)
Block Verification Accelerates Speculative Decoding
di: Sun, Ziteng, et al.
Pubblicazione: (2024)
di: Sun, Ziteng, et al.
Pubblicazione: (2024)
Accelerating Large-Scale Reasoning Model Inference with Sparse Self-Speculative Decoding
di: Zhao, Yilong, et al.
Pubblicazione: (2025)
di: Zhao, Yilong, et al.
Pubblicazione: (2025)
SpecPipe: Accelerating Pipeline Parallelism-based LLM Inference with Speculative Decoding
di: Yin, Haofei, et al.
Pubblicazione: (2025)
di: Yin, Haofei, et al.
Pubblicazione: (2025)
TriForce: Lossless Acceleration of Long Sequence Generation with Hierarchical Speculative Decoding
di: Sun, Hanshi, et al.
Pubblicazione: (2024)
di: Sun, Hanshi, et al.
Pubblicazione: (2024)
TimeDiT: General-purpose Diffusion Transformers for Time Series Foundation Model
di: Cao, Defu, et al.
Pubblicazione: (2024)
di: Cao, Defu, et al.
Pubblicazione: (2024)
Speculative Speculative Decoding
di: Kumar, Tanishq, et al.
Pubblicazione: (2026)
di: Kumar, Tanishq, et al.
Pubblicazione: (2026)
FastEagle: Cascaded Drafting for Accelerating Speculative Decoding
di: Huang, Haiduo, et al.
Pubblicazione: (2025)
di: Huang, Haiduo, et al.
Pubblicazione: (2025)
Accelerating Quasi-Static Time Series Simulations with Foundation Models
di: Puech, Alban, et al.
Pubblicazione: (2024)
di: Puech, Alban, et al.
Pubblicazione: (2024)
FastGRPO: Accelerating Policy Optimization via Concurrency-aware Speculative Decoding and Online Draft Learning
di: Zhang, Yizhou, et al.
Pubblicazione: (2025)
di: Zhang, Yizhou, et al.
Pubblicazione: (2025)
TimeFound: A Foundation Model for Time Series Forecasting
di: Xiao, Congxi, et al.
Pubblicazione: (2025)
di: Xiao, Congxi, et al.
Pubblicazione: (2025)
TPP-SD: Accelerating Transformer Point Process Sampling with Speculative Decoding
di: Gong, Shukai, et al.
Pubblicazione: (2025)
di: Gong, Shukai, et al.
Pubblicazione: (2025)
TS-DP: Reinforcement Speculative Decoding For Temporal Adaptive Diffusion Policy Acceleration
di: Li, Ye, et al.
Pubblicazione: (2025)
di: Li, Ye, et al.
Pubblicazione: (2025)
KERV: Kinematic-Rectified Speculative Decoding for Embodied VLA Models
di: Zheng, Zihao, et al.
Pubblicazione: (2026)
di: Zheng, Zihao, et al.
Pubblicazione: (2026)
Decoding Speculative Decoding
di: Yan, Minghao, et al.
Pubblicazione: (2024)
di: Yan, Minghao, et al.
Pubblicazione: (2024)
Speculative Diffusion Decoding: Accelerating Language Generation through Diffusion
di: Christopher, Jacob K, et al.
Pubblicazione: (2024)
di: Christopher, Jacob K, et al.
Pubblicazione: (2024)
Speculative Decoding with CTC-based Draft Model for LLM Inference Acceleration
di: Wen, Zhuofan, et al.
Pubblicazione: (2024)
di: Wen, Zhuofan, et al.
Pubblicazione: (2024)
Time Tracker: Mixture-of-Experts-Enhanced Foundation Time Series Forecasting Model with Decoupled Training Pipelines
di: Liang, Aobo, et al.
Pubblicazione: (2025)
di: Liang, Aobo, et al.
Pubblicazione: (2025)
MIRA: Medical Time Series Foundation Model for Real-World Health Data
di: Li, Hao, et al.
Pubblicazione: (2025)
di: Li, Hao, et al.
Pubblicazione: (2025)
EAGLE-Pangu: Accelerator-Safe Tree Speculative Decoding on Ascend NPUs
di: Han, Chang, et al.
Pubblicazione: (2026)
di: Han, Chang, et al.
Pubblicazione: (2026)
ConFu: Contemplate the Future for Better Speculative Sampling
di: Qin, Zongyue, et al.
Pubblicazione: (2026)
di: Qin, Zongyue, et al.
Pubblicazione: (2026)
Time-Series Forecasting, Knowledge Distillation, and Refinement within a Multimodal PDE Foundation Model
di: Jollie, Derek, et al.
Pubblicazione: (2024)
di: Jollie, Derek, et al.
Pubblicazione: (2024)
Decoding Latent Spaces: Assessing the Interpretability of Time Series Foundation Models for Visual Analytics
di: Santamaria-Valenzuela, Inmaculada, et al.
Pubblicazione: (2025)
di: Santamaria-Valenzuela, Inmaculada, et al.
Pubblicazione: (2025)
Polybasic Speculative Decoding Through a Theoretical Perspective
di: Wang, Ruilin, et al.
Pubblicazione: (2025)
di: Wang, Ruilin, et al.
Pubblicazione: (2025)
How Foundational are Foundation Models for Time Series Forecasting?
di: Karaouli, Nouha, et al.
Pubblicazione: (2025)
di: Karaouli, Nouha, et al.
Pubblicazione: (2025)
Fast Inference of Removal-Based Node Influence
di: Li, Weikai, et al.
Pubblicazione: (2024)
di: Li, Weikai, et al.
Pubblicazione: (2024)
DMamba: Decomposition-enhanced Mamba for Time Series Forecasting
di: Chen, Ruxuan, et al.
Pubblicazione: (2026)
di: Chen, Ruxuan, et al.
Pubblicazione: (2026)
Accelerated Diffusion Models via Speculative Sampling
di: De Bortoli, Valentin, et al.
Pubblicazione: (2025)
di: De Bortoli, Valentin, et al.
Pubblicazione: (2025)
Evaluating Time Series Foundation Models on Noisy Periodic Time Series
di: Gupta, Syamantak Datta
Pubblicazione: (2025)
di: Gupta, Syamantak Datta
Pubblicazione: (2025)
Discrete Prototypical Memories for Federated Time Series Foundation Models
di: Deng, Liwei, et al.
Pubblicazione: (2026)
di: Deng, Liwei, et al.
Pubblicazione: (2026)
MoESD: Unveil Speculative Decoding's Potential for Accelerating Sparse MoE
di: Huang, Zongle, et al.
Pubblicazione: (2025)
di: Huang, Zongle, et al.
Pubblicazione: (2025)
Accelerating RL Post-Training Rollouts via System-Integrated Speculative Decoding
di: Iso, Hayate, et al.
Pubblicazione: (2026)
di: Iso, Hayate, et al.
Pubblicazione: (2026)
Recursive Speculative Decoding: Accelerating LLM Inference via Sampling Without Replacement
di: Jeon, Wonseok, et al.
Pubblicazione: (2024)
di: Jeon, Wonseok, et al.
Pubblicazione: (2024)
SlimSpec: Low-Rank Draft LM-Head for Accelerated Speculative Decoding
di: Plaksin, Anton, et al.
Pubblicazione: (2026)
di: Plaksin, Anton, et al.
Pubblicazione: (2026)
Time-Series Classification with Multivariate Statistical Dependence Features
di: Sun, Yao, et al.
Pubblicazione: (2026)
di: Sun, Yao, et al.
Pubblicazione: (2026)
Spiffy: Multiplying Diffusion LLM Acceleration via Lossless Speculative Decoding
di: Agrawal, Sudhanshu, et al.
Pubblicazione: (2025)
di: Agrawal, Sudhanshu, et al.
Pubblicazione: (2025)
Accelerating LLM Inference with Lossless Speculative Decoding Algorithms for Heterogeneous Vocabularies
di: Timor, Nadav, et al.
Pubblicazione: (2025)
di: Timor, Nadav, et al.
Pubblicazione: (2025)
Cactus: Accelerating Auto-Regressive Decoding with Constrained Acceptance Speculative Sampling
di: Hao, Yongchang, et al.
Pubblicazione: (2026)
di: Hao, Yongchang, et al.
Pubblicazione: (2026)
An Interpretable Latency Model for Speculative Decoding in LLM Serving
di: Kong, Linghao, et al.
Pubblicazione: (2026)
di: Kong, Linghao, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Graph Fourier Neural ODEs: Modeling Spatial-temporal Multi-scales in Molecular Dynamics
di: Sun, Fang, et al.
Pubblicazione: (2024) -
Mistletoe: Stealthy Acceleration-Collapse Attacks on Speculative Decoding
di: Sun, Shuoyang, et al.
Pubblicazione: (2026) -
Block Verification Accelerates Speculative Decoding
di: Sun, Ziteng, et al.
Pubblicazione: (2024) -
Accelerating Large-Scale Reasoning Model Inference with Sparse Self-Speculative Decoding
di: Zhao, Yilong, et al.
Pubblicazione: (2025) -
SpecPipe: Accelerating Pipeline Parallelism-based LLM Inference with Speculative Decoding
di: Yin, Haofei, et al.
Pubblicazione: (2025)