Accelerating Time Series Foundation Models with Speculative Decoding
Fuente:
arXiv
Guardado en:
| Autores principales: | Subbaraman, Pranav, Sun, Fang, Yao, Yue, Tang, Huacong, Luo, Xiao, Sun, Yizhou |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Graph Fourier Neural ODEs: Modeling Spatial-temporal Multi-scales in Molecular Dynamics
por: Sun, Fang, et al.
Publicado: (2024)
por: Sun, Fang, et al.
Publicado: (2024)
Mistletoe: Stealthy Acceleration-Collapse Attacks on Speculative Decoding
por: Sun, Shuoyang, et al.
Publicado: (2026)
por: Sun, Shuoyang, et al.
Publicado: (2026)
Block Verification Accelerates Speculative Decoding
por: Sun, Ziteng, et al.
Publicado: (2024)
por: Sun, Ziteng, et al.
Publicado: (2024)
Accelerating Large-Scale Reasoning Model Inference with Sparse Self-Speculative Decoding
por: Zhao, Yilong, et al.
Publicado: (2025)
por: Zhao, Yilong, et al.
Publicado: (2025)
SpecPipe: Accelerating Pipeline Parallelism-based LLM Inference with Speculative Decoding
por: Yin, Haofei, et al.
Publicado: (2025)
por: Yin, Haofei, et al.
Publicado: (2025)
TriForce: Lossless Acceleration of Long Sequence Generation with Hierarchical Speculative Decoding
por: Sun, Hanshi, et al.
Publicado: (2024)
por: Sun, Hanshi, et al.
Publicado: (2024)
TimeDiT: General-purpose Diffusion Transformers for Time Series Foundation Model
por: Cao, Defu, et al.
Publicado: (2024)
por: Cao, Defu, et al.
Publicado: (2024)
Speculative Speculative Decoding
por: Kumar, Tanishq, et al.
Publicado: (2026)
por: Kumar, Tanishq, et al.
Publicado: (2026)
FastEagle: Cascaded Drafting for Accelerating Speculative Decoding
por: Huang, Haiduo, et al.
Publicado: (2025)
por: Huang, Haiduo, et al.
Publicado: (2025)
Accelerating Quasi-Static Time Series Simulations with Foundation Models
por: Puech, Alban, et al.
Publicado: (2024)
por: Puech, Alban, et al.
Publicado: (2024)
FastGRPO: Accelerating Policy Optimization via Concurrency-aware Speculative Decoding and Online Draft Learning
por: Zhang, Yizhou, et al.
Publicado: (2025)
por: Zhang, Yizhou, et al.
Publicado: (2025)
TimeFound: A Foundation Model for Time Series Forecasting
por: Xiao, Congxi, et al.
Publicado: (2025)
por: Xiao, Congxi, et al.
Publicado: (2025)
TPP-SD: Accelerating Transformer Point Process Sampling with Speculative Decoding
por: Gong, Shukai, et al.
Publicado: (2025)
por: Gong, Shukai, et al.
Publicado: (2025)
TS-DP: Reinforcement Speculative Decoding For Temporal Adaptive Diffusion Policy Acceleration
por: Li, Ye, et al.
Publicado: (2025)
por: Li, Ye, et al.
Publicado: (2025)
KERV: Kinematic-Rectified Speculative Decoding for Embodied VLA Models
por: Zheng, Zihao, et al.
Publicado: (2026)
por: Zheng, Zihao, et al.
Publicado: (2026)
Decoding Speculative Decoding
por: Yan, Minghao, et al.
Publicado: (2024)
por: Yan, Minghao, et al.
Publicado: (2024)
Speculative Diffusion Decoding: Accelerating Language Generation through Diffusion
por: Christopher, Jacob K, et al.
Publicado: (2024)
por: Christopher, Jacob K, et al.
Publicado: (2024)
Speculative Decoding with CTC-based Draft Model for LLM Inference Acceleration
por: Wen, Zhuofan, et al.
Publicado: (2024)
por: Wen, Zhuofan, et al.
Publicado: (2024)
Time Tracker: Mixture-of-Experts-Enhanced Foundation Time Series Forecasting Model with Decoupled Training Pipelines
por: Liang, Aobo, et al.
Publicado: (2025)
por: Liang, Aobo, et al.
Publicado: (2025)
MIRA: Medical Time Series Foundation Model for Real-World Health Data
por: Li, Hao, et al.
Publicado: (2025)
por: Li, Hao, et al.
Publicado: (2025)
EAGLE-Pangu: Accelerator-Safe Tree Speculative Decoding on Ascend NPUs
por: Han, Chang, et al.
Publicado: (2026)
por: Han, Chang, et al.
Publicado: (2026)
ConFu: Contemplate the Future for Better Speculative Sampling
por: Qin, Zongyue, et al.
Publicado: (2026)
por: Qin, Zongyue, et al.
Publicado: (2026)
Time-Series Forecasting, Knowledge Distillation, and Refinement within a Multimodal PDE Foundation Model
por: Jollie, Derek, et al.
Publicado: (2024)
por: Jollie, Derek, et al.
Publicado: (2024)
Decoding Latent Spaces: Assessing the Interpretability of Time Series Foundation Models for Visual Analytics
por: Santamaria-Valenzuela, Inmaculada, et al.
Publicado: (2025)
por: Santamaria-Valenzuela, Inmaculada, et al.
Publicado: (2025)
Polybasic Speculative Decoding Through a Theoretical Perspective
por: Wang, Ruilin, et al.
Publicado: (2025)
por: Wang, Ruilin, et al.
Publicado: (2025)
How Foundational are Foundation Models for Time Series Forecasting?
por: Karaouli, Nouha, et al.
Publicado: (2025)
por: Karaouli, Nouha, et al.
Publicado: (2025)
Fast Inference of Removal-Based Node Influence
por: Li, Weikai, et al.
Publicado: (2024)
por: Li, Weikai, et al.
Publicado: (2024)
DMamba: Decomposition-enhanced Mamba for Time Series Forecasting
por: Chen, Ruxuan, et al.
Publicado: (2026)
por: Chen, Ruxuan, et al.
Publicado: (2026)
Accelerated Diffusion Models via Speculative Sampling
por: De Bortoli, Valentin, et al.
Publicado: (2025)
por: De Bortoli, Valentin, et al.
Publicado: (2025)
Evaluating Time Series Foundation Models on Noisy Periodic Time Series
por: Gupta, Syamantak Datta
Publicado: (2025)
por: Gupta, Syamantak Datta
Publicado: (2025)
Discrete Prototypical Memories for Federated Time Series Foundation Models
por: Deng, Liwei, et al.
Publicado: (2026)
por: Deng, Liwei, et al.
Publicado: (2026)
MoESD: Unveil Speculative Decoding's Potential for Accelerating Sparse MoE
por: Huang, Zongle, et al.
Publicado: (2025)
por: Huang, Zongle, et al.
Publicado: (2025)
Accelerating RL Post-Training Rollouts via System-Integrated Speculative Decoding
por: Iso, Hayate, et al.
Publicado: (2026)
por: Iso, Hayate, et al.
Publicado: (2026)
Recursive Speculative Decoding: Accelerating LLM Inference via Sampling Without Replacement
por: Jeon, Wonseok, et al.
Publicado: (2024)
por: Jeon, Wonseok, et al.
Publicado: (2024)
SlimSpec: Low-Rank Draft LM-Head for Accelerated Speculative Decoding
por: Plaksin, Anton, et al.
Publicado: (2026)
por: Plaksin, Anton, et al.
Publicado: (2026)
Time-Series Classification with Multivariate Statistical Dependence Features
por: Sun, Yao, et al.
Publicado: (2026)
por: Sun, Yao, et al.
Publicado: (2026)
Spiffy: Multiplying Diffusion LLM Acceleration via Lossless Speculative Decoding
por: Agrawal, Sudhanshu, et al.
Publicado: (2025)
por: Agrawal, Sudhanshu, et al.
Publicado: (2025)
Accelerating LLM Inference with Lossless Speculative Decoding Algorithms for Heterogeneous Vocabularies
por: Timor, Nadav, et al.
Publicado: (2025)
por: Timor, Nadav, et al.
Publicado: (2025)
Cactus: Accelerating Auto-Regressive Decoding with Constrained Acceptance Speculative Sampling
por: Hao, Yongchang, et al.
Publicado: (2026)
por: Hao, Yongchang, et al.
Publicado: (2026)
An Interpretable Latency Model for Speculative Decoding in LLM Serving
por: Kong, Linghao, et al.
Publicado: (2026)
por: Kong, Linghao, et al.
Publicado: (2026)
Ejemplares similares
-
Graph Fourier Neural ODEs: Modeling Spatial-temporal Multi-scales in Molecular Dynamics
por: Sun, Fang, et al.
Publicado: (2024) -
Mistletoe: Stealthy Acceleration-Collapse Attacks on Speculative Decoding
por: Sun, Shuoyang, et al.
Publicado: (2026) -
Block Verification Accelerates Speculative Decoding
por: Sun, Ziteng, et al.
Publicado: (2024) -
Accelerating Large-Scale Reasoning Model Inference with Sparse Self-Speculative Decoding
por: Zhao, Yilong, et al.
Publicado: (2025) -
SpecPipe: Accelerating Pipeline Parallelism-based LLM Inference with Speculative Decoding
por: Yin, Haofei, et al.
Publicado: (2025)