TPP-SD: Accelerating Transformer Point Process Sampling with Speculative Decoding
Fuente:
arXiv
Guardado en:
| Autores principales: | Gong, Shukai, Fu, Yiyang, Ran, Fengyuan, Kong, Quyu, Zhou, Feng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Advances in Temporal Point Processes: Bayesian, Neural, and LLM Approaches
por: Zhou, Feng, et al.
Publicado: (2025)
por: Zhou, Feng, et al.
Publicado: (2025)
Byte-token Enhanced Language Models for Temporal Point Processes Analysis
por: Kong, Quyu, et al.
Publicado: (2025)
por: Kong, Quyu, et al.
Publicado: (2025)
DanmakuTPPBench: A Multi-modal Benchmark for Temporal Point Process Modeling and Understanding
por: Jiang, Yue, et al.
Publicado: (2025)
por: Jiang, Yue, et al.
Publicado: (2025)
Long-range Modeling and Processing of Multimodal Event Sequences
por: Li, Jichu, et al.
Publicado: (2026)
por: Li, Jichu, et al.
Publicado: (2026)
TransFeat-TPP: An Interpretable Deep Covariate Temporal Point Processes
por: Meng, Zizhuo, et al.
Publicado: (2024)
por: Meng, Zizhuo, et al.
Publicado: (2024)
Speculative Sampling for Parametric Temporal Point Processes
por: Biloš, Marin, et al.
Publicado: (2025)
por: Biloš, Marin, et al.
Publicado: (2025)
EasyTPP: Towards Open Benchmarking Temporal Point Processes
por: Xue, Siqiao, et al.
Publicado: (2023)
por: Xue, Siqiao, et al.
Publicado: (2023)
Fair Bayesian Data Selection via Generalized Discrepancy Measures
por: Zhang, Yixuan, et al.
Publicado: (2025)
por: Zhang, Yixuan, et al.
Publicado: (2025)
Negative Binomial Variational Autoencoders for Overdispersed Latent Modeling
por: Zhang, Yixuan, et al.
Publicado: (2025)
por: Zhang, Yixuan, et al.
Publicado: (2025)
HeiSD: Hybrid Speculative Decoding for Embodied Vision-Language-Action Models with Kinematic Awareness
por: Zheng, Zihao, et al.
Publicado: (2026)
por: Zheng, Zihao, et al.
Publicado: (2026)
Recursive Speculative Decoding: Accelerating LLM Inference via Sampling Without Replacement
por: Jeon, Wonseok, et al.
Publicado: (2024)
por: Jeon, Wonseok, et al.
Publicado: (2024)
ADiff4TPP: Asynchronous Diffusion Models for Temporal Point Processes
por: Mukherjee, Amartya, et al.
Publicado: (2025)
por: Mukherjee, Amartya, et al.
Publicado: (2025)
Cactus: Accelerating Auto-Regressive Decoding with Constrained Acceptance Speculative Sampling
por: Hao, Yongchang, et al.
Publicado: (2026)
por: Hao, Yongchang, et al.
Publicado: (2026)
Speculative Speculative Decoding
por: Kumar, Tanishq, et al.
Publicado: (2026)
por: Kumar, Tanishq, et al.
Publicado: (2026)
Accelerating RL Post-Training Rollouts via System-Integrated Speculative Decoding
por: Iso, Hayate, et al.
Publicado: (2026)
por: Iso, Hayate, et al.
Publicado: (2026)
FastEagle: Cascaded Drafting for Accelerating Speculative Decoding
por: Huang, Haiduo, et al.
Publicado: (2025)
por: Huang, Haiduo, et al.
Publicado: (2025)
Accelerating Time Series Foundation Models with Speculative Decoding
por: Subbaraman, Pranav, et al.
Publicado: (2025)
por: Subbaraman, Pranav, et al.
Publicado: (2025)
Accelerated Diffusion Models via Speculative Sampling
por: De Bortoli, Valentin, et al.
Publicado: (2025)
por: De Bortoli, Valentin, et al.
Publicado: (2025)
Out-of-Vocabulary Sampling Boosts Speculative Decoding
por: Timor, Nadav, et al.
Publicado: (2025)
por: Timor, Nadav, et al.
Publicado: (2025)
Speculative Decoding with CTC-based Draft Model for LLM Inference Acceleration
por: Wen, Zhuofan, et al.
Publicado: (2024)
por: Wen, Zhuofan, et al.
Publicado: (2024)
Mistletoe: Stealthy Acceleration-Collapse Attacks on Speculative Decoding
por: Sun, Shuoyang, et al.
Publicado: (2026)
por: Sun, Shuoyang, et al.
Publicado: (2026)
Block Verification Accelerates Speculative Decoding
por: Sun, Ziteng, et al.
Publicado: (2024)
por: Sun, Ziteng, et al.
Publicado: (2024)
Decoding Speculative Decoding
por: Yan, Minghao, et al.
Publicado: (2024)
por: Yan, Minghao, et al.
Publicado: (2024)
QSpec: Speculative Decoding with Complementary Quantization Schemes
por: Zhao, Juntao, et al.
Publicado: (2024)
por: Zhao, Juntao, et al.
Publicado: (2024)
Optimized Speculative Sampling for GPU Hardware Accelerators
por: Wagner, Dominik, et al.
Publicado: (2024)
por: Wagner, Dominik, et al.
Publicado: (2024)
TS-DP: Reinforcement Speculative Decoding For Temporal Adaptive Diffusion Policy Acceleration
por: Li, Ye, et al.
Publicado: (2025)
por: Li, Ye, et al.
Publicado: (2025)
Speculative Diffusion Decoding: Accelerating Language Generation through Diffusion
por: Christopher, Jacob K, et al.
Publicado: (2024)
por: Christopher, Jacob K, et al.
Publicado: (2024)
Scaling Speculative Decoding with Lookahead Reasoning
por: Fu, Yichao, et al.
Publicado: (2025)
por: Fu, Yichao, et al.
Publicado: (2025)
An Interpretable Latency Model for Speculative Decoding in LLM Serving
por: Kong, Linghao, et al.
Publicado: (2026)
por: Kong, Linghao, et al.
Publicado: (2026)
SpecPipe: Accelerating Pipeline Parallelism-based LLM Inference with Speculative Decoding
por: Yin, Haofei, et al.
Publicado: (2025)
por: Yin, Haofei, et al.
Publicado: (2025)
EAGLE-Pangu: Accelerator-Safe Tree Speculative Decoding on Ascend NPUs
por: Han, Chang, et al.
Publicado: (2026)
por: Han, Chang, et al.
Publicado: (2026)
TPP-LLM: Modeling Temporal Point Processes by Efficiently Fine-Tuning Large Language Models
por: Liu, Zefang, et al.
Publicado: (2024)
por: Liu, Zefang, et al.
Publicado: (2024)
CARD: A Cache-Assisted Parallel Speculative Decoding Framework via Query-and-Correct Paradigm for Accelerating LLM Inference
por: Zhou, Enyu, et al.
Publicado: (2025)
por: Zhou, Enyu, et al.
Publicado: (2025)
Greedy Multi-Path Block Verification for Faster Decoding in Speculative Sampling
por: Thomas, Rahul, et al.
Publicado: (2026)
por: Thomas, Rahul, et al.
Publicado: (2026)
MoESD: Unveil Speculative Decoding's Potential for Accelerating Sparse MoE
por: Huang, Zongle, et al.
Publicado: (2025)
por: Huang, Zongle, et al.
Publicado: (2025)
Accelerating Large-Scale Reasoning Model Inference with Sparse Self-Speculative Decoding
por: Zhao, Yilong, et al.
Publicado: (2025)
por: Zhao, Yilong, et al.
Publicado: (2025)
TriForce: Lossless Acceleration of Long Sequence Generation with Hierarchical Speculative Decoding
por: Sun, Hanshi, et al.
Publicado: (2024)
por: Sun, Hanshi, et al.
Publicado: (2024)
SlimSpec: Low-Rank Draft LM-Head for Accelerated Speculative Decoding
por: Plaksin, Anton, et al.
Publicado: (2026)
por: Plaksin, Anton, et al.
Publicado: (2026)
Compiler-Assisted Speculative Sampling for Accelerated LLM Inference on Heterogeneous Edge Devices
por: Mesa, Alejandro Ruiz y, et al.
Publicado: (2026)
por: Mesa, Alejandro Ruiz y, et al.
Publicado: (2026)
Spiffy: Multiplying Diffusion LLM Acceleration via Lossless Speculative Decoding
por: Agrawal, Sudhanshu, et al.
Publicado: (2025)
por: Agrawal, Sudhanshu, et al.
Publicado: (2025)
Ejemplares similares
-
Advances in Temporal Point Processes: Bayesian, Neural, and LLM Approaches
por: Zhou, Feng, et al.
Publicado: (2025) -
Byte-token Enhanced Language Models for Temporal Point Processes Analysis
por: Kong, Quyu, et al.
Publicado: (2025) -
DanmakuTPPBench: A Multi-modal Benchmark for Temporal Point Process Modeling and Understanding
por: Jiang, Yue, et al.
Publicado: (2025) -
Long-range Modeling and Processing of Multimodal Event Sequences
por: Li, Jichu, et al.
Publicado: (2026) -
TransFeat-TPP: An Interpretable Deep Covariate Temporal Point Processes
por: Meng, Zizhuo, et al.
Publicado: (2024)