Parallel Decoder Transformer: Planner-Seeded Latent Coordination for Synchronized Parallel Decoding
Fuente:
arXiv
Guardado en:
| Autor principal: | Robbins, Logan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Accelerating Transformer Inference for Translation via Parallel Decoding
por: Santilli, Andrea, et al.
Publicado: (2023)
por: Santilli, Andrea, et al.
Publicado: (2023)
Decoding at the Speed of Thought: Harnessing Parallel Decoding of Lexical Units for LLMs
por: Sun, Chenxi, et al.
Publicado: (2024)
por: Sun, Chenxi, et al.
Publicado: (2024)
ASPD: Unlocking Adaptive Serial-Parallel Decoding by Exploring Intrinsic Parallelism in LLMs
por: Chen, Keyu, et al.
Publicado: (2025)
por: Chen, Keyu, et al.
Publicado: (2025)
CreditDecoding: Accelerating Parallel Decoding in Diffusion Large Language Models with Trace Credit
por: Wang, Kangyu, et al.
Publicado: (2025)
por: Wang, Kangyu, et al.
Publicado: (2025)
Parallel Context-of-Experts Decoding for Retrieval Augmented Generation
por: Corallo, Giulio, et al.
Publicado: (2026)
por: Corallo, Giulio, et al.
Publicado: (2026)
Copy-as-Decode: Grammar-Constrained Parallel Prefill for LLM Editing
por: Liu, Ziyang
Publicado: (2026)
por: Liu, Ziyang
Publicado: (2026)
Exploring and Improving Drafts in Blockwise Parallel Decoding
por: Kim, Taehyeon, et al.
Publicado: (2024)
por: Kim, Taehyeon, et al.
Publicado: (2024)
Cerberus: Efficient Inference with Adaptive Parallel Decoding and Sequential Knowledge Enhancement
por: Liu, Yuxuan, et al.
Publicado: (2024)
por: Liu, Yuxuan, et al.
Publicado: (2024)
Locally Coherent Parallel Decoding in Diffusion Language Models
por: Hersche, Michael, et al.
Publicado: (2026)
por: Hersche, Michael, et al.
Publicado: (2026)
Why Diffusion Language Models Struggle with Truly Parallel (Non-Autoregressive) Decoding?
por: Li, Pengxiang, et al.
Publicado: (2026)
por: Li, Pengxiang, et al.
Publicado: (2026)
Accelerating Diffusion LLMs via Adaptive Parallel Decoding
por: Israel, Daniel, et al.
Publicado: (2025)
por: Israel, Daniel, et al.
Publicado: (2025)
PARD-2: Target-Aligned Parallel Draft Model for Dual-Mode Speculative Decoding
por: An, Zihao, et al.
Publicado: (2026)
por: An, Zihao, et al.
Publicado: (2026)
Pipeline Parallelism is All You Need for Optimized Early-Exit Based Self-Speculative Decoding
por: Li, Ruanjun, et al.
Publicado: (2025)
por: Li, Ruanjun, et al.
Publicado: (2025)
PaDeLLM-NER: Parallel Decoding in Large Language Models for Named Entity Recognition
por: Lu, Jinghui, et al.
Publicado: (2024)
por: Lu, Jinghui, et al.
Publicado: (2024)
Breaking the Autoregressive Chain: Hyper-Parallel Decoding for Efficient LLM-Based Attribute Value Extraction
por: Glavas, Theodore, et al.
Publicado: (2026)
por: Glavas, Theodore, et al.
Publicado: (2026)
ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding
por: Li, Jia-Nan, et al.
Publicado: (2025)
por: Li, Jia-Nan, et al.
Publicado: (2025)
Latent Chain-of-Thought? Decoding the Depth-Recurrent Transformer
por: Lu, Wenquan, et al.
Publicado: (2025)
por: Lu, Wenquan, et al.
Publicado: (2025)
MineDraft: A Framework for Batch Parallel Speculative Decoding
por: Tang, Zhenwei, et al.
Publicado: (2026)
por: Tang, Zhenwei, et al.
Publicado: (2026)
Plan, Verify and Fill: A Structured Parallel Decoding Approach for Diffusion Language Models
por: Li, Miao, et al.
Publicado: (2026)
por: Li, Miao, et al.
Publicado: (2026)
A Survey on Parallel Text Generation: From Parallel Decoding to Diffusion Language Models
por: Zhang, Lingzhe, et al.
Publicado: (2025)
por: Zhang, Lingzhe, et al.
Publicado: (2025)
Falcon: Faster and Parallel Inference of Large Language Models through Enhanced Semi-Autoregressive Drafting and Custom-Designed Decoding Tree
por: Gao, Xiangxiang, et al.
Publicado: (2024)
por: Gao, Xiangxiang, et al.
Publicado: (2024)
Generation Meets Verification: Accelerating Large Language Model Inference with Smart Parallel Auto-Correct Decoding
por: Yi, Hanling, et al.
Publicado: (2024)
por: Yi, Hanling, et al.
Publicado: (2024)
Parallel Test-Time Scaling for Latent Reasoning Models
por: You, Runyang, et al.
Publicado: (2025)
por: You, Runyang, et al.
Publicado: (2025)
Generative Sentiment Analysis via Latent Category Distribution and Constrained Decoding
por: Zhou, Jun, et al.
Publicado: (2024)
por: Zhou, Jun, et al.
Publicado: (2024)
Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction
por: Lee, Jihwan, et al.
Publicado: (2025)
por: Lee, Jihwan, et al.
Publicado: (2025)
ParallelMuse: Agentic Parallel Thinking for Deep Information Seeking
por: Li, Baixuan, et al.
Publicado: (2025)
por: Li, Baixuan, et al.
Publicado: (2025)
FBS: Modeling Native Parallel Reading inside a Transformer
por: Wang, Tongxi
Publicado: (2026)
por: Wang, Tongxi
Publicado: (2026)
Dynamic Depth Decoding: Faster Speculative Decoding for LLMs
por: Brown, Oscar, et al.
Publicado: (2024)
por: Brown, Oscar, et al.
Publicado: (2024)
StableMask: Refining Causal Masking in Decoder-only Transformer
por: Yin, Qingyu, et al.
Publicado: (2024)
por: Yin, Qingyu, et al.
Publicado: (2024)
Hybrid Verified Decoding: Learning to Allocate Verification in Speculative Decoding
por: Su, Xin, et al.
Publicado: (2026)
por: Su, Xin, et al.
Publicado: (2026)
Thoughtbubbles: an Unsupervised Method for Parallel Thinking in Latent Space
por: Liu, Houjun, et al.
Publicado: (2025)
por: Liu, Houjun, et al.
Publicado: (2025)
Bridging Logic and Learning: Decoding Temporal Logic Embeddings via Transformers
por: Candussio, Sara, et al.
Publicado: (2025)
por: Candussio, Sara, et al.
Publicado: (2025)
Approximately Aligned Decoding
por: Melcer, Daniel, et al.
Publicado: (2024)
por: Melcer, Daniel, et al.
Publicado: (2024)
Parallel Universes, Parallel Languages: A Comprehensive Study on LLM-based Multilingual Counterfactual Example Generation
por: Wang, Qianli, et al.
Publicado: (2026)
por: Wang, Qianli, et al.
Publicado: (2026)
CSV-Decode: Certifiable Sub-Vocabulary Decoding for Efficient Large Language Model Inference
por: Liu, Dong, et al.
Publicado: (2025)
por: Liu, Dong, et al.
Publicado: (2025)
Decoders Laugh as Loud as Encoders
por: Borodach, Eli, et al.
Publicado: (2025)
por: Borodach, Eli, et al.
Publicado: (2025)
The Disparate Impacts of Speculative Decoding
por: Sandler, Jameson, et al.
Publicado: (2025)
por: Sandler, Jameson, et al.
Publicado: (2025)
Direct Multi-Token Decoding
por: Luo, Xuan, et al.
Publicado: (2025)
por: Luo, Xuan, et al.
Publicado: (2025)
Scaling Laws for Speculative Decoding
por: Yan, Siyuan, et al.
Publicado: (2025)
por: Yan, Siyuan, et al.
Publicado: (2025)
Cross-Attention Speculative Decoding
por: Zhong, Wei, et al.
Publicado: (2025)
por: Zhong, Wei, et al.
Publicado: (2025)
Ejemplares similares
-
Accelerating Transformer Inference for Translation via Parallel Decoding
por: Santilli, Andrea, et al.
Publicado: (2023) -
Decoding at the Speed of Thought: Harnessing Parallel Decoding of Lexical Units for LLMs
por: Sun, Chenxi, et al.
Publicado: (2024) -
ASPD: Unlocking Adaptive Serial-Parallel Decoding by Exploring Intrinsic Parallelism in LLMs
por: Chen, Keyu, et al.
Publicado: (2025) -
CreditDecoding: Accelerating Parallel Decoding in Diffusion Large Language Models with Trace Credit
por: Wang, Kangyu, et al.
Publicado: (2025) -
Parallel Context-of-Experts Decoding for Retrieval Augmented Generation
por: Corallo, Giulio, et al.
Publicado: (2026)