Locally Coherent Parallel Decoding in Diffusion Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Hersche, Michael, Menet, Nicolas, Tanios, Ronan, Rahimi, Abbas |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Soft-Masked Diffusion Language Models
di: Hersche, Michael, et al.
Pubblicazione: (2025)
di: Hersche, Michael, et al.
Pubblicazione: (2025)
A Theoretical Analysis of Test-Driven Code Generation
di: Menet, Nicolas, et al.
Pubblicazione: (2026)
di: Menet, Nicolas, et al.
Pubblicazione: (2026)
Structured Sparse Transition Matrices to Enable State Tracking in State-Space Models
di: Terzić, Aleksandar, et al.
Pubblicazione: (2025)
di: Terzić, Aleksandar, et al.
Pubblicazione: (2025)
Thompson Sampling via Fine-Tuning of LLMs
di: Menet, Nicolas, et al.
Pubblicazione: (2025)
di: Menet, Nicolas, et al.
Pubblicazione: (2025)
Limits of Transformer Language Models on Learning to Compose Algorithms
di: Thomm, Jonathan, et al.
Pubblicazione: (2024)
di: Thomm, Jonathan, et al.
Pubblicazione: (2024)
On the Expressiveness and Length Generalization of Selective State-Space Models on Regular Languages
di: Terzić, Aleksandar, et al.
Pubblicazione: (2024)
di: Terzić, Aleksandar, et al.
Pubblicazione: (2024)
Flash PD-SSM: Memory-Optimized Structured Sparse State-Space Models
di: Terzić, Aleksandar, et al.
Pubblicazione: (2026)
di: Terzić, Aleksandar, et al.
Pubblicazione: (2026)
POETS: Uncertainty-Aware LLM Optimization via Compute-Efficient Policy Ensembles
di: Menet, Nicolas, et al.
Pubblicazione: (2026)
di: Menet, Nicolas, et al.
Pubblicazione: (2026)
ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
Plan, Verify and Fill: A Structured Parallel Decoding Approach for Diffusion Language Models
di: Li, Miao, et al.
Pubblicazione: (2026)
di: Li, Miao, et al.
Pubblicazione: (2026)
I-RAVEN-X: Benchmarking Generalization and Robustness of Analogical and Mathematical Reasoning in Large Language and Reasoning Models
di: Camposampiero, Giacomo, et al.
Pubblicazione: (2025)
di: Camposampiero, Giacomo, et al.
Pubblicazione: (2025)
Towards Learning to Reason: Comparing LLMs with Neuro-Symbolic on Arithmetic Relations in Abstract Reasoning
di: Hersche, Michael, et al.
Pubblicazione: (2024)
di: Hersche, Michael, et al.
Pubblicazione: (2024)
On the Role of Noise in Factorizers for Disentangling Distributed Representations
di: Karunaratne, Geethan, et al.
Pubblicazione: (2024)
di: Karunaratne, Geethan, et al.
Pubblicazione: (2024)
Scalable Evaluation and Neural Models for Compositional Generalization
di: Camposampiero, Giacomo, et al.
Pubblicazione: (2025)
di: Camposampiero, Giacomo, et al.
Pubblicazione: (2025)
Can Large Reasoning Models do Analogical Reasoning under Perceptual Uncertainty?
di: Camposampiero, Giacomo, et al.
Pubblicazione: (2025)
di: Camposampiero, Giacomo, et al.
Pubblicazione: (2025)
Accelerating Diffusion LLMs via Adaptive Parallel Decoding
di: Israel, Daniel, et al.
Pubblicazione: (2025)
di: Israel, Daniel, et al.
Pubblicazione: (2025)
Exploring and Improving Drafts in Blockwise Parallel Decoding
di: Kim, Taehyeon, et al.
Pubblicazione: (2024)
di: Kim, Taehyeon, et al.
Pubblicazione: (2024)
Towards Learning Abductive Reasoning using VSA Distributed Representations
di: Camposampiero, Giacomo, et al.
Pubblicazione: (2024)
di: Camposampiero, Giacomo, et al.
Pubblicazione: (2024)
Terminating Differentiable Tree Experts
di: Thomm, Jonathan, et al.
Pubblicazione: (2024)
di: Thomm, Jonathan, et al.
Pubblicazione: (2024)
Generation Meets Verification: Accelerating Large Language Model Inference with Smart Parallel Auto-Correct Decoding
di: Yi, Hanling, et al.
Pubblicazione: (2024)
di: Yi, Hanling, et al.
Pubblicazione: (2024)
A foundation model with multi-variate parallel attention to generate neuronal activity
di: Carzaniga, Francesco, et al.
Pubblicazione: (2025)
di: Carzaniga, Francesco, et al.
Pubblicazione: (2025)
Parallelism and Generation Order in Masked Diffusion Language Models: Limits Today, Potential Tomorrow
di: Zhong, Yangyang, et al.
Pubblicazione: (2026)
di: Zhong, Yangyang, et al.
Pubblicazione: (2026)
Controlled Decoding from Language Models
di: Mudgal, Sidharth, et al.
Pubblicazione: (2023)
di: Mudgal, Sidharth, et al.
Pubblicazione: (2023)
Accelerating Transformer Inference for Translation via Parallel Decoding
di: Santilli, Andrea, et al.
Pubblicazione: (2023)
di: Santilli, Andrea, et al.
Pubblicazione: (2023)
Probabilistic Abduction for Visual Abstract Reasoning via Learning Rules in Vector-symbolic Architectures
di: Hersche, Michael, et al.
Pubblicazione: (2024)
di: Hersche, Michael, et al.
Pubblicazione: (2024)
Decoding-time Realignment of Language Models
di: Liu, Tianlin, et al.
Pubblicazione: (2024)
di: Liu, Tianlin, et al.
Pubblicazione: (2024)
Optimizing Decoding Paths in Masked Diffusion Models by Quantifying Uncertainty
di: Chen, Ziyu, et al.
Pubblicazione: (2025)
di: Chen, Ziyu, et al.
Pubblicazione: (2025)
Top-H Decoding: Adapting the Creativity and Coherence with Bounded Entropy in Text Generation
di: Potraghloo, Erfan Baghaei, et al.
Pubblicazione: (2025)
di: Potraghloo, Erfan Baghaei, et al.
Pubblicazione: (2025)
On Speculative Decoding for Multimodal Large Language Models
di: Gagrani, Mukul, et al.
Pubblicazione: (2024)
di: Gagrani, Mukul, et al.
Pubblicazione: (2024)
Confidence-Modulated Speculative Decoding for Large Language Models
di: Sen, Jaydip, et al.
Pubblicazione: (2025)
di: Sen, Jaydip, et al.
Pubblicazione: (2025)
The Bicameral Model: Bidirectional Hidden-State Coupling Between Parallel Language Models
di: Flamant, Cedric, et al.
Pubblicazione: (2026)
di: Flamant, Cedric, et al.
Pubblicazione: (2026)
Training Optimal Large Diffusion Language Models
di: Ni, Jinjie, et al.
Pubblicazione: (2025)
di: Ni, Jinjie, et al.
Pubblicazione: (2025)
Fast Large Language Model Collaborative Decoding via Speculation
di: Fu, Jiale, et al.
Pubblicazione: (2025)
di: Fu, Jiale, et al.
Pubblicazione: (2025)
The Structure of Relation Decoding Linear Operators in Large Language Models
di: Christ, Miranda Anna, et al.
Pubblicazione: (2025)
di: Christ, Miranda Anna, et al.
Pubblicazione: (2025)
Can Small-Scale Data Poisoning Exacerbate Dialect-Linked Biases in Large Language Models?
di: Abbas, Chaymaa, et al.
Pubblicazione: (2025)
di: Abbas, Chaymaa, et al.
Pubblicazione: (2025)
Training Large Language Models To Reason In Parallel With Global Forking Tokens
di: Jia, Sheng, et al.
Pubblicazione: (2025)
di: Jia, Sheng, et al.
Pubblicazione: (2025)
ThreadWeaver: Adaptive Threading for Efficient Parallel Reasoning in Language Models
di: Lian, Long, et al.
Pubblicazione: (2025)
di: Lian, Long, et al.
Pubblicazione: (2025)
TrustLDM: Benchmarking Trustworthiness in Language Diffusion Models
di: Mo, Yichuan, et al.
Pubblicazione: (2026)
di: Mo, Yichuan, et al.
Pubblicazione: (2026)
Fine-Tuning Discrete Diffusion Models with Policy Gradient Methods
di: Zekri, Oussama, et al.
Pubblicazione: (2025)
di: Zekri, Oussama, et al.
Pubblicazione: (2025)
Contrastive Decoding for Synthetic Data Generation in Low-Resource Language Modeling
di: Ulm, Jannek, et al.
Pubblicazione: (2025)
di: Ulm, Jannek, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Soft-Masked Diffusion Language Models
di: Hersche, Michael, et al.
Pubblicazione: (2025) -
A Theoretical Analysis of Test-Driven Code Generation
di: Menet, Nicolas, et al.
Pubblicazione: (2026) -
Structured Sparse Transition Matrices to Enable State Tracking in State-Space Models
di: Terzić, Aleksandar, et al.
Pubblicazione: (2025) -
Thompson Sampling via Fine-Tuning of LLMs
di: Menet, Nicolas, et al.
Pubblicazione: (2025) -
Limits of Transformer Language Models on Learning to Compose Algorithms
di: Thomm, Jonathan, et al.
Pubblicazione: (2024)