Stability-Weighted Decoding for Diffusion Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Yue, Huang, Jian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
DOS: Dependency-Oriented Sampler for Masked Diffusion Language Models
di: Zhou, Xueyu, et al.
Pubblicazione: (2026)
di: Zhou, Xueyu, et al.
Pubblicazione: (2026)
Speculative Diffusion Decoding: Accelerating Language Generation through Diffusion
di: Christopher, Jacob K, et al.
Pubblicazione: (2024)
di: Christopher, Jacob K, et al.
Pubblicazione: (2024)
Locally Coherent Parallel Decoding in Diffusion Language Models
di: Hersche, Michael, et al.
Pubblicazione: (2026)
di: Hersche, Michael, et al.
Pubblicazione: (2026)
TraceDet: Hallucination Detection from the Decoding Trace of Diffusion Large Language Models
di: Chang, Shenxu, et al.
Pubblicazione: (2025)
di: Chang, Shenxu, et al.
Pubblicazione: (2025)
DualDiffusion: A Speculative Decoding Strategy for Masked Diffusion Models
di: Goyal, Satyam, et al.
Pubblicazione: (2026)
di: Goyal, Satyam, et al.
Pubblicazione: (2026)
Sequential Diffusion Language Models
di: Liu, Yangzhou, et al.
Pubblicazione: (2025)
di: Liu, Yangzhou, et al.
Pubblicazione: (2025)
Improving Diffusion Language Model Decoding through Joint Search in Generation Order and Token Space
di: Shen, Yangyi, et al.
Pubblicazione: (2026)
di: Shen, Yangyi, et al.
Pubblicazione: (2026)
DoTA: Weight-Decomposed Tensor Adaptation for Large Language Models
di: Hu, Xiaolin, et al.
Pubblicazione: (2024)
di: Hu, Xiaolin, et al.
Pubblicazione: (2024)
Plan, Verify and Fill: A Structured Parallel Decoding Approach for Diffusion Language Models
di: Li, Miao, et al.
Pubblicazione: (2026)
di: Li, Miao, et al.
Pubblicazione: (2026)
Decoding Uncertainty: The Impact of Decoding Strategies for Uncertainty Estimation in Large Language Models
di: Hashimoto, Wataru, et al.
Pubblicazione: (2025)
di: Hashimoto, Wataru, et al.
Pubblicazione: (2025)
Steering Language Models with Weight Arithmetic
di: Fierro, Constanza, et al.
Pubblicazione: (2025)
di: Fierro, Constanza, et al.
Pubblicazione: (2025)
Theoretical Benefit and Limitation of Diffusion Language Model
di: Feng, Guhao, et al.
Pubblicazione: (2025)
di: Feng, Guhao, et al.
Pubblicazione: (2025)
Learning to Decode Collaboratively with Multiple Language Models
di: Shen, Shannon Zejiang, et al.
Pubblicazione: (2024)
di: Shen, Shannon Zejiang, et al.
Pubblicazione: (2024)
Adapting Decoder-Based Language Models for Diverse Encoder Downstream Tasks
di: Suganthan, Paul, et al.
Pubblicazione: (2025)
di: Suganthan, Paul, et al.
Pubblicazione: (2025)
WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More
di: Yue, Yuxuan, et al.
Pubblicazione: (2024)
di: Yue, Yuxuan, et al.
Pubblicazione: (2024)
Controlled Decoding from Language Models
di: Mudgal, Sidharth, et al.
Pubblicazione: (2023)
di: Mudgal, Sidharth, et al.
Pubblicazione: (2023)
Dynamic Attention-Guided Context Decoding for Mitigating Context Faithfulness Hallucinations in Large Language Models
di: Huang, Yanwen, et al.
Pubblicazione: (2025)
di: Huang, Yanwen, et al.
Pubblicazione: (2025)
AGGC: Adaptive Group Gradient Clipping for Stabilizing Large Language Model Training
di: Li, Zhiyuan, et al.
Pubblicazione: (2026)
di: Li, Zhiyuan, et al.
Pubblicazione: (2026)
Dataless Knowledge Fusion by Merging Weights of Language Models
di: Jin, Xisen, et al.
Pubblicazione: (2022)
di: Jin, Xisen, et al.
Pubblicazione: (2022)
FlashDecoding++: Faster Large Language Model Inference on GPUs
di: Hong, Ke, et al.
Pubblicazione: (2023)
di: Hong, Ke, et al.
Pubblicazione: (2023)
Recurrent Drafter for Fast Speculative Decoding in Large Language Models
di: Cheng, Yunfei, et al.
Pubblicazione: (2024)
di: Cheng, Yunfei, et al.
Pubblicazione: (2024)
Decoding Rarity: Large Language Models in the Diagnosis of Rare Diseases
di: Carbonari, Valentina, et al.
Pubblicazione: (2025)
di: Carbonari, Valentina, et al.
Pubblicazione: (2025)
Rethinking Token Prediction: Tree-Structured Diffusion Language Model
di: Wu, Zihao, et al.
Pubblicazione: (2026)
di: Wu, Zihao, et al.
Pubblicazione: (2026)
Speculative Decoding Across Languages
di: Paudel, Nirajan, et al.
Pubblicazione: (2026)
di: Paudel, Nirajan, et al.
Pubblicazione: (2026)
DPad: Efficient Diffusion Language Models with Suffix Dropout
di: Chen, Xinhua, et al.
Pubblicazione: (2025)
di: Chen, Xinhua, et al.
Pubblicazione: (2025)
Seed Diffusion: A Large-Scale Diffusion Language Model with High-Speed Inference
di: Song, Yuxuan, et al.
Pubblicazione: (2025)
di: Song, Yuxuan, et al.
Pubblicazione: (2025)
Large Language Diffusion Models
di: Nie, Shen, et al.
Pubblicazione: (2025)
di: Nie, Shen, et al.
Pubblicazione: (2025)
Diffusion Guided Language Modeling
di: Lovelace, Justin, et al.
Pubblicazione: (2024)
di: Lovelace, Justin, et al.
Pubblicazione: (2024)
Anchored Diffusion Language Model
di: Rout, Litu, et al.
Pubblicazione: (2025)
di: Rout, Litu, et al.
Pubblicazione: (2025)
Fast and Effective Weight Update for Pruned Large Language Models
di: Boža, Vladimír
Pubblicazione: (2024)
di: Boža, Vladimír
Pubblicazione: (2024)
CharED: Character-wise Ensemble Decoding for Large Language Models
di: Gu, Kevin, et al.
Pubblicazione: (2024)
di: Gu, Kevin, et al.
Pubblicazione: (2024)
MeTHanol: Modularized Thinking Language Models with Intermediate Layer Thinking, Decoding and Bootstrapping Reasoning
di: Xi, Ningyuan, et al.
Pubblicazione: (2024)
di: Xi, Ningyuan, et al.
Pubblicazione: (2024)
Decoding-time Realignment of Language Models
di: Liu, Tianlin, et al.
Pubblicazione: (2024)
di: Liu, Tianlin, et al.
Pubblicazione: (2024)
Stopping Computation for Converged Tokens in Masked Diffusion-LM Decoding
di: Oba, Daisuke, et al.
Pubblicazione: (2026)
di: Oba, Daisuke, et al.
Pubblicazione: (2026)
Diffusion-State Policy Optimization for Masked Diffusion Language Models
di: Oba, Daisuke, et al.
Pubblicazione: (2026)
di: Oba, Daisuke, et al.
Pubblicazione: (2026)
Foundations of Large Language Model Compression -- Part 1: Weight Quantization
di: Young, Sean I.
Pubblicazione: (2024)
di: Young, Sean I.
Pubblicazione: (2024)
PEDAL: Enhancing Greedy Decoding with Large Language Models using Diverse Exemplars
di: Prabhu, Sumanth
Pubblicazione: (2024)
di: Prabhu, Sumanth
Pubblicazione: (2024)
From Decoding to Meta-Generation: Inference-time Algorithms for Large Language Models
di: Welleck, Sean, et al.
Pubblicazione: (2024)
di: Welleck, Sean, et al.
Pubblicazione: (2024)
When to Commit? Towards Variable-Size Self-Contained Blocks for Discrete Diffusion Language Models
di: Wang, Danny, et al.
Pubblicazione: (2026)
di: Wang, Danny, et al.
Pubblicazione: (2026)
Documenti analoghi
-
ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding
di: Li, Jia-Nan, et al.
Pubblicazione: (2025) -
DOS: Dependency-Oriented Sampler for Masked Diffusion Language Models
di: Zhou, Xueyu, et al.
Pubblicazione: (2026) -
Speculative Diffusion Decoding: Accelerating Language Generation through Diffusion
di: Christopher, Jacob K, et al.
Pubblicazione: (2024) -
Locally Coherent Parallel Decoding in Diffusion Language Models
di: Hersche, Michael, et al.
Pubblicazione: (2026) -
TraceDet: Hallucination Detection from the Decoding Trace of Diffusion Large Language Models
di: Chang, Shenxu, et al.
Pubblicazione: (2025)