Beyond Hard Masks: Progressive Token Evolution for Diffusion Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhong, Linhao, Wu, Linyu, Fang, Bozhen, Feng, Tianjian, Jing, Chenchen, Wang, Wen, Zhang, Jiaheng, Chen, Hao, Shen, Chunhua |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Efficient Self-Evaluation for Diffusion Language Models via Sequence Regeneration
par: Zhong, Linhao, et autres
Publié: (2026)
par: Zhong, Linhao, et autres
Publié: (2026)
Time Is a Feature: Exploiting Temporal Dynamics in Diffusion Language Models
par: Wang, Wen, et autres
Publié: (2025)
par: Wang, Wen, et autres
Publié: (2025)
Improving Diffusion Language Model Decoding through Joint Search in Generation Order and Token Space
par: Shen, Yangyi, et autres
Publié: (2026)
par: Shen, Yangyi, et autres
Publié: (2026)
DMark: Order-Agnostic Watermarking for Diffusion Large Language Models
par: Wu, Linyu, et autres
Publié: (2025)
par: Wu, Linyu, et autres
Publié: (2025)
DiffuMask: Diffusion Language Model for Token-level Prompt Pruning
par: Zheng, Caleb, et autres
Publié: (2026)
par: Zheng, Caleb, et autres
Publié: (2026)
Scaling Beyond Masked Diffusion Language Models
par: Sahoo, Subham Sekhar, et autres
Publié: (2026)
par: Sahoo, Subham Sekhar, et autres
Publié: (2026)
Remask, Don't Replace: Token-to-Mask Refinement in Diffusion Large Language Models
par: Yao, Lin
Publié: (2026)
par: Yao, Lin
Publié: (2026)
Targeted Remasking: Replacing Token Editing with Token-to-Mask Refinement in Discrete Diffusion Language Models
par: Yao, Lin
Publié: (2026)
par: Yao, Lin
Publié: (2026)
Masked Diffusion Models as Energy Minimization
par: Chen, Sitong, et autres
Publié: (2025)
par: Chen, Sitong, et autres
Publié: (2025)
SIMPLEMIX: Frustratingly Simple Mixing of Off- and On-policy Data in Language Model Preference Learning
par: Li, Tianjian, et autres
Publié: (2025)
par: Li, Tianjian, et autres
Publié: (2025)
Beyond Masks: Efficient, Flexible Diffusion Language Models via Deletion-Insertion Processes
par: Ding, Fangyu, et autres
Publié: (2026)
par: Ding, Fangyu, et autres
Publié: (2026)
ExLM: Rethinking the Impact of [MASK] Tokens in Masked Language Models
par: Zheng, Kangjie, et autres
Publié: (2025)
par: Zheng, Kangjie, et autres
Publié: (2025)
One Token Is Enough: Improving Diffusion Language Models with a Sink Token
par: Zhang, Zihou, et autres
Publié: (2026)
par: Zhang, Zihou, et autres
Publié: (2026)
T$^\star$: Progressive Block Scaling for Masked Diffusion Language Models Through Trajectory Aware Reinforcement Learning
par: Xia, Hanchen, et autres
Publié: (2026)
par: Xia, Hanchen, et autres
Publié: (2026)
Activation Steering for Masked Diffusion Language Models
par: Shnaidman, Adi, et autres
Publié: (2025)
par: Shnaidman, Adi, et autres
Publié: (2025)
General Phrase Debiaser: Debiasing Masked Language Models at a Multi-Token Level
par: Shi, Bingkang, et autres
Publié: (2023)
par: Shi, Bingkang, et autres
Publié: (2023)
Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning
par: Luo, Linhao, et autres
Publié: (2023)
par: Luo, Linhao, et autres
Publié: (2023)
From Reasoning to Agentic: Credit Assignment in Reinforcement Learning for Large Language Models
par: Zhang, Chenchen
Publié: (2026)
par: Zhang, Chenchen
Publié: (2026)
SPG: Sandwiched Policy Gradient for Masked Diffusion Language Models
par: Wang, Chenyu, et autres
Publié: (2025)
par: Wang, Chenyu, et autres
Publié: (2025)
StableToken: A Noise-Robust Semantic Speech Tokenizer for Resilient SpeechLLMs
par: Song, Yuhan, et autres
Publié: (2025)
par: Song, Yuhan, et autres
Publié: (2025)
Stopping Computation for Converged Tokens in Masked Diffusion-LM Decoding
par: Oba, Daisuke, et autres
Publié: (2026)
par: Oba, Daisuke, et autres
Publié: (2026)
How Important Is Tokenization in French Medical Masked Language Models?
par: Labrak, Yanis, et autres
Publié: (2024)
par: Labrak, Yanis, et autres
Publié: (2024)
Masked Diffusion Language Models with Frequency-Informed Training
par: Kosmopoulou, Despoina, et autres
Publié: (2025)
par: Kosmopoulou, Despoina, et autres
Publié: (2025)
Soft-Masked Diffusion Language Models
par: Hersche, Michael, et autres
Publié: (2025)
par: Hersche, Michael, et autres
Publié: (2025)
Rethinking Token Prediction: Tree-Structured Diffusion Language Model
par: Wu, Zihao, et autres
Publié: (2026)
par: Wu, Zihao, et autres
Publié: (2026)
Parallelism and Generation Order in Masked Diffusion Language Models: Limits Today, Potential Tomorrow
par: Zhong, Yangyang, et autres
Publié: (2026)
par: Zhong, Yangyang, et autres
Publié: (2026)
MEDFuse: Multimodal EHR Data Fusion with Masked Lab-Test Modeling and Large Language Models
par: Phan, Thao Minh Nguyen, et autres
Publié: (2024)
par: Phan, Thao Minh Nguyen, et autres
Publié: (2024)
Diffusion-State Policy Optimization for Masked Diffusion Language Models
par: Oba, Daisuke, et autres
Publié: (2026)
par: Oba, Daisuke, et autres
Publié: (2026)
TokMem: One-Token Procedural Memory for Large Language Models
par: Wu, Zijun, et autres
Publié: (2025)
par: Wu, Zijun, et autres
Publié: (2025)
Continual Learning for Large Language Models: A Survey
par: Wu, Tongtong, et autres
Publié: (2024)
par: Wu, Tongtong, et autres
Publié: (2024)
Beyond Pass-by-Pass Optimization: Intent-Driven IR Optimization with Large Language Models
par: Qiu, Lei, et autres
Publié: (2026)
par: Qiu, Lei, et autres
Publié: (2026)
Diffutron: A Masked Diffusion Language Model for Turkish Language
par: Kocabay, Şuayp Talha, et autres
Publié: (2026)
par: Kocabay, Şuayp Talha, et autres
Publié: (2026)
Embedding Inversion via Conditional Masked Diffusion Language Models
par: Xiao, Han
Publié: (2026)
par: Xiao, Han
Publié: (2026)
Edit-Based Refinement for Parallel Masked Diffusion Language Models
par: Ren, Houxing, et autres
Publié: (2026)
par: Ren, Houxing, et autres
Publié: (2026)
Beyond Next-Token Prediction: A Performance Characterization of Diffusion versus Autoregressive Language Models
par: Kim, Minseo, et autres
Publié: (2025)
par: Kim, Minseo, et autres
Publié: (2025)
Simple and Effective Masked Diffusion Language Models
par: Sahoo, Subham Sekhar, et autres
Publié: (2024)
par: Sahoo, Subham Sekhar, et autres
Publié: (2024)
On the Reasoning Abilities of Masked Diffusion Language Models
par: Svete, Anej, et autres
Publié: (2025)
par: Svete, Anej, et autres
Publié: (2025)
Enabling Language Models to Implicitly Learn Self-Improvement
par: Wang, Ziqi, et autres
Publié: (2023)
par: Wang, Ziqi, et autres
Publié: (2023)
LFED: A Literary Fiction Evaluation Dataset for Large Language Models
par: Yu, Linhao, et autres
Publié: (2024)
par: Yu, Linhao, et autres
Publié: (2024)
DreamOn: Diffusion Language Models For Code Infilling Beyond Fixed-size Canvas
par: Wu, Zirui, et autres
Publié: (2026)
par: Wu, Zirui, et autres
Publié: (2026)
Documents similaires
-
Efficient Self-Evaluation for Diffusion Language Models via Sequence Regeneration
par: Zhong, Linhao, et autres
Publié: (2026) -
Time Is a Feature: Exploiting Temporal Dynamics in Diffusion Language Models
par: Wang, Wen, et autres
Publié: (2025) -
Improving Diffusion Language Model Decoding through Joint Search in Generation Order and Token Space
par: Shen, Yangyi, et autres
Publié: (2026) -
DMark: Order-Agnostic Watermarking for Diffusion Large Language Models
par: Wu, Linyu, et autres
Publié: (2025) -
DiffuMask: Diffusion Language Model for Token-level Prompt Pruning
par: Zheng, Caleb, et autres
Publié: (2026)