ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Jia-Nan, Guan, Jian, Wu, Wei, Li, Chongxuan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ReFusion: Improving Natural Language Understanding with Computation-Efficient Retrieval Representation Fusion
par: Wu, Shangyu, et autres
Publié: (2024)
par: Wu, Shangyu, et autres
Publié: (2024)
Locally Coherent Parallel Decoding in Diffusion Language Models
par: Hersche, Michael, et autres
Publié: (2026)
par: Hersche, Michael, et autres
Publié: (2026)
Plan, Verify and Fill: A Structured Parallel Decoding Approach for Diffusion Language Models
par: Li, Miao, et autres
Publié: (2026)
par: Li, Miao, et autres
Publié: (2026)
Theoretical Benefit and Limitation of Diffusion Language Model
par: Feng, Guhao, et autres
Publié: (2025)
par: Feng, Guhao, et autres
Publié: (2025)
PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models
par: Zhao, Xueliang, et autres
Publié: (2025)
par: Zhao, Xueliang, et autres
Publié: (2025)
Generation Meets Verification: Accelerating Large Language Model Inference with Smart Parallel Auto-Correct Decoding
par: Yi, Hanling, et autres
Publié: (2024)
par: Yi, Hanling, et autres
Publié: (2024)
Masked Diffusion Models as Energy Minimization
par: Chen, Sitong, et autres
Publié: (2025)
par: Chen, Sitong, et autres
Publié: (2025)
Continuous Autoregressive Language Models
par: Shao, Chenze, et autres
Publié: (2025)
par: Shao, Chenze, et autres
Publié: (2025)
When Linear Attention Meets Autoregressive Decoding: Towards More Effective and Efficient Linearized Large Language Models
par: You, Haoran, et autres
Publié: (2024)
par: You, Haoran, et autres
Publié: (2024)
Training Large Language Models To Reason In Parallel With Global Forking Tokens
par: Jia, Sheng, et autres
Publié: (2025)
par: Jia, Sheng, et autres
Publié: (2025)
DiTAR: Diffusion Transformer Autoregressive Modeling for Speech Generation
par: Jia, Dongya, et autres
Publié: (2025)
par: Jia, Dongya, et autres
Publié: (2025)
Efficient-DLM: From Autoregressive to Diffusion Language Models, and Beyond in Speed
par: Fu, Yonggan, et autres
Publié: (2025)
par: Fu, Yonggan, et autres
Publié: (2025)
Scaling up Masked Diffusion Models on Text
par: Nie, Shen, et autres
Publié: (2024)
par: Nie, Shen, et autres
Publié: (2024)
On the Compressibility of Quantized Large Language Models
par: Mao, Yu, et autres
Publié: (2024)
par: Mao, Yu, et autres
Publié: (2024)
Why Diffusion Language Models Struggle with Truly Parallel (Non-Autoregressive) Decoding?
par: Li, Pengxiang, et autres
Publié: (2026)
par: Li, Pengxiang, et autres
Publié: (2026)
Variational Reasoning for Language Models
par: Zhou, Xiangxin, et autres
Publié: (2025)
par: Zhou, Xiangxin, et autres
Publié: (2025)
Knowledge Fusion of Large Language Models Via Modular SkillPacks
par: Du, Guodong, et autres
Publié: (2025)
par: Du, Guodong, et autres
Publié: (2025)
Parallelism and Generation Order in Masked Diffusion Language Models: Limits Today, Potential Tomorrow
par: Zhong, Yangyang, et autres
Publié: (2026)
par: Zhong, Yangyang, et autres
Publié: (2026)
Accelerating Diffusion LLMs via Adaptive Parallel Decoding
par: Israel, Daniel, et autres
Publié: (2025)
par: Israel, Daniel, et autres
Publié: (2025)
Principled RL for Diffusion LLMs Emerges from a Sequence-Level Perspective
par: Ou, Jingyang, et autres
Publié: (2025)
par: Ou, Jingyang, et autres
Publié: (2025)
RePo: Language Models with Context Re-Positioning
par: Li, Huayang, et autres
Publié: (2025)
par: Li, Huayang, et autres
Publié: (2025)
On Speculative Decoding for Multimodal Large Language Models
par: Gagrani, Mukul, et autres
Publié: (2024)
par: Gagrani, Mukul, et autres
Publié: (2024)
Beyond Next-Token Prediction: A Performance Characterization of Diffusion versus Autoregressive Language Models
par: Kim, Minseo, et autres
Publié: (2025)
par: Kim, Minseo, et autres
Publié: (2025)
Planner and Executor: Collaboration between Discrete Diffusion And Autoregressive Models in Reasoning
par: Berrayana, Lina, et autres
Publié: (2025)
par: Berrayana, Lina, et autres
Publié: (2025)
Mechanism Shift During Post-training from Autoregressive to Masked Diffusion Language Models
par: Kong, Injin, et autres
Publié: (2026)
par: Kong, Injin, et autres
Publié: (2026)
Confidence-Modulated Speculative Decoding for Large Language Models
par: Sen, Jaydip, et autres
Publié: (2025)
par: Sen, Jaydip, et autres
Publié: (2025)
ALPINE: Unveiling the Planning Capability of Autoregressive Learning in Language Models
par: Wang, Siwei, et autres
Publié: (2024)
par: Wang, Siwei, et autres
Publié: (2024)
Fast Large Language Model Collaborative Decoding via Speculation
par: Fu, Jiale, et autres
Publié: (2025)
par: Fu, Jiale, et autres
Publié: (2025)
The Structure of Relation Decoding Linear Operators in Large Language Models
par: Christ, Miranda Anna, et autres
Publié: (2025)
par: Christ, Miranda Anna, et autres
Publié: (2025)
Probabilistic Token Alignment for Large Language Model Fusion
par: Zeng, Runjia, et autres
Publié: (2025)
par: Zeng, Runjia, et autres
Publié: (2025)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
par: Ye, Jiacheng, et autres
Publié: (2024)
par: Ye, Jiacheng, et autres
Publié: (2024)
Context Dependence and Reliability in Autoregressive Language Models
par: Sengupta, Poushali, et autres
Publié: (2026)
par: Sengupta, Poushali, et autres
Publié: (2026)
Exploring and Improving Drafts in Blockwise Parallel Decoding
par: Kim, Taehyeon, et autres
Publié: (2024)
par: Kim, Taehyeon, et autres
Publié: (2024)
Crafting Efficient Fine-Tuning Strategies for Large Language Models
par: Oliver, Michael, et autres
Publié: (2024)
par: Oliver, Michael, et autres
Publié: (2024)
LLaDA2.0: Scaling Up Diffusion Language Models to 100B
par: Bie, Tiwei, et autres
Publié: (2025)
par: Bie, Tiwei, et autres
Publié: (2025)
Large Language Models to Diffusion Finetuning
par: Cetin, Edoardo, et autres
Publié: (2025)
par: Cetin, Edoardo, et autres
Publié: (2025)
Controlled Decoding from Language Models
par: Mudgal, Sidharth, et autres
Publié: (2023)
par: Mudgal, Sidharth, et autres
Publié: (2023)
Echo: A Large Language Model with Temporal Episodic Memory
par: Liu, WenTao, et autres
Publié: (2025)
par: Liu, WenTao, et autres
Publié: (2025)
A Survey on Diffusion Language Models
par: Li, Tianyi, et autres
Publié: (2025)
par: Li, Tianyi, et autres
Publié: (2025)
Think Big, Generate Quick: LLM-to-SLM for Fast Autoregressive Decoding
par: Bergner, Benjamin, et autres
Publié: (2024)
par: Bergner, Benjamin, et autres
Publié: (2024)
Documents similaires
-
ReFusion: Improving Natural Language Understanding with Computation-Efficient Retrieval Representation Fusion
par: Wu, Shangyu, et autres
Publié: (2024) -
Locally Coherent Parallel Decoding in Diffusion Language Models
par: Hersche, Michael, et autres
Publié: (2026) -
Plan, Verify and Fill: A Structured Parallel Decoding Approach for Diffusion Language Models
par: Li, Miao, et autres
Publié: (2026) -
Theoretical Benefit and Limitation of Diffusion Language Model
par: Feng, Guhao, et autres
Publié: (2025) -
PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models
par: Zhao, Xueliang, et autres
Publié: (2025)