Enregistré dans:
| Auteurs principaux: | Bao, Wenrui, Chen, Zhiben, Xu, Dan, Shang, Yuzhang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2509.25188 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
dParallel: Learnable Parallel Decoding for dLLMs
par: Chen, Zigeng, et autres
Publié: (2025)
par: Chen, Zigeng, et autres
Publié: (2025)
Divide and Conquer: Accelerating Diffusion-Based Large Language Models via Adaptive Parallel Decoding
par: Luo, Xiangzhong, et autres
Publié: (2026)
par: Luo, Xiangzhong, et autres
Publié: (2026)
CreditDecoding: Accelerating Parallel Decoding in Diffusion Large Language Models with Trace Credit
par: Wang, Kangyu, et autres
Publié: (2025)
par: Wang, Kangyu, et autres
Publié: (2025)
Parallel Decoding via Hidden Transfer for Lossless Large Language Model Acceleration
par: Wu, Pengfei, et autres
Publié: (2024)
par: Wu, Pengfei, et autres
Publié: (2024)
Lossless Acceleration of Large Language Model via Adaptive N-gram Parallel Decoding
par: Ou, Jie, et autres
Publié: (2024)
par: Ou, Jie, et autres
Publié: (2024)
Revealing the Parallel Multilingual Learning within Large Language Models
par: Mu, Yongyu, et autres
Publié: (2024)
par: Mu, Yongyu, et autres
Publié: (2024)
Accelerating Diffusion LLMs via Adaptive Parallel Decoding
par: Israel, Daniel, et autres
Publié: (2025)
par: Israel, Daniel, et autres
Publié: (2025)
AdaDecode: Accelerating LLM Decoding with Adaptive Layer Parallelism
par: Wei, Zhepei, et autres
Publié: (2025)
par: Wei, Zhepei, et autres
Publié: (2025)
Dependency-Guided Parallel Decoding in Discrete Diffusion Language Models
par: Ringel, Liran, et autres
Publié: (2026)
par: Ringel, Liran, et autres
Publié: (2026)
Locally Coherent Parallel Decoding in Diffusion Language Models
par: Hersche, Michael, et autres
Publié: (2026)
par: Hersche, Michael, et autres
Publié: (2026)
ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding
par: Li, Jia-Nan, et autres
Publié: (2025)
par: Li, Jia-Nan, et autres
Publié: (2025)
Good Agentic Friends Do Not Just Give Verbal Advice: They Can Update Your Weights
par: Bao, Wenrui, et autres
Publié: (2026)
par: Bao, Wenrui, et autres
Publié: (2026)
Accelerating Transformer Inference for Translation via Parallel Decoding
par: Santilli, Andrea, et autres
Publié: (2023)
par: Santilli, Andrea, et autres
Publié: (2023)
Why Diffusion Language Models Struggle with Truly Parallel (Non-Autoregressive) Decoding?
par: Li, Pengxiang, et autres
Publié: (2026)
par: Li, Pengxiang, et autres
Publié: (2026)
A Survey on Parallel Text Generation: From Parallel Decoding to Diffusion Language Models
par: Zhang, Lingzhe, et autres
Publié: (2025)
par: Zhang, Lingzhe, et autres
Publié: (2025)
Accelerate Parallelizable Reasoning via Parallel Decoding within One Sequence
par: Yu, Yijiong
Publié: (2025)
par: Yu, Yijiong
Publié: (2025)
ButterflyQuant: Ultra-low-bit LLM Quantization through Learnable Orthogonal Butterfly Transforms
par: Xu, Bingxin, et autres
Publié: (2025)
par: Xu, Bingxin, et autres
Publié: (2025)
PSD: Pushing the Pareto Frontier of Diffusion LLMs via Parallel Speculative Decoding
par: Sun, Shengyin, et autres
Publié: (2026)
par: Sun, Shengyin, et autres
Publié: (2026)
Generation Meets Verification: Accelerating Large Language Model Inference with Smart Parallel Auto-Correct Decoding
par: Yi, Hanling, et autres
Publié: (2024)
par: Yi, Hanling, et autres
Publié: (2024)
Parallel-R1: Towards Parallel Thinking via Reinforcement Learning
par: Zheng, Tong, et autres
Publié: (2025)
par: Zheng, Tong, et autres
Publié: (2025)
Plan, Verify and Fill: A Structured Parallel Decoding Approach for Diffusion Language Models
par: Li, Miao, et autres
Publié: (2026)
par: Li, Miao, et autres
Publié: (2026)
Learning to Keep a Promise: Scaling Language Model Decoding Parallelism with Learned Asynchronous Decoding
par: Jin, Tian, et autres
Publié: (2025)
par: Jin, Tian, et autres
Publié: (2025)
Fast-dLLM: Training-free Acceleration of Diffusion LLM by Enabling KV Cache and Parallel Decoding
par: Wu, Chengyue, et autres
Publié: (2025)
par: Wu, Chengyue, et autres
Publié: (2025)
ParallelSpec: Parallel Drafter for Efficient Speculative Decoding
par: Xiao, Zilin, et autres
Publié: (2024)
par: Xiao, Zilin, et autres
Publié: (2024)
Parallel Decoder Transformer: Planner-Seeded Latent Coordination for Synchronized Parallel Decoding
par: Robbins, Logan
Publié: (2025)
par: Robbins, Logan
Publié: (2025)
Hardware-Aware Parallel Prompt Decoding for Memory-Efficient Acceleration of LLM Inference
par: Chen, Hao Mark, et autres
Publié: (2024)
par: Chen, Hao Mark, et autres
Publié: (2024)
Robin3D: Improving 3D Large Language Model via Robust Instruction Tuning
par: Kang, Weitai, et autres
Publié: (2024)
par: Kang, Weitai, et autres
Publié: (2024)
LoPT: Lossless Parallel Tokenization Acceleration for Long Context Inference of Large Language Model
par: Shao, Wei, et autres
Publié: (2025)
par: Shao, Wei, et autres
Publié: (2025)
Trans-Zero: Self-Play Incentivizes Large Language Models for Multilingual Translation Without Parallel Data
par: Zou, Wei, et autres
Publié: (2025)
par: Zou, Wei, et autres
Publié: (2025)
ASPD: Unlocking Adaptive Serial-Parallel Decoding by Exploring Intrinsic Parallelism in LLMs
par: Chen, Keyu, et autres
Publié: (2025)
par: Chen, Keyu, et autres
Publié: (2025)
Ensemble Learning for Heterogeneous Large Language Models with Deep Parallel Collaboration
par: Huang, Yichong, et autres
Publié: (2024)
par: Huang, Yichong, et autres
Publié: (2024)
PaDeLLM-NER: Parallel Decoding in Large Language Models for Named Entity Recognition
par: Lu, Jinghui, et autres
Publié: (2024)
par: Lu, Jinghui, et autres
Publié: (2024)
Edit-Based Refinement for Parallel Masked Diffusion Language Models
par: Ren, Houxing, et autres
Publié: (2026)
par: Ren, Houxing, et autres
Publié: (2026)
LoPA: Scaling dLLM Inference via Lookahead Parallel Decoding
par: Xu, Chenkai, et autres
Publié: (2025)
par: Xu, Chenkai, et autres
Publié: (2025)
Parallel-Probe: Towards Efficient Parallel Thinking via 2D Probing
par: Zheng, Tong, et autres
Publié: (2026)
par: Zheng, Tong, et autres
Publié: (2026)
Fast-Decoding Diffusion Language Models via Progress-Aware Confidence Schedules
par: Mohamed, Amr, et autres
Publié: (2025)
par: Mohamed, Amr, et autres
Publié: (2025)
Draft & Verify: Lossless Large Language Model Acceleration via Self-Speculative Decoding
par: Zhang, Jun, et autres
Publié: (2023)
par: Zhang, Jun, et autres
Publié: (2023)
Learning Adaptive Parallel Reasoning with Language Models
par: Pan, Jiayi, et autres
Publié: (2025)
par: Pan, Jiayi, et autres
Publié: (2025)
Native Parallel Reasoner: Reasoning in Parallelism via Self-Distilled Reinforcement Learning
par: Wu, Tong, et autres
Publié: (2025)
par: Wu, Tong, et autres
Publié: (2025)
Automatically Planning Optimal Parallel Strategy for Large Language Models
par: Li, Zongbiao, et autres
Publié: (2024)
par: Li, Zongbiao, et autres
Publié: (2024)
Documents similaires
-
dParallel: Learnable Parallel Decoding for dLLMs
par: Chen, Zigeng, et autres
Publié: (2025) -
Divide and Conquer: Accelerating Diffusion-Based Large Language Models via Adaptive Parallel Decoding
par: Luo, Xiangzhong, et autres
Publié: (2026) -
CreditDecoding: Accelerating Parallel Decoding in Diffusion Large Language Models with Trace Credit
par: Wang, Kangyu, et autres
Publié: (2025) -
Parallel Decoding via Hidden Transfer for Lossless Large Language Model Acceleration
par: Wu, Pengfei, et autres
Publié: (2024) -
Lossless Acceleration of Large Language Model via Adaptive N-gram Parallel Decoding
par: Ou, Jie, et autres
Publié: (2024)