DSB: Dynamic Sliding Block Scheduling for Diffusion LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Luo, Lizhuo, Li, Shenggui, Wen, Yonggang, Zhang, Tianwei |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DAWN: Dependency-Aware Fast Inference for Diffusion LLMs
par: Luo, Lizhuo, et autres
Publié: (2026)
par: Luo, Lizhuo, et autres
Publié: (2026)
AsyncDSB: Schedule-Asynchronous Diffusion Schrödinger Bridge for Image Inpainting
par: Han, Zihao, et autres
Publié: (2024)
par: Han, Zihao, et autres
Publié: (2024)
SPPO:Efficient Long-sequence LLM Training via Adaptive Sequence Pipeline Parallel Offloading
par: Chen, Qiaoling, et autres
Publié: (2025)
par: Chen, Qiaoling, et autres
Publié: (2025)
Triplet-Block Diffusion RWKV
par: Lin, Ke, et autres
Publié: (2026)
par: Lin, Ke, et autres
Publié: (2026)
SpecForge: A Flexible and Efficient Open-Source Training Framework for Speculative Decoding
par: Li, Shenggui, et autres
Publié: (2026)
par: Li, Shenggui, et autres
Publié: (2026)
From Next-Token to Next-Block: A Principled Adaptation Path for Diffusion LLMs
par: Tian, Yuchuan, et autres
Publié: (2025)
par: Tian, Yuchuan, et autres
Publié: (2025)
Inference-time Alignment via Sparse Junction Steering
par: Hu, Runyi, et autres
Publié: (2026)
par: Hu, Runyi, et autres
Publié: (2026)
Fast-dLLM v2: Efficient Block-Diffusion LLM
par: Wu, Chengyue, et autres
Publié: (2025)
par: Wu, Chengyue, et autres
Publié: (2025)
Understanding the Dark Side of LLMs' Intrinsic Self-Correction
par: Zhang, Qingjie, et autres
Publié: (2024)
par: Zhang, Qingjie, et autres
Publié: (2024)
Thinking Inside the Mask: In-Place Prompting in Diffusion LLMs
par: Jin, Xiangqi, et autres
Publié: (2025)
par: Jin, Xiangqi, et autres
Publié: (2025)
Speculating LLMs' Chinese Training Data Pollution from Their Tokens
par: Zhang, Qingjie, et autres
Publié: (2025)
par: Zhang, Qingjie, et autres
Publié: (2025)
Sparse-dLLM: Accelerating Diffusion LLMs with Dynamic Cache Eviction
par: Song, Yuerong, et autres
Publié: (2025)
par: Song, Yuerong, et autres
Publié: (2025)
ReSpec: Towards Optimizing Speculative Decoding in Reinforcement Learning Systems
par: Chen, Qiaoling, et autres
Publié: (2025)
par: Chen, Qiaoling, et autres
Publié: (2025)
DFlare: Scaling Up Draft Capacity for Block Diffusion Speculative Decoding
par: Zhang, Jiebin, et autres
Publié: (2026)
par: Zhang, Jiebin, et autres
Publié: (2026)
Swordsman: Entropy-Driven Adaptive Block Partition for Efficient Diffusion Language Models
par: Zhang, Yu, et autres
Publié: (2026)
par: Zhang, Yu, et autres
Publié: (2026)
Efficient Many-Shot In-Context Learning with Dynamic Block-Sparse Attention
par: Xiao, Emily, et autres
Publié: (2025)
par: Xiao, Emily, et autres
Publié: (2025)
SpecBlock: Block-Iterative Speculative Decoding with Dynamic Tree Drafting
par: Shi, Weijie, et autres
Publié: (2026)
par: Shi, Weijie, et autres
Publié: (2026)
Automatic Slide Updating with User-Defined Dynamic Templates and Natural Language Instructions
par: Zhou, Kun, et autres
Publié: (2026)
par: Zhou, Kun, et autres
Publié: (2026)
DFlash: Block Diffusion for Flash Speculative Decoding
par: Chen, Jian, et autres
Publié: (2026)
par: Chen, Jian, et autres
Publié: (2026)
SlidesGen-Bench: Evaluating Slides Generation via Computational and Quantitative Metrics
par: Yang, Yunqiao, et autres
Publié: (2026)
par: Yang, Yunqiao, et autres
Publié: (2026)
Advancing Block Diffusion Language Models for Test-Time Scaling
par: Lu, Yi, et autres
Publié: (2026)
par: Lu, Yi, et autres
Publié: (2026)
Avoiding Overthinking and Underthinking: Curriculum-Aware Budget Scheduling for LLMs
par: Rahman, Amirul, et autres
Publié: (2026)
par: Rahman, Amirul, et autres
Publié: (2026)
Fast-Decoding Diffusion Language Models via Progress-Aware Confidence Schedules
par: Mohamed, Amr, et autres
Publié: (2025)
par: Mohamed, Amr, et autres
Publié: (2025)
DiffCoT: Diffusion-styled Chain-of-Thought Reasoning in LLMs
par: Cao, Shidong, et autres
Publié: (2026)
par: Cao, Shidong, et autres
Publié: (2026)
dMoE: dLLMs with Learnable Block Experts
par: Feng, Sicheng, et autres
Publié: (2026)
par: Feng, Sicheng, et autres
Publié: (2026)
Accelerating Speculative Decoding with Block Diffusion Draft Trees
par: Ringel, Liran, et autres
Publié: (2026)
par: Ringel, Liran, et autres
Publié: (2026)
The Devil behind the mask: An emergent safety vulnerability of Diffusion LLMs
par: Wen, Zichen, et autres
Publié: (2025)
par: Wen, Zichen, et autres
Publié: (2025)
CONCUR: High-Throughput Agentic Batch Inference of LLM via Congestion-Based Concurrency Control
par: Chen, Qiaoling, et autres
Publié: (2026)
par: Chen, Qiaoling, et autres
Publié: (2026)
Cost-Efficient RAG for Entity Matching with LLMs: A Blocking-based Exploration
par: Ma, Chuangtao, et autres
Publié: (2026)
par: Ma, Chuangtao, et autres
Publié: (2026)
CtrlDiff: Boosting Large Diffusion Language Models with Dynamic Block Prediction and Controllable Generation
par: Huang, Chihan, et autres
Publié: (2025)
par: Huang, Chihan, et autres
Publié: (2025)
Lookahead-then-Verify: Reliable Constrained Decoding for Diffusion LLMs under Context-Free Grammars
par: Zhang, Yitong, et autres
Publié: (2026)
par: Zhang, Yitong, et autres
Publié: (2026)
Reinforcement Learning Enhanced LLMs: A Survey
par: Wang, Shuhe, et autres
Publié: (2024)
par: Wang, Shuhe, et autres
Publié: (2024)
D$^3$: Dynamic Directional Graph-Constrained Data Scheduling for LLM Training
par: Xu, Yuanjian, et autres
Publié: (2026)
par: Xu, Yuanjian, et autres
Publié: (2026)
Semantic-Aware Scheduling for GPU Clusters with Large Language Models
par: Wang, Zerui, et autres
Publié: (2025)
par: Wang, Zerui, et autres
Publié: (2025)
Internal Chain-of-Thought: Empirical Evidence for Layer-wise Subtask Scheduling in LLMs
par: Yang, Zhipeng, et autres
Publié: (2025)
par: Yang, Zhipeng, et autres
Publié: (2025)
Fast-dVLM: Efficient Block-Diffusion VLM via Direct Conversion from Autoregressive VLM
par: Wu, Chengyue, et autres
Publié: (2026)
par: Wu, Chengyue, et autres
Publié: (2026)
GeoBlock: Inferring Block Granularity from Dependency Geometry in Diffusion Language Models
par: Wan, Lipeng, et autres
Publié: (2026)
par: Wan, Lipeng, et autres
Publié: (2026)
FlashBlock: Attention Caching for Efficient Long-Context Block Diffusion
par: Chen, Zhuokun, et autres
Publié: (2026)
par: Chen, Zhuokun, et autres
Publié: (2026)
On the Role of Discreteness in Diffusion LLMs
par: Jin, Ziqi, et autres
Publié: (2025)
par: Jin, Ziqi, et autres
Publié: (2025)
HiPO: Hybrid Policy Optimization for Dynamic Reasoning in LLMs
par: Deng, Ken, et autres
Publié: (2025)
par: Deng, Ken, et autres
Publié: (2025)
Documents similaires
-
DAWN: Dependency-Aware Fast Inference for Diffusion LLMs
par: Luo, Lizhuo, et autres
Publié: (2026) -
AsyncDSB: Schedule-Asynchronous Diffusion Schrödinger Bridge for Image Inpainting
par: Han, Zihao, et autres
Publié: (2024) -
SPPO:Efficient Long-sequence LLM Training via Adaptive Sequence Pipeline Parallel Offloading
par: Chen, Qiaoling, et autres
Publié: (2025) -
Triplet-Block Diffusion RWKV
par: Lin, Ke, et autres
Publié: (2026) -
SpecForge: A Flexible and Efficient Open-Source Training Framework for Speculative Decoding
par: Li, Shenggui, et autres
Publié: (2026)