Fast-Decoding Diffusion Language Models via Progress-Aware Confidence Schedules
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Mohamed, Amr, Zhang, Yang, Vazirgiannis, Michalis, Shang, Guokan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Lost in the Mix: Evaluating LLM Understanding of Code-Switched Text
von: Mohamed, Amr, et al.
Veröffentlicht: (2025)
von: Mohamed, Amr, et al.
Veröffentlicht: (2025)
Beyond Random Sampling: Efficient Language Model Pretraining via Curriculum Learning
von: Zhang, Yang, et al.
Veröffentlicht: (2025)
von: Zhang, Yang, et al.
Veröffentlicht: (2025)
LLM as a Broken Telephone: Iterative Generation Distorts Information
von: Mohamed, Amr, et al.
Veröffentlicht: (2025)
von: Mohamed, Amr, et al.
Veröffentlicht: (2025)
Markovian Generation Chains in Large Language Models
von: Geng, Mingmeng, et al.
Veröffentlicht: (2026)
von: Geng, Mingmeng, et al.
Veröffentlicht: (2026)
The Curious Decline of Linguistic Diversity: Training Language Models on Synthetic Text
von: Guo, Yanzhu, et al.
Veröffentlicht: (2023)
von: Guo, Yanzhu, et al.
Veröffentlicht: (2023)
Leveraging Discourse Structure for Extractive Meeting Summarization
von: Rennard, Virgile, et al.
Veröffentlicht: (2024)
von: Rennard, Virgile, et al.
Veröffentlicht: (2024)
Nile-Chat: Egyptian Language Models for Arabic and Latin Scripts
von: Shang, Guokan, et al.
Veröffentlicht: (2025)
von: Shang, Guokan, et al.
Veröffentlicht: (2025)
GreekMMLU: A Native-Sourced Multitask Benchmark for Evaluating Language Models in Greek
von: Zhang, Yang, et al.
Veröffentlicht: (2026)
von: Zhang, Yang, et al.
Veröffentlicht: (2026)
Atlas-Chat: Adapting Large Language Models for Low-Resource Moroccan Arabic Dialect
von: Shang, Guokan, et al.
Veröffentlicht: (2024)
von: Shang, Guokan, et al.
Veröffentlicht: (2024)
Graph Linearization Methods for Reasoning on Graphs with Large Language Models
von: Xypolopoulos, Christos, et al.
Veröffentlicht: (2024)
von: Xypolopoulos, Christos, et al.
Veröffentlicht: (2024)
Benchmarking Linguistic Diversity of Large Language Models
von: Guo, Yanzhu, et al.
Veröffentlicht: (2024)
von: Guo, Yanzhu, et al.
Veröffentlicht: (2024)
CARTE: A Benchmark for Mapping Language Model Knowledge Across France
von: Carneiro, Sarah Almeida, et al.
Veröffentlicht: (2026)
von: Carneiro, Sarah Almeida, et al.
Veröffentlicht: (2026)
Beyond Confidence: Adaptive and Coherent Decoding for Diffusion Language Models
von: Chen, Kecheng, et al.
Veröffentlicht: (2025)
von: Chen, Kecheng, et al.
Veröffentlicht: (2025)
Bias in the Mirror: Are LLMs opinions robust to their own adversarial attacks ?
von: Rennard, Virgile, et al.
Veröffentlicht: (2024)
von: Rennard, Virgile, et al.
Veröffentlicht: (2024)
Graph Neural Networks on Discriminative Graphs of Words
von: Abbahaddou, Yassine, et al.
Veröffentlicht: (2024)
von: Abbahaddou, Yassine, et al.
Veröffentlicht: (2024)
Shorter but not Worse: Frugal Reasoning via Easy Samples as Length Regularizers in Math RLVR
von: Bounhar, Abdelaziz, et al.
Veröffentlicht: (2025)
von: Bounhar, Abdelaziz, et al.
Veröffentlicht: (2025)
Word Sense Induction with Hierarchical Clustering and Mutual Information Maximization
von: Abdine, Hadi, et al.
Veröffentlicht: (2022)
von: Abdine, Hadi, et al.
Veröffentlicht: (2022)
Learning to Parallel: Accelerating Diffusion Large Language Models via Learnable Parallel Decoding
von: Bao, Wenrui, et al.
Veröffentlicht: (2025)
von: Bao, Wenrui, et al.
Veröffentlicht: (2025)
Prot2Text: Multimodal Protein's Function Generation with GNNs and Transformers
von: Abdine, Hadi, et al.
Veröffentlicht: (2023)
von: Abdine, Hadi, et al.
Veröffentlicht: (2023)
Enhancing Language Model Factuality via Activation-Based Confidence Calibration and Guided Decoding
von: Liu, Xin, et al.
Veröffentlicht: (2024)
von: Liu, Xin, et al.
Veröffentlicht: (2024)
CoCoA: Confidence and Context-Aware Adaptive Decoding for Resolving Knowledge Conflicts in Large Language Models
von: Khandelwal, Anant, et al.
Veröffentlicht: (2025)
von: Khandelwal, Anant, et al.
Veröffentlicht: (2025)
TALON: Confidence-Aware Speculative Decoding with Adaptive Token Trees
von: Liu, Tianyu, et al.
Veröffentlicht: (2026)
von: Liu, Tianyu, et al.
Veröffentlicht: (2026)
Fast Large Language Model Collaborative Decoding via Speculation
von: Fu, Jiale, et al.
Veröffentlicht: (2025)
von: Fu, Jiale, et al.
Veröffentlicht: (2025)
AdaSpec: Adaptive Speculative Decoding for Fast, SLO-Aware Large Language Model Serving
von: Huang, Kaiyu, et al.
Veröffentlicht: (2025)
von: Huang, Kaiyu, et al.
Veröffentlicht: (2025)
Reversible Diffusion Decoding for Diffusion Language Models
von: Wang, Xinyun, et al.
Veröffentlicht: (2026)
von: Wang, Xinyun, et al.
Veröffentlicht: (2026)
Confidence-Modulated Speculative Decoding for Large Language Models
von: Sen, Jaydip, et al.
Veröffentlicht: (2025)
von: Sen, Jaydip, et al.
Veröffentlicht: (2025)
When Confidence Misleads: Suffix Anchoring and Anchor-Proximity Confidence Modulation for Diffusion Language Models
von: Park, Jungwon, et al.
Veröffentlicht: (2026)
von: Park, Jungwon, et al.
Veröffentlicht: (2026)
A Greek Government Decisions Dataset for Public-Sector Analysis and Insight
von: Antoniou, Giorgos, et al.
Veröffentlicht: (2025)
von: Antoniou, Giorgos, et al.
Veröffentlicht: (2025)
Self Speculative Decoding for Diffusion Large Language Models
von: Gao, Yifeng, et al.
Veröffentlicht: (2025)
von: Gao, Yifeng, et al.
Veröffentlicht: (2025)
Position-Aware Depth Decay Decoding ($D^3$): Boosting Large Language Model Inference Efficiency
von: Fan, Siqi, et al.
Veröffentlicht: (2025)
von: Fan, Siqi, et al.
Veröffentlicht: (2025)
Divide and Conquer: Accelerating Diffusion-Based Large Language Models via Adaptive Parallel Decoding
von: Luo, Xiangzhong, et al.
Veröffentlicht: (2026)
von: Luo, Xiangzhong, et al.
Veröffentlicht: (2026)
Recurrent Drafter for Fast Speculative Decoding in Large Language Models
von: Cheng, Yunfei, et al.
Veröffentlicht: (2024)
von: Cheng, Yunfei, et al.
Veröffentlicht: (2024)
Cost-Aware Diffusion Draft Trees for Speculative Decoding
von: Zhang, Shuai, et al.
Veröffentlicht: (2026)
von: Zhang, Shuai, et al.
Veröffentlicht: (2026)
Fast Best-of-N Decoding via Speculative Rejection
von: Sun, Hanshi, et al.
Veröffentlicht: (2024)
von: Sun, Hanshi, et al.
Veröffentlicht: (2024)
Defending Large Language Models Against Jailbreak Attacks via In-Decoding Safety-Awareness Probing
von: Zhao, Yinzhi, et al.
Veröffentlicht: (2026)
von: Zhao, Yinzhi, et al.
Veröffentlicht: (2026)
Language Confusion Gate: Language-Aware Decoding Through Model Self-Distillation
von: Zhang, Collin, et al.
Veröffentlicht: (2025)
von: Zhang, Collin, et al.
Veröffentlicht: (2025)
DART: Diffusion-Inspired Speculative Decoding for Fast LLM Inference
von: Liu, Fuliang, et al.
Veröffentlicht: (2026)
von: Liu, Fuliang, et al.
Veröffentlicht: (2026)
Direct Confidence Alignment: Aligning Verbalized Confidence with Internal Confidence In Large Language Models
von: Zhang, Glenn, et al.
Veröffentlicht: (2025)
von: Zhang, Glenn, et al.
Veröffentlicht: (2025)
Factorization-Error-Free Discrete Diffusion Language Model via Speculative Decoding
von: Fang, Xun, et al.
Veröffentlicht: (2026)
von: Fang, Xun, et al.
Veröffentlicht: (2026)
Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences
von: Shrivastava, Vaishnavi, et al.
Veröffentlicht: (2025)
von: Shrivastava, Vaishnavi, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Lost in the Mix: Evaluating LLM Understanding of Code-Switched Text
von: Mohamed, Amr, et al.
Veröffentlicht: (2025) -
Beyond Random Sampling: Efficient Language Model Pretraining via Curriculum Learning
von: Zhang, Yang, et al.
Veröffentlicht: (2025) -
LLM as a Broken Telephone: Iterative Generation Distorts Information
von: Mohamed, Amr, et al.
Veröffentlicht: (2025) -
Markovian Generation Chains in Large Language Models
von: Geng, Mingmeng, et al.
Veröffentlicht: (2026) -
The Curious Decline of Linguistic Diversity: Training Language Models on Synthetic Text
von: Guo, Yanzhu, et al.
Veröffentlicht: (2023)