Just on Time: Token-Level Early Stopping for Diffusion Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Kohut, Zahar, Shykula, Severyn, Khamula, Dmytro, Vysotskyi, Mykola, Rumezhak, Taras, Karpiv, Volodymyr |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Critic-Guided Reinforcement Unlearning in Text-to-Image Diffusion
di: Vysotskyi, Mykola, et al.
Pubblicazione: (2026)
di: Vysotskyi, Mykola, et al.
Pubblicazione: (2026)
Automated Instruction Revision (AIR): A Structured Comparison of Task Adaptation Strategies for LLM
di: Bilyk, Solomiia, et al.
Pubblicazione: (2026)
di: Bilyk, Solomiia, et al.
Pubblicazione: (2026)
Stopping Computation for Converged Tokens in Masked Diffusion-LM Decoding
di: Oba, Daisuke, et al.
Pubblicazione: (2026)
di: Oba, Daisuke, et al.
Pubblicazione: (2026)
AdaEDL: Early Draft Stopping for Speculative Decoding of Large Language Models via an Entropy-based Lower Bound on Token Acceptance Probability
di: Agrawal, Sudhanshu, et al.
Pubblicazione: (2024)
di: Agrawal, Sudhanshu, et al.
Pubblicazione: (2024)
Stop-Think-AutoRegress: Language Modeling with Latent Diffusion Planning
di: Lovelace, Justin, et al.
Pubblicazione: (2026)
di: Lovelace, Justin, et al.
Pubblicazione: (2026)
Small Language Models Improve Giants by Rewriting Their Outputs
di: Vernikos, Giorgos, et al.
Pubblicazione: (2023)
di: Vernikos, Giorgos, et al.
Pubblicazione: (2023)
Stop Taking Tokenizers for Granted: They Are Core Design Decisions in Large Language Models
di: Alqahtani, Sawsan, et al.
Pubblicazione: (2026)
di: Alqahtani, Sawsan, et al.
Pubblicazione: (2026)
FLOP-Efficient Training: Early Stopping Based on Test-Time Compute Awareness
di: Amer, Hossam, et al.
Pubblicazione: (2026)
di: Amer, Hossam, et al.
Pubblicazione: (2026)
Rethinking Token Prediction: Tree-Structured Diffusion Language Model
di: Wu, Zihao, et al.
Pubblicazione: (2026)
di: Wu, Zihao, et al.
Pubblicazione: (2026)
Diffusion Language Models Generation Can Be Halted Early
di: Vaina, Sofia Maria Lo Cicero, et al.
Pubblicazione: (2023)
di: Vaina, Sofia Maria Lo Cicero, et al.
Pubblicazione: (2023)
Exact Byte-Level Probabilities from Tokenized Language Models for FIM-Tasks and Model Ensembles
di: Phan, Buu, et al.
Pubblicazione: (2024)
di: Phan, Buu, et al.
Pubblicazione: (2024)
Fine-Tuning Language Models with Just Forward Passes
di: Malladi, Sadhika, et al.
Pubblicazione: (2023)
di: Malladi, Sadhika, et al.
Pubblicazione: (2023)
Early Stopping for Large Reasoning Models via Confidence Dynamics
di: Hosseini, Parsa, et al.
Pubblicazione: (2026)
di: Hosseini, Parsa, et al.
Pubblicazione: (2026)
Beyond Early-Token Bias: Model-Specific and Language-Specific Position Effects in Multilingual LLMs
di: Menschikov, Mikhail, et al.
Pubblicazione: (2025)
di: Menschikov, Mikhail, et al.
Pubblicazione: (2025)
Scalable Token-Level Hallucination Detection in Large Language Models
di: Min, Rui, et al.
Pubblicazione: (2026)
di: Min, Rui, et al.
Pubblicazione: (2026)
West-of-N: Synthetic Preferences for Self-Improving Reward Models
di: Pace, Alizée, et al.
Pubblicazione: (2024)
di: Pace, Alizée, et al.
Pubblicazione: (2024)
TokenShapley: Token Level Context Attribution with Shapley Value
di: Xiao, Yingtai, et al.
Pubblicazione: (2025)
di: Xiao, Yingtai, et al.
Pubblicazione: (2025)
Multimodal Latent Language Modeling with Next-Token Diffusion
di: Sun, Yutao, et al.
Pubblicazione: (2024)
di: Sun, Yutao, et al.
Pubblicazione: (2024)
Improving Diffusion Language Model Decoding through Joint Search in Generation Order and Token Space
di: Shen, Yangyi, et al.
Pubblicazione: (2026)
di: Shen, Yangyi, et al.
Pubblicazione: (2026)
TLPO: Token-Level Policy Optimization for Mitigating Language Confusion in Large Language Models
di: Choo, Jinho, et al.
Pubblicazione: (2026)
di: Choo, Jinho, et al.
Pubblicazione: (2026)
Simple and Effective Masked Diffusion Language Models
di: Sahoo, Subham Sekhar, et al.
Pubblicazione: (2024)
di: Sahoo, Subham Sekhar, et al.
Pubblicazione: (2024)
Optimal Stopping vs Best-of-$N$ for Inference Time Optimization
di: Kalayci, Yusuf, et al.
Pubblicazione: (2025)
di: Kalayci, Yusuf, et al.
Pubblicazione: (2025)
Detection of Machine-Generated Text: Literature Survey
di: Valiaiev, Dmytro
Pubblicazione: (2024)
di: Valiaiev, Dmytro
Pubblicazione: (2024)
Language Modeling with Learned Meta-Tokens
di: Shah, Alok N., et al.
Pubblicazione: (2025)
di: Shah, Alok N., et al.
Pubblicazione: (2025)
Parallel Token Prediction for Language Models
di: Draxler, Felix, et al.
Pubblicazione: (2025)
di: Draxler, Felix, et al.
Pubblicazione: (2025)
TLDR: Token-Level Detective Reward Model for Large Vision Language Models
di: Fu, Deqing, et al.
Pubblicazione: (2024)
di: Fu, Deqing, et al.
Pubblicazione: (2024)
AlignDistil: Token-Level Language Model Alignment as Adaptive Policy Distillation
di: Zhang, Songming, et al.
Pubblicazione: (2025)
di: Zhang, Songming, et al.
Pubblicazione: (2025)
Large Language Models Struggle in Token-Level Clinical Named Entity Recognition
di: Lu, Qiuhao, et al.
Pubblicazione: (2024)
di: Lu, Qiuhao, et al.
Pubblicazione: (2024)
DP-Fusion: Token-Level Differentially Private Inference for Large Language Models
di: Thareja, Rushil, et al.
Pubblicazione: (2025)
di: Thareja, Rushil, et al.
Pubblicazione: (2025)
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
di: Shao, Chenze, et al.
Pubblicazione: (2024)
di: Shao, Chenze, et al.
Pubblicazione: (2024)
TokUR: Token-Level Uncertainty Estimation for Large Language Model Reasoning
di: Zhang, Tunyu, et al.
Pubblicazione: (2025)
di: Zhang, Tunyu, et al.
Pubblicazione: (2025)
First is Not Really Better Than Last: Evaluating Layer Choice and Aggregation Strategies in Language Model Data Influence Estimation
di: Vitel, Dmytro, et al.
Pubblicazione: (2025)
di: Vitel, Dmytro, et al.
Pubblicazione: (2025)
QuIP: 2-Bit Quantization of Large Language Models With Guarantees
di: Chee, Jerry, et al.
Pubblicazione: (2023)
di: Chee, Jerry, et al.
Pubblicazione: (2023)
TIDE: Token-Informed Depth Execution for Per-Token Early Exit in LLM Inference
di: Jaber, Jaber, et al.
Pubblicazione: (2026)
di: Jaber, Jaber, et al.
Pubblicazione: (2026)
Towards Token-Level Text Anomaly Detection
di: Cao, Yang, et al.
Pubblicazione: (2026)
di: Cao, Yang, et al.
Pubblicazione: (2026)
Fact-Checking the Output of Large Language Models via Token-Level Uncertainty Quantification
di: Fadeeva, Ekaterina, et al.
Pubblicazione: (2024)
di: Fadeeva, Ekaterina, et al.
Pubblicazione: (2024)
Neural Attention Search Linear: Towards Adaptive Token-Level Hybrid Attention Models
di: Deng, Difan, et al.
Pubblicazione: (2026)
di: Deng, Difan, et al.
Pubblicazione: (2026)
From Token to Token Pair: Efficient Prompt Compression for Large Language Models in Clinical Prediction
di: Zhu, Mingcheng, et al.
Pubblicazione: (2026)
di: Zhu, Mingcheng, et al.
Pubblicazione: (2026)
The Geometry of Tokens in Internal Representations of Large Language Models
di: Viswanathan, Karthik, et al.
Pubblicazione: (2025)
di: Viswanathan, Karthik, et al.
Pubblicazione: (2025)
Time Will Tell: Timing Side Channels via Output Token Count in Large Language Models
di: Zhang, Tianchen, et al.
Pubblicazione: (2024)
di: Zhang, Tianchen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Critic-Guided Reinforcement Unlearning in Text-to-Image Diffusion
di: Vysotskyi, Mykola, et al.
Pubblicazione: (2026) -
Automated Instruction Revision (AIR): A Structured Comparison of Task Adaptation Strategies for LLM
di: Bilyk, Solomiia, et al.
Pubblicazione: (2026) -
Stopping Computation for Converged Tokens in Masked Diffusion-LM Decoding
di: Oba, Daisuke, et al.
Pubblicazione: (2026) -
AdaEDL: Early Draft Stopping for Speculative Decoding of Large Language Models via an Entropy-based Lower Bound on Token Acceptance Probability
di: Agrawal, Sudhanshu, et al.
Pubblicazione: (2024) -
Stop-Think-AutoRegress: Language Modeling with Latent Diffusion Planning
di: Lovelace, Justin, et al.
Pubblicazione: (2026)