Targeted Remasking: Replacing Token Editing with Token-to-Mask Refinement in Discrete Diffusion Language Models
Fuente:
arXiv
Salvato in:
| Autore principale: | Yao, Lin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Remask, Don't Replace: Token-to-Mask Refinement in Diffusion Large Language Models
di: Yao, Lin
Pubblicazione: (2026)
di: Yao, Lin
Pubblicazione: (2026)
STaRR: Spatial-Temporal Token-Dynamics-Aware Responsive Remasking for Diffusion Language Models
di: Sun, Xinhao, et al.
Pubblicazione: (2025)
di: Sun, Xinhao, et al.
Pubblicazione: (2025)
Beyond Hard Masks: Progressive Token Evolution for Diffusion Language Models
di: Zhong, Linhao, et al.
Pubblicazione: (2026)
di: Zhong, Linhao, et al.
Pubblicazione: (2026)
One Token Is Enough: Improving Diffusion Language Models with a Sink Token
di: Zhang, Zihou, et al.
Pubblicazione: (2026)
di: Zhang, Zihou, et al.
Pubblicazione: (2026)
UniMoT: Unified Molecule-Text Language Model with Discrete Token Representation
di: Guo, Shuhan, et al.
Pubblicazione: (2024)
di: Guo, Shuhan, et al.
Pubblicazione: (2024)
Explainability-Based Token Replacement on LLM-Generated Text
di: Mohammadi, Hadi, et al.
Pubblicazione: (2025)
di: Mohammadi, Hadi, et al.
Pubblicazione: (2025)
How Important Is Tokenization in French Medical Masked Language Models?
di: Labrak, Yanis, et al.
Pubblicazione: (2024)
di: Labrak, Yanis, et al.
Pubblicazione: (2024)
General Phrase Debiaser: Debiasing Masked Language Models at a Multi-Token Level
di: Shi, Bingkang, et al.
Pubblicazione: (2023)
di: Shi, Bingkang, et al.
Pubblicazione: (2023)
Saber: An Efficient Sampling with Adaptive Acceleration and Backtracking Enhanced Remasking for Diffusion Language Model
di: Dong, Yihong, et al.
Pubblicazione: (2025)
di: Dong, Yihong, et al.
Pubblicazione: (2025)
Enabling Autoregressive Models to Fill In Masked Tokens
di: Israel, Daniel, et al.
Pubblicazione: (2025)
di: Israel, Daniel, et al.
Pubblicazione: (2025)
Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models
di: Kongmanee, Jaturong
Pubblicazione: (2025)
di: Kongmanee, Jaturong
Pubblicazione: (2025)
Thinking Tokens for Language Modeling
di: Herel, David, et al.
Pubblicazione: (2024)
di: Herel, David, et al.
Pubblicazione: (2024)
Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization
di: Wang, Dixuan, et al.
Pubblicazione: (2024)
di: Wang, Dixuan, et al.
Pubblicazione: (2024)
Text Generation Beyond Discrete Token Sampling
di: Zhuang, Yufan, et al.
Pubblicazione: (2025)
di: Zhuang, Yufan, et al.
Pubblicazione: (2025)
Token Masking Improves Transformer-Based Text Classification
di: Xu, Xianglong, et al.
Pubblicazione: (2025)
di: Xu, Xianglong, et al.
Pubblicazione: (2025)
SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling
di: Liu, Dong, et al.
Pubblicazione: (2025)
di: Liu, Dong, et al.
Pubblicazione: (2025)
Finish First, Perfect Later: Test-Time Token-Level Cross-Validation for Diffusion Large Language Models
di: Tian, Runchu, et al.
Pubblicazione: (2025)
di: Tian, Runchu, et al.
Pubblicazione: (2025)
Saliency-driven Dynamic Token Pruning for Large Language Models
di: Tao, Yao, et al.
Pubblicazione: (2025)
di: Tao, Yao, et al.
Pubblicazione: (2025)
The Path Matters: Learning a Token-Commitment Policy for Diffusion Language Models
di: Sun, Bohang, et al.
Pubblicazione: (2026)
di: Sun, Bohang, et al.
Pubblicazione: (2026)
Discrete Tokenization for Multimodal LLMs: A Comprehensive Survey
di: Li, Jindong, et al.
Pubblicazione: (2025)
di: Li, Jindong, et al.
Pubblicazione: (2025)
Memory Retrieval and Consolidation in Large Language Models through Function Tokens
di: Zhang, Shaohua, et al.
Pubblicazione: (2025)
di: Zhang, Shaohua, et al.
Pubblicazione: (2025)
IntactKV: Improving Large Language Model Quantization by Keeping Pivot Tokens Intact
di: Liu, Ruikang, et al.
Pubblicazione: (2024)
di: Liu, Ruikang, et al.
Pubblicazione: (2024)
Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models
di: Cho, Gyeongje, et al.
Pubblicazione: (2025)
di: Cho, Gyeongje, et al.
Pubblicazione: (2025)
Token Signature: Predicting Chain-of-Thought Gains with Token Decoding Feature in Large Language Models
di: Liu, Peijie, et al.
Pubblicazione: (2025)
di: Liu, Peijie, et al.
Pubblicazione: (2025)
Accelerating Multilingual Language Model for Excessively Tokenized Languages
di: Hong, Jimin, et al.
Pubblicazione: (2024)
di: Hong, Jimin, et al.
Pubblicazione: (2024)
Extended Japanese Commonsense Morality Dataset with Masked Token and Label Enhancement
di: Ohashi, Takumi, et al.
Pubblicazione: (2024)
di: Ohashi, Takumi, et al.
Pubblicazione: (2024)
On the Fallacy of Global Token Perplexity in Spoken Language Model Evaluation
di: Hsu, Chan-Jan, et al.
Pubblicazione: (2026)
di: Hsu, Chan-Jan, et al.
Pubblicazione: (2026)
Adaptive Token Biaser: Knowledge Editing via Biasing Key Entities
di: Bi, Baolong, et al.
Pubblicazione: (2024)
di: Bi, Baolong, et al.
Pubblicazione: (2024)
Don't Let It Fade: Preserving Edits in Diffusion Language Models via Token Timestep Allocation
di: Kim, Woojin, et al.
Pubblicazione: (2025)
di: Kim, Woojin, et al.
Pubblicazione: (2025)
From Language Models over Tokens to Language Models over Characters
di: Vieira, Tim, et al.
Pubblicazione: (2024)
di: Vieira, Tim, et al.
Pubblicazione: (2024)
StableMask: Refining Causal Masking in Decoder-only Transformer
di: Yin, Qingyu, et al.
Pubblicazione: (2024)
di: Yin, Qingyu, et al.
Pubblicazione: (2024)
Counting Ability of Large Language Models and Impact of Tokenization
di: Zhang, Xiang, et al.
Pubblicazione: (2024)
di: Zhang, Xiang, et al.
Pubblicazione: (2024)
HeartLLM: Discretized ECG Tokenization for LLM-Based Diagnostic Reasoning
di: Yang, Jinning, et al.
Pubblicazione: (2025)
di: Yang, Jinning, et al.
Pubblicazione: (2025)
Token Constraint Decoding Improves Robustness on Question Answering for Large Language Models
di: Yao, Jui-Ming, et al.
Pubblicazione: (2025)
di: Yao, Jui-Ming, et al.
Pubblicazione: (2025)
The Token Tax: Systematic Bias in Multilingual Tokenization
di: Lundin, Jessica M., et al.
Pubblicazione: (2025)
di: Lundin, Jessica M., et al.
Pubblicazione: (2025)
Length-MAX Tokenizer for Language Models
di: Dong, Dong, et al.
Pubblicazione: (2025)
di: Dong, Dong, et al.
Pubblicazione: (2025)
Pre-Training Curriculum for Multi-Token Prediction in Language Models
di: Aynetdinov, Ansar, et al.
Pubblicazione: (2025)
di: Aynetdinov, Ansar, et al.
Pubblicazione: (2025)
Contextual Reinforcement in Multimodal Token Compression for Large Language Models
di: Piero, Naderdel, et al.
Pubblicazione: (2025)
di: Piero, Naderdel, et al.
Pubblicazione: (2025)
From Tokens to Lattices: Emergent Lattice Structures in Language Models
di: Xiong, Bo, et al.
Pubblicazione: (2025)
di: Xiong, Bo, et al.
Pubblicazione: (2025)
Is There a Case for Conversation Optimized Tokenizers in Large Language Models?
di: Ferrando, Raquel, et al.
Pubblicazione: (2025)
di: Ferrando, Raquel, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Remask, Don't Replace: Token-to-Mask Refinement in Diffusion Large Language Models
di: Yao, Lin
Pubblicazione: (2026) -
STaRR: Spatial-Temporal Token-Dynamics-Aware Responsive Remasking for Diffusion Language Models
di: Sun, Xinhao, et al.
Pubblicazione: (2025) -
Beyond Hard Masks: Progressive Token Evolution for Diffusion Language Models
di: Zhong, Linhao, et al.
Pubblicazione: (2026) -
One Token Is Enough: Improving Diffusion Language Models with a Sink Token
di: Zhang, Zihou, et al.
Pubblicazione: (2026) -
UniMoT: Unified Molecule-Text Language Model with Discrete Token Representation
di: Guo, Shuhan, et al.
Pubblicazione: (2024)