Stopping Computation for Converged Tokens in Masked Diffusion-LM Decoding
Fuente:
arXiv
Guardado en:
| Autores principales: | Oba, Daisuke, Bollegala, Danushka, Kaneko, Masahiro, Okazaki, Naoaki |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Diffusion-State Policy Optimization for Masked Diffusion Language Models
por: Oba, Daisuke, et al.
Publicado: (2026)
por: Oba, Daisuke, et al.
Publicado: (2026)
In-Contextual Gender Bias Suppression for Large Language Models
por: Oba, Daisuke, et al.
Publicado: (2023)
por: Oba, Daisuke, et al.
Publicado: (2023)
Evaluating Gender Bias in Large Language Models via Chain-of-Thought Prompting
por: Kaneko, Masahiro, et al.
Publicado: (2024)
por: Kaneko, Masahiro, et al.
Publicado: (2024)
Drifting Objectives for Refining Discrete Diffusion Language Models
por: Oba, Daisuke, et al.
Publicado: (2026)
por: Oba, Daisuke, et al.
Publicado: (2026)
Aligning Tree-Search Policies with Fixed Token Budgets in Test-Time Scaling of LLMs
por: Miyamoto, Sora, et al.
Publicado: (2026)
por: Miyamoto, Sora, et al.
Publicado: (2026)
The Gaps between Pre-train and Downstream Settings in Bias Evaluation and Debiasing
por: Kaneko, Masahiro, et al.
Publicado: (2024)
por: Kaneko, Masahiro, et al.
Publicado: (2024)
Eagle: Ethical Dataset Given from Real Interactions
por: Kaneko, Masahiro, et al.
Publicado: (2024)
por: Kaneko, Masahiro, et al.
Publicado: (2024)
Improving Pre-trained Language Model Sensitivity via Mask Specific losses: A case study on Biomedical NER
por: Abaho, Micheal, et al.
Publicado: (2024)
por: Abaho, Micheal, et al.
Publicado: (2024)
A Japanese Benchmark for Evaluating Social Bias in Reasoning Based on Attribution Theory
por: Shiotani, Taihei, et al.
Publicado: (2026)
por: Shiotani, Taihei, et al.
Publicado: (2026)
Evaluating Gender Bias of Pre-trained Language Models in Natural Language Inference by Considering All Labels
por: Anantaprayoon, Panatchakorn, et al.
Publicado: (2023)
por: Anantaprayoon, Panatchakorn, et al.
Publicado: (2023)
OUTFOX: LLM-Generated Essay Detection Through In-Context Learning with Adversarially Generated Examples
por: Koike, Ryuto, et al.
Publicado: (2023)
por: Koike, Ryuto, et al.
Publicado: (2023)
How You Prompt Matters! Even Task-Oriented Constraints in Instructions Affect LLM-Generated Text Detection
por: Koike, Ryuto, et al.
Publicado: (2023)
por: Koike, Ryuto, et al.
Publicado: (2023)
Solving NLP Problems through Human-System Collaboration: A Discussion-based Approach
por: Kaneko, Masahiro, et al.
Publicado: (2023)
por: Kaneko, Masahiro, et al.
Publicado: (2023)
Social Bias Evaluation for Large Language Models Requires Prompt Variations
por: Hida, Rem, et al.
Publicado: (2024)
por: Hida, Rem, et al.
Publicado: (2024)
SAIE Framework: Support Alone Isn't Enough -- Advancing LLM Training with Adversarial Remarks
por: Loem, Mengsay, et al.
Publicado: (2023)
por: Loem, Mengsay, et al.
Publicado: (2023)
JUBAKU: An Adversarial Benchmark for Exposing Culturally Grounded Stereotypes in Japanese LLMs
por: Shiotani, Taihei, et al.
Publicado: (2026)
por: Shiotani, Taihei, et al.
Publicado: (2026)
ExLM: Rethinking the Impact of [MASK] Tokens in Masked Language Models
por: Zheng, Kangjie, et al.
Publicado: (2025)
por: Zheng, Kangjie, et al.
Publicado: (2025)
Intent-Aware Self-Correction for Mitigating Social Biases in Large Language Models
por: Anantaprayoon, Panatchakorn, et al.
Publicado: (2025)
por: Anantaprayoon, Panatchakorn, et al.
Publicado: (2025)
Map of Encoders -- Mapping Sentence Encoders using Quantum Relative Entropy
por: Zhang, Gaifan, et al.
Publicado: (2026)
por: Zhang, Gaifan, et al.
Publicado: (2026)
A Semantic Distance Metric Learning approach for Lexical Semantic Change Detection
por: Aida, Taichi, et al.
Publicado: (2024)
por: Aida, Taichi, et al.
Publicado: (2024)
SCDTour: Embedding Axis Ordering and Merging for Interpretable Semantic Change Detection
por: Aida, Taichi, et al.
Publicado: (2025)
por: Aida, Taichi, et al.
Publicado: (2025)
Investigating the Contextualised Word Embedding Dimensions Specified for Contextual and Temporal Semantic Changes
por: Aida, Taichi, et al.
Publicado: (2024)
por: Aida, Taichi, et al.
Publicado: (2024)
Evaluating Short-Term Temporal Fluctuations of Social Biases in Social Media Data and Masked Language Models
por: Zhou, Yi, et al.
Publicado: (2024)
por: Zhou, Yi, et al.
Publicado: (2024)
LLM Output Detectability and Task Performance Can be Jointly Optimized
por: Saito, Koshiro, et al.
Publicado: (2026)
por: Saito, Koshiro, et al.
Publicado: (2026)
Sampling-based Pseudo-Likelihood for Membership Inference Attacks
por: Kaneko, Masahiro, et al.
Publicado: (2024)
por: Kaneko, Masahiro, et al.
Publicado: (2024)
Just on Time: Token-Level Early Stopping for Diffusion Language Models
por: Kohut, Zahar, et al.
Publicado: (2026)
por: Kohut, Zahar, et al.
Publicado: (2026)
Paraphrasing Adversarial Attack on LLM-as-a-Reviewer
por: Kaneko, Masahiro
Publicado: (2026)
por: Kaneko, Masahiro
Publicado: (2026)
Tokenization as Finite-State Transduction
por: Cognetta, Marco, et al.
Publicado: (2024)
por: Cognetta, Marco, et al.
Publicado: (2024)
DualDiffusion: A Speculative Decoding Strategy for Masked Diffusion Models
por: Goyal, Satyam, et al.
Publicado: (2026)
por: Goyal, Satyam, et al.
Publicado: (2026)
Synthetic Data Generation for Training Diversified Commonsense Reasoning Models
por: Zhang, Tianhui, et al.
Publicado: (2026)
por: Zhang, Tianhui, et al.
Publicado: (2026)
Evaluating Unsupervised Dimensionality Reduction Methods for Pretrained Sentence Embeddings
por: Zhang, Gaifan, et al.
Publicado: (2024)
por: Zhang, Gaifan, et al.
Publicado: (2024)
Evaluating the Effect of Retrieval Augmentation on Social Biases
por: Zhang, Tianhui, et al.
Publicado: (2025)
por: Zhang, Tianhui, et al.
Publicado: (2025)
Annotating Training Data for Conditional Semantic Textual Similarity Measurement using Large Language Models
por: Zhang, Gaifan, et al.
Publicado: (2025)
por: Zhang, Gaifan, et al.
Publicado: (2025)
CASE -- Condition-Aware Sentence Embeddings for Conditional Semantic Textual Similarity Measurement
por: Zhang, Gaifan, et al.
Publicado: (2025)
por: Zhang, Gaifan, et al.
Publicado: (2025)
Evaluating the Evaluation of Diversity in Commonsense Generation
por: Zhang, Tianhui, et al.
Publicado: (2025)
por: Zhang, Tianhui, et al.
Publicado: (2025)
Improving Diversity of Commonsense Generation by Large Language Models via In-Context Learning
por: Zhang, Tianhui, et al.
Publicado: (2024)
por: Zhang, Tianhui, et al.
Publicado: (2024)
Multi-modal, Multi-task, Multi-criteria Automatic Evaluation with Vision Language Models
por: Ohi, Masanari, et al.
Publicado: (2024)
por: Ohi, Masanari, et al.
Publicado: (2024)
Knowledge of Pretrained Language Models on Surface Information of Tokens
por: Hiraoka, Tatsuya, et al.
Publicado: (2024)
por: Hiraoka, Tatsuya, et al.
Publicado: (2024)
JailNewsBench: Multi-Lingual and Regional Benchmark for Fake News Generation under Jailbreak Attacks
por: Kaneko, Masahiro, et al.
Publicado: (2026)
por: Kaneko, Masahiro, et al.
Publicado: (2026)
ExaGPT: Example-Based Machine-Generated Text Detection for Human Interpretability
por: Koike, Ryuto, et al.
Publicado: (2025)
por: Koike, Ryuto, et al.
Publicado: (2025)
Ejemplares similares
-
Diffusion-State Policy Optimization for Masked Diffusion Language Models
por: Oba, Daisuke, et al.
Publicado: (2026) -
In-Contextual Gender Bias Suppression for Large Language Models
por: Oba, Daisuke, et al.
Publicado: (2023) -
Evaluating Gender Bias in Large Language Models via Chain-of-Thought Prompting
por: Kaneko, Masahiro, et al.
Publicado: (2024) -
Drifting Objectives for Refining Discrete Diffusion Language Models
por: Oba, Daisuke, et al.
Publicado: (2026) -
Aligning Tree-Search Policies with Fixed Token Budgets in Test-Time Scaling of LLMs
por: Miyamoto, Sora, et al.
Publicado: (2026)