Diffusion Language Models Are Natively Length-Aware
Fuente:
arXiv
Salvato in:
| Autori principali: | Rossi, Vittorio, Cirò, Giacomo, Beltrame, Davide, Gandolfi, Luca, Röttger, Paul, Hovy, Dirk |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SimBench: Benchmarking the Ability of Large Language Models to Simulate Human Behaviors
di: Hu, Tiancheng, et al.
Pubblicazione: (2025)
di: Hu, Tiancheng, et al.
Pubblicazione: (2025)
Compromesso! Italian Many-Shot Jailbreaks Undermine the Safety of Large Language Models
di: Pernisi, Fabio, et al.
Pubblicazione: (2024)
di: Pernisi, Fabio, et al.
Pubblicazione: (2024)
Large Language Model Hacking: Quantifying the Hidden Risks of Using LLMs for Text Annotation
di: Baumann, Joachim, et al.
Pubblicazione: (2025)
di: Baumann, Joachim, et al.
Pubblicazione: (2025)
The Pluralistic Moral Gap: Understanding Judgment and Value Differences between Humans and Large Language Models
di: Russo, Giuseppe, et al.
Pubblicazione: (2025)
di: Russo, Giuseppe, et al.
Pubblicazione: (2025)
SafetyPrompts: a Systematic Review of Open Datasets for Evaluating and Improving Large Language Model Safety
di: Röttger, Paul, et al.
Pubblicazione: (2024)
di: Röttger, Paul, et al.
Pubblicazione: (2024)
The Ecological Fallacy in Annotation: Modelling Human Label Variation goes beyond Sociodemographics
di: Orlikowski, Matthias, et al.
Pubblicazione: (2023)
di: Orlikowski, Matthias, et al.
Pubblicazione: (2023)
Comparing Pre-trained Human Language Models: Is it Better with Human Context as Groups, Individual Traits, or Both?
di: Soni, Nikita, et al.
Pubblicazione: (2024)
di: Soni, Nikita, et al.
Pubblicazione: (2024)
Beyond Flesch-Kincaid: Prompt-based Metrics Improve Difficulty Classification of Educational Texts
di: Rooein, Donya, et al.
Pubblicazione: (2024)
di: Rooein, Donya, et al.
Pubblicazione: (2024)
Improving Variable-Length Generation in Diffusion Language Models via Length Regularization
di: Cheng, Zicong, et al.
Pubblicazione: (2026)
di: Cheng, Zicong, et al.
Pubblicazione: (2026)
Context-Aware Initialization for Reducing Generative Path Length in Diffusion Language Models
di: Miao, Tongyuan, et al.
Pubblicazione: (2025)
di: Miao, Tongyuan, et al.
Pubblicazione: (2025)
On the Expressiveness and Length Generalization of Selective State-Space Models on Regular Languages
di: Terzić, Aleksandar, et al.
Pubblicazione: (2024)
di: Terzić, Aleksandar, et al.
Pubblicazione: (2024)
Beyond Demographics: Fine-tuning Large Language Models to Predict Individuals' Subjective Text Perceptions
di: Orlikowski, Matthias, et al.
Pubblicazione: (2025)
di: Orlikowski, Matthias, et al.
Pubblicazione: (2025)
XSTest: A Test Suite for Identifying Exaggerated Safety Behaviours in Large Language Models
di: Röttger, Paul, et al.
Pubblicazione: (2023)
di: Röttger, Paul, et al.
Pubblicazione: (2023)
Principled Personas: Defining and Measuring the Intended Effects of Persona Prompting on Task Performance
di: de Araujo, Pedro Henrique Luz, et al.
Pubblicazione: (2025)
di: de Araujo, Pedro Henrique Luz, et al.
Pubblicazione: (2025)
No for Some, Yes for Others: Persona Prompts and Other Sources of False Refusal in Language Models
di: Plaza-del-Arco, Flor Miriam, et al.
Pubblicazione: (2025)
di: Plaza-del-Arco, Flor Miriam, et al.
Pubblicazione: (2025)
Hansel: Output Length Controlling Framework for Large Language Models
di: Song, Seoha, et al.
Pubblicazione: (2024)
di: Song, Seoha, et al.
Pubblicazione: (2024)
Sink-Aware Pruning for Diffusion Language Models
di: Myrzakhan, Aidar, et al.
Pubblicazione: (2026)
di: Myrzakhan, Aidar, et al.
Pubblicazione: (2026)
LoSA: Locality Aware Sparse Attention for Block-Wise Diffusion Language Models
di: Xi, Haocheng, et al.
Pubblicazione: (2026)
di: Xi, Haocheng, et al.
Pubblicazione: (2026)
Demystifying OPD: Length Inflation and Stabilization Strategies for Large Language Models
di: Luo, Feng, et al.
Pubblicazione: (2026)
di: Luo, Feng, et al.
Pubblicazione: (2026)
Length-MAX Tokenizer for Language Models
di: Dong, Dong, et al.
Pubblicazione: (2025)
di: Dong, Dong, et al.
Pubblicazione: (2025)
Diffusion LMs Can Approximate Optimal Infilling Lengths Implicitly
di: Liu, Hengchang, et al.
Pubblicazione: (2026)
di: Liu, Hengchang, et al.
Pubblicazione: (2026)
Political Compass or Spinning Arrow? Towards More Meaningful Evaluations for Values and Opinions in Large Language Models
di: Röttger, Paul, et al.
Pubblicazione: (2024)
di: Röttger, Paul, et al.
Pubblicazione: (2024)
Fusion Matters: Length-Aware Analysis of Positional-Encoding Fusion in Transformers
di: Hallam, Mohamed Amine, et al.
Pubblicazione: (2026)
di: Hallam, Mohamed Amine, et al.
Pubblicazione: (2026)
Revisiting Uncertainty Quantification Evaluation in Language Models: Spurious Interactions with Response Length Bias Results
di: Santilli, Andrea, et al.
Pubblicazione: (2025)
di: Santilli, Andrea, et al.
Pubblicazione: (2025)
Entropy Aware Reward Guidance for Diffusion Language Model Alignment
di: Tejaswi, Atula, et al.
Pubblicazione: (2026)
di: Tejaswi, Atula, et al.
Pubblicazione: (2026)
"My Answer is C": First-Token Probabilities Do Not Match Text Answers in Instruction-Tuned Language Models
di: Wang, Xinpeng, et al.
Pubblicazione: (2024)
di: Wang, Xinpeng, et al.
Pubblicazione: (2024)
Beyond the Limits: A Survey of Techniques to Extend the Context Length in Large Language Models
di: Wang, Xindi, et al.
Pubblicazione: (2024)
di: Wang, Xindi, et al.
Pubblicazione: (2024)
The Call for Socially Aware Language Technologies
di: Yang, Diyi, et al.
Pubblicazione: (2024)
di: Yang, Diyi, et al.
Pubblicazione: (2024)
Sequential Diffusion Language Models
di: Liu, Yangzhou, et al.
Pubblicazione: (2025)
di: Liu, Yangzhou, et al.
Pubblicazione: (2025)
Large Language Diffusion Models
di: Nie, Shen, et al.
Pubblicazione: (2025)
di: Nie, Shen, et al.
Pubblicazione: (2025)
Diffusion Guided Language Modeling
di: Lovelace, Justin, et al.
Pubblicazione: (2024)
di: Lovelace, Justin, et al.
Pubblicazione: (2024)
Anchored Diffusion Language Model
di: Rout, Litu, et al.
Pubblicazione: (2025)
di: Rout, Litu, et al.
Pubblicazione: (2025)
LLiMba: Sardinian on a Single GPU -- Adapting a 3B Language Model to a Vanishing Romance Language
di: Ballore, Luca
Pubblicazione: (2026)
di: Ballore, Luca
Pubblicazione: (2026)
Harnessing Large Language Models as Post-hoc Correctors
di: Zhong, Zhiqiang, et al.
Pubblicazione: (2024)
di: Zhong, Zhiqiang, et al.
Pubblicazione: (2024)
TRA: Better Length Generalisation with Threshold Relative Attention
di: Opper, Mattia, et al.
Pubblicazione: (2025)
di: Opper, Mattia, et al.
Pubblicazione: (2025)
On the Optimal Reasoning Length for RL-Trained Language Models
di: Nohara, Daisuke, et al.
Pubblicazione: (2026)
di: Nohara, Daisuke, et al.
Pubblicazione: (2026)
SmartThinker: Progressive Chain-of-Thought Length Calibration for Efficient Large Language Model Reasoning
di: Hu, Chenzhi, et al.
Pubblicazione: (2026)
di: Hu, Chenzhi, et al.
Pubblicazione: (2026)
Cascade-Aware Training of Language Models
di: Wang, Congchao, et al.
Pubblicazione: (2024)
di: Wang, Congchao, et al.
Pubblicazione: (2024)
Diffusion-State Policy Optimization for Masked Diffusion Language Models
di: Oba, Daisuke, et al.
Pubblicazione: (2026)
di: Oba, Daisuke, et al.
Pubblicazione: (2026)
Confidence Regularized Masked Language Modeling using Text Length
di: Ji, Seunghyun, et al.
Pubblicazione: (2025)
di: Ji, Seunghyun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SimBench: Benchmarking the Ability of Large Language Models to Simulate Human Behaviors
di: Hu, Tiancheng, et al.
Pubblicazione: (2025) -
Compromesso! Italian Many-Shot Jailbreaks Undermine the Safety of Large Language Models
di: Pernisi, Fabio, et al.
Pubblicazione: (2024) -
Large Language Model Hacking: Quantifying the Hidden Risks of Using LLMs for Text Annotation
di: Baumann, Joachim, et al.
Pubblicazione: (2025) -
The Pluralistic Moral Gap: Understanding Judgment and Value Differences between Humans and Large Language Models
di: Russo, Giuseppe, et al.
Pubblicazione: (2025) -
SafetyPrompts: a Systematic Review of Open Datasets for Evaluating and Improving Large Language Model Safety
di: Röttger, Paul, et al.
Pubblicazione: (2024)