Diffusion LMs Can Approximate Optimal Infilling Lengths Implicitly
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Hengchang, Yang, Zhao, Su, Bing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Enabling Approximate Joint Sampling in Diffusion LMs
di: Bansal, Parikshit, et al.
Pubblicazione: (2025)
di: Bansal, Parikshit, et al.
Pubblicazione: (2025)
Planning-Aware Code Infilling via Horizon-Length Prediction
di: Ding, Yifeng, et al.
Pubblicazione: (2024)
di: Ding, Yifeng, et al.
Pubblicazione: (2024)
Self-Infilling Code Generation
di: Zheng, Lin, et al.
Pubblicazione: (2023)
di: Zheng, Lin, et al.
Pubblicazione: (2023)
SoftLMs: Efficient Adaptive Low-Rank Approximation of Language Models using Soft-Thresholding Mechanism
di: Bhatnagar, Priyansh, et al.
Pubblicazione: (2024)
di: Bhatnagar, Priyansh, et al.
Pubblicazione: (2024)
Compositional preference models for aligning LMs
di: Go, Dongyoung, et al.
Pubblicazione: (2023)
di: Go, Dongyoung, et al.
Pubblicazione: (2023)
Flexible-length Text Infilling for Discrete Diffusion Models
di: Zhang, Andrew, et al.
Pubblicazione: (2025)
di: Zhang, Andrew, et al.
Pubblicazione: (2025)
D3LM: A Discrete DNA Diffusion Language Model for Bidirectional DNA Understanding and Generation
di: Yang, Zhao, et al.
Pubblicazione: (2026)
di: Yang, Zhao, et al.
Pubblicazione: (2026)
Entropy-Aligned Decoding of LMs for Better Writing and Reasoning
di: Ahmed, Kareem, et al.
Pubblicazione: (2026)
di: Ahmed, Kareem, et al.
Pubblicazione: (2026)
Training Bilingual LMs with Data Constraints in the Targeted Language
di: Seto, Skyler, et al.
Pubblicazione: (2024)
di: Seto, Skyler, et al.
Pubblicazione: (2024)
Improving Variable-Length Generation in Diffusion Language Models via Length Regularization
di: Cheng, Zicong, et al.
Pubblicazione: (2026)
di: Cheng, Zicong, et al.
Pubblicazione: (2026)
Learning How to Ask: Querying LMs with Mixtures of Soft Prompts
di: Qin, Guanghui, et al.
Pubblicazione: (2021)
di: Qin, Guanghui, et al.
Pubblicazione: (2021)
Extracting Training Data from Diffusion Language Models via Infilling
di: Wang, Yihan, et al.
Pubblicazione: (2026)
di: Wang, Yihan, et al.
Pubblicazione: (2026)
Reflect-RL: Two-Player Online RL Fine-Tuning for LMs
di: Zhou, Runlong, et al.
Pubblicazione: (2024)
di: Zhou, Runlong, et al.
Pubblicazione: (2024)
Diffusion Language Models Are Natively Length-Aware
di: Rossi, Vittorio, et al.
Pubblicazione: (2026)
di: Rossi, Vittorio, et al.
Pubblicazione: (2026)
MUStReason: A Benchmark for Diagnosing Pragmatic Reasoning in Video-LMs for Multimodal Sarcasm Detection
di: Saha, Anisha, et al.
Pubblicazione: (2025)
di: Saha, Anisha, et al.
Pubblicazione: (2025)
Grounded Token Initialization for New Vocabulary in LMs for Generative Recommendation
di: Chen, Daiwei, et al.
Pubblicazione: (2026)
di: Chen, Daiwei, et al.
Pubblicazione: (2026)
Beyond Binary Rewards: Training LMs to Reason About Their Uncertainty
di: Damani, Mehul, et al.
Pubblicazione: (2025)
di: Damani, Mehul, et al.
Pubblicazione: (2025)
Transformers Can Achieve Length Generalization But Not Robustly
di: Zhou, Yongchao, et al.
Pubblicazione: (2024)
di: Zhou, Yongchao, et al.
Pubblicazione: (2024)
A Little Help Goes a Long Way: Efficient LLM Training by Leveraging Small LMs
di: Rawat, Ankit Singh, et al.
Pubblicazione: (2024)
di: Rawat, Ankit Singh, et al.
Pubblicazione: (2024)
When Thoughts Meet Facts: Reusable Reasoning for Long-Context LMs
di: Jeong, Soyeong, et al.
Pubblicazione: (2025)
di: Jeong, Soyeong, et al.
Pubblicazione: (2025)
Intrinsic Entropy of Context Length Scaling in LLMs
di: Shi, Jingzhe, et al.
Pubblicazione: (2025)
di: Shi, Jingzhe, et al.
Pubblicazione: (2025)
Addressing the Ecological Fallacy in Larger LMs with Human Context
di: Soni, Nikita, et al.
Pubblicazione: (2026)
di: Soni, Nikita, et al.
Pubblicazione: (2026)
Length-MAX Tokenizer for Language Models
di: Dong, Dong, et al.
Pubblicazione: (2025)
di: Dong, Dong, et al.
Pubblicazione: (2025)
Length Desensitization in Direct Preference Optimization
di: Liu, Wei, et al.
Pubblicazione: (2024)
di: Liu, Wei, et al.
Pubblicazione: (2024)
On the Optimal Reasoning Length for RL-Trained Language Models
di: Nohara, Daisuke, et al.
Pubblicazione: (2026)
di: Nohara, Daisuke, et al.
Pubblicazione: (2026)
Multi-Layer Transformers Gradient Can be Approximated in Almost Linear Time
di: Liang, Yingyu, et al.
Pubblicazione: (2024)
di: Liang, Yingyu, et al.
Pubblicazione: (2024)
Diffusion Language Models Generation Can Be Halted Early
di: Vaina, Sofia Maria Lo Cicero, et al.
Pubblicazione: (2023)
di: Vaina, Sofia Maria Lo Cicero, et al.
Pubblicazione: (2023)
Efficient Parallel Samplers for Recurrent-Depth Models and Their Connection to Diffusion Language Models
di: Geiping, Jonas, et al.
Pubblicazione: (2025)
di: Geiping, Jonas, et al.
Pubblicazione: (2025)
Exploratory Preference Optimization: Harnessing Implicit Q*-Approximation for Sample-Efficient RLHF
di: Xie, Tengyang, et al.
Pubblicazione: (2024)
di: Xie, Tengyang, et al.
Pubblicazione: (2024)
Skip-Connected Policy Optimization for Implicit Advantage
di: Teng, Fengwei, et al.
Pubblicazione: (2026)
di: Teng, Fengwei, et al.
Pubblicazione: (2026)
Can an LLM Induce a Graph? Investigating Memory Drift and Context Length
di: Yousuf, Raquib Bin, et al.
Pubblicazione: (2025)
di: Yousuf, Raquib Bin, et al.
Pubblicazione: (2025)
Bootstrapping Language Models with DPO Implicit Rewards
di: Chen, Changyu, et al.
Pubblicazione: (2024)
di: Chen, Changyu, et al.
Pubblicazione: (2024)
ImProver 2: Iteratively Self-Improving LMs for Neurosymbolic Proof Optimization
di: Ahuja, Riyaz, et al.
Pubblicazione: (2026)
di: Ahuja, Riyaz, et al.
Pubblicazione: (2026)
One Pass Streaming Algorithm for Super Long Token Attention Approximation in Sublinear Space
di: Addanki, Raghav, et al.
Pubblicazione: (2023)
di: Addanki, Raghav, et al.
Pubblicazione: (2023)
Parallelizing Linear Transformers with the Delta Rule over Sequence Length
di: Yang, Songlin, et al.
Pubblicazione: (2024)
di: Yang, Songlin, et al.
Pubblicazione: (2024)
On Provable Length and Compositional Generalization
di: Ahuja, Kartik, et al.
Pubblicazione: (2024)
di: Ahuja, Kartik, et al.
Pubblicazione: (2024)
SELF: Self-Extend the Context Length With Logistic Growth Function
di: Dang, Phat Thanh, et al.
Pubblicazione: (2025)
di: Dang, Phat Thanh, et al.
Pubblicazione: (2025)
Implicit Geometry of Next-token Prediction: From Language Sparsity Patterns to Model Representations
di: Zhao, Yize, et al.
Pubblicazione: (2024)
di: Zhao, Yize, et al.
Pubblicazione: (2024)
BERT-ASC: Auxiliary-Sentence Construction for Implicit Aspect Learning in Sentiment Analysis
di: Ahmed, Murtadha, et al.
Pubblicazione: (2022)
di: Ahmed, Murtadha, et al.
Pubblicazione: (2022)
Bridging Kolmogorov Complexity and Deep Learning: Asymptotically Optimal Description Length Objectives for Transformers
di: Shaw, Peter, et al.
Pubblicazione: (2025)
di: Shaw, Peter, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Enabling Approximate Joint Sampling in Diffusion LMs
di: Bansal, Parikshit, et al.
Pubblicazione: (2025) -
Planning-Aware Code Infilling via Horizon-Length Prediction
di: Ding, Yifeng, et al.
Pubblicazione: (2024) -
Self-Infilling Code Generation
di: Zheng, Lin, et al.
Pubblicazione: (2023) -
SoftLMs: Efficient Adaptive Low-Rank Approximation of Language Models using Soft-Thresholding Mechanism
di: Bhatnagar, Priyansh, et al.
Pubblicazione: (2024) -
Compositional preference models for aligning LMs
di: Go, Dongyoung, et al.
Pubblicazione: (2023)