Your Absorbing Discrete Diffusion Secretly Models the Bayesian Posterior
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Doyle, Cooper |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Your Absorbing Discrete Diffusion Secretly Models the Conditional Distributions of Clean Data
par: Ou, Jingyang, et autres
Publié: (2024)
par: Ou, Jingyang, et autres
Publié: (2024)
Your Transformer is Secretly Linear
par: Razzhigaev, Anton, et autres
Publié: (2024)
par: Razzhigaev, Anton, et autres
Publié: (2024)
Direct Preference Optimization: Your Language Model is Secretly a Reward Model
par: Rafailov, Rafael, et autres
Publié: (2023)
par: Rafailov, Rafael, et autres
Publié: (2023)
LightTransfer: Your Long-Context LLM is Secretly a Hybrid Model with Effortless Adaptation
par: Zhang, Xuan, et autres
Publié: (2024)
par: Zhang, Xuan, et autres
Publié: (2024)
Learning Adapter Rank via Symmetry Breaking
par: Doyle, Cooper, et autres
Publié: (2025)
par: Doyle, Cooper, et autres
Publié: (2025)
Check Your LLM's Secret Dictionary! Five Lines of Code Reveal What Your LLM Learned (Including What It Shouldn't Have)
par: Miyashita, Hisashi
Publié: (2026)
par: Miyashita, Hisashi
Publié: (2026)
$\textit{Jump Your Steps}$: Optimizing Sampling Schedule of Discrete Diffusion Models
par: Park, Yong-Hyun, et autres
Publié: (2024)
par: Park, Yong-Hyun, et autres
Publié: (2024)
Masked Diffusion Models are Secretly Time-Agnostic Masked Models and Exploit Inaccurate Categorical Sampling
par: Zheng, Kaiwen, et autres
Publié: (2024)
par: Zheng, Kaiwen, et autres
Publié: (2024)
Non-Markovian Discrete Diffusion with Causal Language Models
par: Zhang, Yangtian, et autres
Publié: (2025)
par: Zhang, Yangtian, et autres
Publié: (2025)
Generalized Interpolating Discrete Diffusion
par: von Rütte, Dimitri, et autres
Publié: (2025)
par: von Rütte, Dimitri, et autres
Publié: (2025)
Fine-Tuning Discrete Diffusion Models with Policy Gradient Methods
par: Zekri, Oussama, et autres
Publié: (2025)
par: Zekri, Oussama, et autres
Publié: (2025)
Continuous Diffusion Scales Competitively with Discrete Diffusion for Language
par: Yang, Zhihan, et autres
Publié: (2026)
par: Yang, Zhihan, et autres
Publié: (2026)
Generalized Discrete Diffusion from Snapshots
par: Zekri, Oussama, et autres
Publié: (2026)
par: Zekri, Oussama, et autres
Publié: (2026)
Planner and Executor: Collaboration between Discrete Diffusion And Autoregressive Models in Reasoning
par: Berrayana, Lina, et autres
Publié: (2025)
par: Berrayana, Lina, et autres
Publié: (2025)
Syntactic Control of Language Models by Posterior Inference
par: Xefteri, Vicky, et autres
Publié: (2025)
par: Xefteri, Vicky, et autres
Publié: (2025)
Steering Without Breaking: Mechanistically Informed Interventions for Discrete Diffusion Language Models
par: Zhou, Hanhan, et autres
Publié: (2026)
par: Zhou, Hanhan, et autres
Publié: (2026)
Unifying Continuous and Discrete Text Diffusion with Non-simultaneous Diffusion Processes
par: Li, Bocheng, et autres
Publié: (2025)
par: Li, Bocheng, et autres
Publié: (2025)
MetaState: Persistent Working Memory Enhances Reasoning in Discrete Diffusion Language Models
par: Xia, Kejing, et autres
Publié: (2026)
par: Xia, Kejing, et autres
Publié: (2026)
Ultra-Fast Language Generation via Discrete Diffusion Divergence Instruct
par: Zheng, Haoyang, et autres
Publié: (2025)
par: Zheng, Haoyang, et autres
Publié: (2025)
In-Situ Tweedie Discrete Diffusion Models
par: Li, Xiao, et autres
Publié: (2025)
par: Li, Xiao, et autres
Publié: (2025)
Why is Your Language Model a Poor Implicit Reward Model?
par: Razin, Noam, et autres
Publié: (2025)
par: Razin, Noam, et autres
Publié: (2025)
Latent Reasoning in TRMs is Secretly a Policy Improvement Operator
par: Asadulaev, Arip, et autres
Publié: (2025)
par: Asadulaev, Arip, et autres
Publié: (2025)
Censored LLMs as a Natural Testbed for Secret Knowledge Elicitation
par: Casademunt, Helena, et autres
Publié: (2026)
par: Casademunt, Helena, et autres
Publié: (2026)
Intent Factored Generation: Unleashing the Diversity in Your Language Model
par: Ahmed, Eltayeb, et autres
Publié: (2025)
par: Ahmed, Eltayeb, et autres
Publié: (2025)
Flexible-length Text Infilling for Discrete Diffusion Models
par: Zhang, Andrew, et autres
Publié: (2025)
par: Zhang, Andrew, et autres
Publié: (2025)
Is Your Model Fairly Certain? Uncertainty-Aware Fairness Evaluation for LLMs
par: Wang, Yinong Oliver, et autres
Publié: (2025)
par: Wang, Yinong Oliver, et autres
Publié: (2025)
Reasoning with Sampling: Your Base Model is Smarter Than You Think
par: Karan, Aayush, et autres
Publié: (2025)
par: Karan, Aayush, et autres
Publié: (2025)
Should You Use Your Large Language Model to Explore or Exploit?
par: Harris, Keegan, et autres
Publié: (2025)
par: Harris, Keegan, et autres
Publié: (2025)
Teaching Your Models to Understand Code via Focal Preference Alignment
par: Wu, Jie, et autres
Publié: (2025)
par: Wu, Jie, et autres
Publié: (2025)
To Believe or Not to Believe Your LLM
par: Yadkori, Yasin Abbasi, et autres
Publié: (2024)
par: Yadkori, Yasin Abbasi, et autres
Publié: (2024)
Cross-Layer Discrete Concept Discovery for Interpreting Language Models
par: Garg, Ankur, et autres
Publié: (2025)
par: Garg, Ankur, et autres
Publié: (2025)
How to Train Your Advisor: Steering Black-Box LLMs with Advisor Models
par: Asawa, Parth, et autres
Publié: (2025)
par: Asawa, Parth, et autres
Publié: (2025)
Discrete Markov Bridge
par: Li, Hengli, et autres
Publié: (2025)
par: Li, Hengli, et autres
Publié: (2025)
A Notion of Complexity for Theory of Mind via Discrete World Models
par: Huang, X. Angelo, et autres
Publié: (2024)
par: Huang, X. Angelo, et autres
Publié: (2024)
Steering Masked Discrete Diffusion Models via Discrete Denoising Posterior Prediction
par: Rector-Brooks, Jarrid, et autres
Publié: (2024)
par: Rector-Brooks, Jarrid, et autres
Publié: (2024)
Your Finetuned Large Language Model is Already a Powerful Out-of-distribution Detector
par: Zhang, Andi, et autres
Publié: (2024)
par: Zhang, Andi, et autres
Publié: (2024)
UniMoT: Unified Molecule-Text Language Model with Discrete Token Representation
par: Guo, Shuhan, et autres
Publié: (2024)
par: Guo, Shuhan, et autres
Publié: (2024)
How Contaminated Is Your Benchmark? Quantifying Dataset Leakage in Large Language Models with Kernel Divergence
par: Choi, Hyeong Kyu, et autres
Publié: (2025)
par: Choi, Hyeong Kyu, et autres
Publié: (2025)
On Discrete Prompt Optimization for Diffusion Models
par: Wang, Ruochen, et autres
Publié: (2024)
par: Wang, Ruochen, et autres
Publié: (2024)
Not All Synthetic Data Is Yours to Learn From
par: Alemohammad, Sina, et autres
Publié: (2026)
par: Alemohammad, Sina, et autres
Publié: (2026)
Documents similaires
-
Your Absorbing Discrete Diffusion Secretly Models the Conditional Distributions of Clean Data
par: Ou, Jingyang, et autres
Publié: (2024) -
Your Transformer is Secretly Linear
par: Razzhigaev, Anton, et autres
Publié: (2024) -
Direct Preference Optimization: Your Language Model is Secretly a Reward Model
par: Rafailov, Rafael, et autres
Publié: (2023) -
LightTransfer: Your Long-Context LLM is Secretly a Hybrid Model with Effortless Adaptation
par: Zhang, Xuan, et autres
Publié: (2024) -
Learning Adapter Rank via Symmetry Breaking
par: Doyle, Cooper, et autres
Publié: (2025)