Diffusion Guided Language Modeling
Fuente:
arXiv
Guardado en:
| Autores principales: | Lovelace, Justin, Kishore, Varsha, Chen, Yiwei, Weinberger, Kilian Q. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
IncDSI: Incrementally Updatable Document Retrieval
por: Kishore, Varsha, et al.
Publicado: (2023)
por: Kishore, Varsha, et al.
Publicado: (2023)
Stop-Think-AutoRegress: Language Modeling with Latent Diffusion Planning
por: Lovelace, Justin, et al.
Publicado: (2026)
por: Lovelace, Justin, et al.
Publicado: (2026)
Prescriptive Scaling Laws for Data Constrained Training
por: Lovelace, Justin, et al.
Publicado: (2026)
por: Lovelace, Justin, et al.
Publicado: (2026)
Adaptive Moments are Surprisingly Effective for Plug-and-Play Diffusion Sampling
por: Belardi, Christian, et al.
Publicado: (2026)
por: Belardi, Christian, et al.
Publicado: (2026)
Pre-training Limited Memory Language Models with Internal and External Knowledge
por: Zhao, Linxi, et al.
Publicado: (2025)
por: Zhao, Linxi, et al.
Publicado: (2025)
Sample-Efficient Diffusion for Text-To-Speech Synthesis
por: Lovelace, Justin, et al.
Publicado: (2024)
por: Lovelace, Justin, et al.
Publicado: (2024)
Correction with Backtracking Reduces Hallucination in Summarization
por: Liu, Zhenzhen, et al.
Publicado: (2023)
por: Liu, Zhenzhen, et al.
Publicado: (2023)
SpeechOp: Inference-Time Task Composition for Generative Speech Processing
por: Lovelace, Justin, et al.
Publicado: (2025)
por: Lovelace, Justin, et al.
Publicado: (2025)
Don't Trust: Verify -- Grounding LLM Quantitative Reasoning with Autoformalization
por: Zhou, Jin Peng, et al.
Publicado: (2024)
por: Zhou, Jin Peng, et al.
Publicado: (2024)
Scaling Beyond Masked Diffusion Language Models
por: Sahoo, Subham Sekhar, et al.
Publicado: (2026)
por: Sahoo, Subham Sekhar, et al.
Publicado: (2026)
On the Effectiveness of Large Language Models in Automating Categorization of Scientific Texts
por: Shahi, Gautam Kishore, et al.
Publicado: (2025)
por: Shahi, Gautam Kishore, et al.
Publicado: (2025)
$Q\sharp$: Provably Optimal Distributional RL for LLM Post-Training
por: Zhou, Jin Peng, et al.
Publicado: (2025)
por: Zhou, Jin Peng, et al.
Publicado: (2025)
Music Transcription with (Almost) No Supervision
por: Shin, Saebyeol, et al.
Publicado: (2026)
por: Shin, Saebyeol, et al.
Publicado: (2026)
Re-evaluating the Need for Multimodal Signals in Unsupervised Grammar Induction
por: Li, Boyi, et al.
Publicado: (2022)
por: Li, Boyi, et al.
Publicado: (2022)
Sequential Diffusion Language Models
por: Liu, Yangzhou, et al.
Publicado: (2025)
por: Liu, Yangzhou, et al.
Publicado: (2025)
An Empirical Comparison of Vocabulary Expansion and Initialization Approaches for Language Models
por: Mundra, Nandini, et al.
Publicado: (2024)
por: Mundra, Nandini, et al.
Publicado: (2024)
PhantomWiki: On-Demand Datasets for Reasoning and Retrieval Evaluation
por: Gong, Albert, et al.
Publicado: (2025)
por: Gong, Albert, et al.
Publicado: (2025)
Attention-Based Sampler for Diffusion Language Models
por: Zhou, Yuyan, et al.
Publicado: (2026)
por: Zhou, Yuyan, et al.
Publicado: (2026)
LogicDiff: Logic-Guided Denoising Improves Zero-Shot Reasoning in Masked Diffusion Language Models
por: Aman, Shaik
Publicado: (2026)
por: Aman, Shaik
Publicado: (2026)
Distribution-Aware Reward: Reinforcement Learning over Predictive Distributions for LLM Regression
por: Park, Jungsoo, et al.
Publicado: (2026)
por: Park, Jungsoo, et al.
Publicado: (2026)
Simple and Effective Masked Diffusion Language Models
por: Sahoo, Subham Sekhar, et al.
Publicado: (2024)
por: Sahoo, Subham Sekhar, et al.
Publicado: (2024)
DPad: Efficient Diffusion Language Models with Suffix Dropout
por: Chen, Xinhua, et al.
Publicado: (2025)
por: Chen, Xinhua, et al.
Publicado: (2025)
Learning from Synthetic Data Improves Multi-hop Reasoning
por: Kabra, Anmol, et al.
Publicado: (2026)
por: Kabra, Anmol, et al.
Publicado: (2026)
Large Language Diffusion Models
por: Nie, Shen, et al.
Publicado: (2025)
por: Nie, Shen, et al.
Publicado: (2025)
Anchored Diffusion Language Model
por: Rout, Litu, et al.
Publicado: (2025)
por: Rout, Litu, et al.
Publicado: (2025)
Promises and Pitfalls of Generative Masked Language Modeling: Theoretical Framework and Practical Guidelines
por: Li, Yuchen, et al.
Publicado: (2024)
por: Li, Yuchen, et al.
Publicado: (2024)
DLM-One: Diffusion Language Models for One-Step Sequence Generation
por: Chen, Tianqi, et al.
Publicado: (2025)
por: Chen, Tianqi, et al.
Publicado: (2025)
Diffusion-State Policy Optimization for Masked Diffusion Language Models
por: Oba, Daisuke, et al.
Publicado: (2026)
por: Oba, Daisuke, et al.
Publicado: (2026)
3M-Diffusion: Latent Multi-Modal Diffusion for Language-Guided Molecular Structure Generation
por: Zhu, Huaisheng, et al.
Publicado: (2024)
por: Zhu, Huaisheng, et al.
Publicado: (2024)
LangFlow: Continuous Diffusion Rivals Discrete in Language Modeling
por: Chen, Yuxin, et al.
Publicado: (2026)
por: Chen, Yuxin, et al.
Publicado: (2026)
DICE: Diffusion Large Language Models Excel at Generating CUDA Kernels
por: Bai, Haolei, et al.
Publicado: (2026)
por: Bai, Haolei, et al.
Publicado: (2026)
Forcing Diffuse Distributions out of Language Models
por: Zhang, Yiming, et al.
Publicado: (2024)
por: Zhang, Yiming, et al.
Publicado: (2024)
Diffusion Language Models Are Natively Length-Aware
por: Rossi, Vittorio, et al.
Publicado: (2026)
por: Rossi, Vittorio, et al.
Publicado: (2026)
Stability-Weighted Decoding for Diffusion Language Models
por: Wu, Yue, et al.
Publicado: (2026)
por: Wu, Yue, et al.
Publicado: (2026)
Boundary-Guided Policy Optimization for Memory-efficient RL of Diffusion Large Language Models
por: Lin, Nianyi, et al.
Publicado: (2025)
por: Lin, Nianyi, et al.
Publicado: (2025)
End-to-End Ontology Learning with Large Language Models
por: Lo, Andy, et al.
Publicado: (2024)
por: Lo, Andy, et al.
Publicado: (2024)
MUStReason: A Benchmark for Diagnosing Pragmatic Reasoning in Video-LMs for Multimodal Sarcasm Detection
por: Saha, Anisha, et al.
Publicado: (2025)
por: Saha, Anisha, et al.
Publicado: (2025)
How to Make Large Language Models Generate 100% Valid Molecules?
por: Tao, Wen, et al.
Publicado: (2025)
por: Tao, Wen, et al.
Publicado: (2025)
A Survey on Diffusion Language Models
por: Li, Tianyi, et al.
Publicado: (2025)
por: Li, Tianyi, et al.
Publicado: (2025)
Expert-Choice Routing Enables Adaptive Computation in Diffusion Language Models
por: Zhang, Shuibai, et al.
Publicado: (2026)
por: Zhang, Shuibai, et al.
Publicado: (2026)
Ejemplares similares
-
IncDSI: Incrementally Updatable Document Retrieval
por: Kishore, Varsha, et al.
Publicado: (2023) -
Stop-Think-AutoRegress: Language Modeling with Latent Diffusion Planning
por: Lovelace, Justin, et al.
Publicado: (2026) -
Prescriptive Scaling Laws for Data Constrained Training
por: Lovelace, Justin, et al.
Publicado: (2026) -
Adaptive Moments are Surprisingly Effective for Plug-and-Play Diffusion Sampling
por: Belardi, Christian, et al.
Publicado: (2026) -
Pre-training Limited Memory Language Models with Internal and External Knowledge
por: Zhao, Linxi, et al.
Publicado: (2025)