Stop-Think-AutoRegress: Language Modeling with Latent Diffusion Planning
Fuente:
arXiv
Salvato in:
| Autori principali: | Lovelace, Justin, Belardi, Christian, Zalouk, Sofian, Polavaram, Adhitya, Kundurthy, Srivatsa, Weinberger, Kilian Q. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Prescriptive Scaling Laws for Data Constrained Training
di: Lovelace, Justin, et al.
Pubblicazione: (2026)
di: Lovelace, Justin, et al.
Pubblicazione: (2026)
Pre-training Limited Memory Language Models with Internal and External Knowledge
di: Zhao, Linxi, et al.
Pubblicazione: (2025)
di: Zhao, Linxi, et al.
Pubblicazione: (2025)
Diffusion Guided Language Modeling
di: Lovelace, Justin, et al.
Pubblicazione: (2024)
di: Lovelace, Justin, et al.
Pubblicazione: (2024)
Adaptive Moments are Surprisingly Effective for Plug-and-Play Diffusion Sampling
di: Belardi, Christian, et al.
Pubblicazione: (2026)
di: Belardi, Christian, et al.
Pubblicazione: (2026)
IncDSI: Incrementally Updatable Document Retrieval
di: Kishore, Varsha, et al.
Pubblicazione: (2023)
di: Kishore, Varsha, et al.
Pubblicazione: (2023)
Sample-Efficient Diffusion for Text-To-Speech Synthesis
di: Lovelace, Justin, et al.
Pubblicazione: (2024)
di: Lovelace, Justin, et al.
Pubblicazione: (2024)
LinkD: AutoRegressive Diffusion Model for Mechanical Linkage Synthesis
di: Jadhav, Yayati, et al.
Pubblicazione: (2026)
di: Jadhav, Yayati, et al.
Pubblicazione: (2026)
NoiseAR: AutoRegressing Initial Noise Prior for Diffusion Models
di: Li, Zeming, et al.
Pubblicazione: (2025)
di: Li, Zeming, et al.
Pubblicazione: (2025)
Privacy Attacks on Image AutoRegressive Models
di: Kowalczuk, Antoni, et al.
Pubblicazione: (2025)
di: Kowalczuk, Antoni, et al.
Pubblicazione: (2025)
On Speeding Up Language Model Evaluation
di: Zhou, Jin Peng, et al.
Pubblicazione: (2024)
di: Zhou, Jin Peng, et al.
Pubblicazione: (2024)
Implementing Adaptations for Vision AutoRegressive Model
di: Shaikh, Kaif, et al.
Pubblicazione: (2025)
di: Shaikh, Kaif, et al.
Pubblicazione: (2025)
SpeechOp: Inference-Time Task Composition for Generative Speech Processing
di: Lovelace, Justin, et al.
Pubblicazione: (2025)
di: Lovelace, Justin, et al.
Pubblicazione: (2025)
SDAR: A Synergistic Diffusion-AutoRegression Paradigm for Scalable Sequence Generation
di: Cheng, Shuang, et al.
Pubblicazione: (2025)
di: Cheng, Shuang, et al.
Pubblicazione: (2025)
Bayesian Vector AutoRegression with Factorised Granger-Causal Graphs
di: Zhao, He, et al.
Pubblicazione: (2024)
di: Zhao, He, et al.
Pubblicazione: (2024)
MVAR: MultiVariate AutoRegressive Air Pollutants Forecasting Model
di: Fan, Xu, et al.
Pubblicazione: (2025)
di: Fan, Xu, et al.
Pubblicazione: (2025)
Nested AutoRegressive Models
di: Wu, Hongyu, et al.
Pubblicazione: (2025)
di: Wu, Hongyu, et al.
Pubblicazione: (2025)
SpreadsheetArena: Decomposing Preference in LLM Generation of Spreadsheet Workbooks
di: Kundurthy, Srivatsa, et al.
Pubblicazione: (2026)
di: Kundurthy, Srivatsa, et al.
Pubblicazione: (2026)
Lossless Vocabulary Reduction for Auto-Regressive Language Models
di: Chijiwa, Daiki, et al.
Pubblicazione: (2025)
di: Chijiwa, Daiki, et al.
Pubblicazione: (2025)
Just on Time: Token-Level Early Stopping for Diffusion Language Models
di: Kohut, Zahar, et al.
Pubblicazione: (2026)
di: Kohut, Zahar, et al.
Pubblicazione: (2026)
Efficient Context Propagating Perceiver Architectures for Auto-Regressive Language Modeling
di: Mahmood, Kaleel, et al.
Pubblicazione: (2024)
di: Mahmood, Kaleel, et al.
Pubblicazione: (2024)
Don't Trust: Verify -- Grounding LLM Quantitative Reasoning with Autoformalization
di: Zhou, Jin Peng, et al.
Pubblicazione: (2024)
di: Zhou, Jin Peng, et al.
Pubblicazione: (2024)
Music Transcription with (Almost) No Supervision
di: Shin, Saebyeol, et al.
Pubblicazione: (2026)
di: Shin, Saebyeol, et al.
Pubblicazione: (2026)
The Illusion of Superposition? A Principled Analysis of Latent Thinking in Language Models
di: Rizvi-Martel, Michael, et al.
Pubblicazione: (2026)
di: Rizvi-Martel, Michael, et al.
Pubblicazione: (2026)
Parallel Token Prediction for Language Models
di: Draxler, Felix, et al.
Pubblicazione: (2025)
di: Draxler, Felix, et al.
Pubblicazione: (2025)
AutoRegressive Generation with B-rep Holistic Token Sequence Representation
di: Li, Jiahao, et al.
Pubblicazione: (2026)
di: Li, Jiahao, et al.
Pubblicazione: (2026)
BARD: Bridging AutoRegressive and Diffusion Vision-Language Models Via Highly Efficient Progressive Block Merging and Stage-Wise Distillation
di: Chen, Baoyou, et al.
Pubblicazione: (2026)
di: Chen, Baoyou, et al.
Pubblicazione: (2026)
VARADE: a Variational-based AutoRegressive model for Anomaly Detection on the Edge
di: Mascolini, Alessio, et al.
Pubblicazione: (2024)
di: Mascolini, Alessio, et al.
Pubblicazione: (2024)
Imitation Learning for Multi-turn LM Agents via On-policy Expert Corrections
di: Lauffer, Niklas, et al.
Pubblicazione: (2025)
di: Lauffer, Niklas, et al.
Pubblicazione: (2025)
SparVAR: Exploring Sparsity in Visual AutoRegressive Modeling for Training-Free Acceleration
di: Li, Zekun, et al.
Pubblicazione: (2026)
di: Li, Zekun, et al.
Pubblicazione: (2026)
Improving Multislice Electron Ptychography with a Generative Prior
di: Belardi, Christian K., et al.
Pubblicazione: (2025)
di: Belardi, Christian K., et al.
Pubblicazione: (2025)
Numerical Words and Linguistic Loops: The Perpetual Four-Letter Routine
di: Polavaram, Krishna Chaitanya
Pubblicazione: (2025)
di: Polavaram, Krishna Chaitanya
Pubblicazione: (2025)
EMO: Earth Mover Distance Optimization for Auto-Regressive Language Modeling
di: Ren, Siyu, et al.
Pubblicazione: (2023)
di: Ren, Siyu, et al.
Pubblicazione: (2023)
Optimal Stopping in Latent Diffusion Models
di: Wu, Yu-Han, et al.
Pubblicazione: (2025)
di: Wu, Yu-Han, et al.
Pubblicazione: (2025)
Auto-Regressive Next-Token Predictors are Universal Learners
di: Malach, Eran
Pubblicazione: (2023)
di: Malach, Eran
Pubblicazione: (2023)
Thinking into the Future: Latent Lookahead Training for Transformers
di: Noci, Lorenzo, et al.
Pubblicazione: (2026)
di: Noci, Lorenzo, et al.
Pubblicazione: (2026)
The Depth Ceiling: On the Limits of Large Language Models in Discovering Latent Planning
di: Xu, Yi, et al.
Pubblicazione: (2026)
di: Xu, Yi, et al.
Pubblicazione: (2026)
On the Thinking-Language Modeling Gap in Large Language Models
di: Liu, Chenxi, et al.
Pubblicazione: (2025)
di: Liu, Chenxi, et al.
Pubblicazione: (2025)
Stopping Computation for Converged Tokens in Masked Diffusion-LM Decoding
di: Oba, Daisuke, et al.
Pubblicazione: (2026)
di: Oba, Daisuke, et al.
Pubblicazione: (2026)
AMLNet: Adversarial Mutual Learning Neural Network for Non-AutoRegressive Multi-Horizon Time Series Forecasting
di: Lin, Yang
Pubblicazione: (2023)
di: Lin, Yang
Pubblicazione: (2023)
Task Generalization With AutoRegressive Compositional Structure: Can Learning From $D$ Tasks Generalize to $D^{T}$ Tasks?
di: Abedsoltan, Amirhesam, et al.
Pubblicazione: (2025)
di: Abedsoltan, Amirhesam, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Prescriptive Scaling Laws for Data Constrained Training
di: Lovelace, Justin, et al.
Pubblicazione: (2026) -
Pre-training Limited Memory Language Models with Internal and External Knowledge
di: Zhao, Linxi, et al.
Pubblicazione: (2025) -
Diffusion Guided Language Modeling
di: Lovelace, Justin, et al.
Pubblicazione: (2024) -
Adaptive Moments are Surprisingly Effective for Plug-and-Play Diffusion Sampling
di: Belardi, Christian, et al.
Pubblicazione: (2026) -
IncDSI: Incrementally Updatable Document Retrieval
di: Kishore, Varsha, et al.
Pubblicazione: (2023)