Reasoning with Latent Tokens in Diffusion Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | He, Andre, Welleck, Sean, Fried, Daniel |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Rewarding the Unlikely: Lifting GRPO Beyond Distribution Sharpening
di: He, Andre, et al.
Pubblicazione: (2025)
di: He, Andre, et al.
Pubblicazione: (2025)
L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2025)
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2025)
Optimizing Temperature for Language Models with Multi-Sample Inference
di: Du, Weihua, et al.
Pubblicazione: (2025)
di: Du, Weihua, et al.
Pubblicazione: (2025)
Programming with Pixels: Can Computer-Use Agents do Software Engineering?
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2025)
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2025)
miniCodeProps: a Minimal Benchmark for Proving Code Properties
di: Lohn, Evan, et al.
Pubblicazione: (2024)
di: Lohn, Evan, et al.
Pubblicazione: (2024)
Agentic-R1: Distilled Dual-Strategy Reasoning
di: Du, Weihua, et al.
Pubblicazione: (2025)
di: Du, Weihua, et al.
Pubblicazione: (2025)
Gym-Anything: Turn any Software into an Agent Environment
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2026)
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2026)
AlphaVerus: Bootstrapping Formally Verified Code Generation through Self-Improving Translation and Treefinement
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2024)
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2024)
Multimodal Latent Language Modeling with Next-Token Diffusion
di: Sun, Yutao, et al.
Pubblicazione: (2024)
di: Sun, Yutao, et al.
Pubblicazione: (2024)
miniCTX: Neural Theorem Proving with (Long-)Contexts
di: Hu, Jiewen, et al.
Pubblicazione: (2024)
di: Hu, Jiewen, et al.
Pubblicazione: (2024)
Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning
di: Su, DiJia, et al.
Pubblicazione: (2025)
di: Su, DiJia, et al.
Pubblicazione: (2025)
From Decoding to Meta-Generation: Inference-time Algorithms for Large Language Models
di: Welleck, Sean, et al.
Pubblicazione: (2024)
di: Welleck, Sean, et al.
Pubblicazione: (2024)
Implicit Contact Diffuser: Sequential Contact Reasoning with Latent Point Cloud Diffusion
di: Huang, Zixuan, et al.
Pubblicazione: (2024)
di: Huang, Zixuan, et al.
Pubblicazione: (2024)
Latent-DARM: Bridging Discrete Diffusion And Autoregressive Models For Reasoning
di: Berrayana, Lina, et al.
Pubblicazione: (2026)
di: Berrayana, Lina, et al.
Pubblicazione: (2026)
Window-Diffusion: Accelerating Diffusion Language Model Inference with Windowed Token Pruning and Caching
di: Zuo, Fengrui, et al.
Pubblicazione: (2026)
di: Zuo, Fengrui, et al.
Pubblicazione: (2026)
Towards Linguistically-Aware and Language-Independent Tokenization for Large Language Models (LLMs)
di: Rahman, Abrar, et al.
Pubblicazione: (2024)
di: Rahman, Abrar, et al.
Pubblicazione: (2024)
ImProver 2: Iteratively Self-Improving LMs for Neurosymbolic Proof Optimization
di: Ahuja, Riyaz, et al.
Pubblicazione: (2026)
di: Ahuja, Riyaz, et al.
Pubblicazione: (2026)
VFM-VAE: Vision Foundation Models Can Be Good Tokenizers for Latent Diffusion Models
di: Bi, Tianci, et al.
Pubblicazione: (2025)
di: Bi, Tianci, et al.
Pubblicazione: (2025)
Guiding Language Model Reasoning with Planning Tokens
di: Wang, Xinyi, et al.
Pubblicazione: (2023)
di: Wang, Xinyi, et al.
Pubblicazione: (2023)
Repetition Improves Language Model Embeddings
di: Springer, Jacob Mitchell, et al.
Pubblicazione: (2024)
di: Springer, Jacob Mitchell, et al.
Pubblicazione: (2024)
GradAlign: Gradient-Aligned Data Selection for LLM Reinforcement Learning
di: Yang, Ningyuan, et al.
Pubblicazione: (2026)
di: Yang, Ningyuan, et al.
Pubblicazione: (2026)
Are Latent Reasoning Models Easily Interpretable?
di: Dilgren, Connor, et al.
Pubblicazione: (2026)
di: Dilgren, Connor, et al.
Pubblicazione: (2026)
Enhancing Latent Computation in Transformers with Latent Tokens
di: Sun, Yuchang, et al.
Pubblicazione: (2025)
di: Sun, Yuchang, et al.
Pubblicazione: (2025)
Rethinking Token Prediction: Tree-Structured Diffusion Language Model
di: Wu, Zihao, et al.
Pubblicazione: (2026)
di: Wu, Zihao, et al.
Pubblicazione: (2026)
LEPO: Latent Reasoning Policy Optimization for Large Language Models
di: Zhou, Yuyan, et al.
Pubblicazione: (2026)
di: Zhou, Yuyan, et al.
Pubblicazione: (2026)
Tree Search for Language Model Agents
di: Koh, Jing Yu, et al.
Pubblicazione: (2024)
di: Koh, Jing Yu, et al.
Pubblicazione: (2024)
LanteRn: Latent Visual Structured Reasoning
di: Viveiros, André G., et al.
Pubblicazione: (2026)
di: Viveiros, André G., et al.
Pubblicazione: (2026)
Hyper-Transforming Latent Diffusion Models
di: Peis, Ignacio, et al.
Pubblicazione: (2025)
di: Peis, Ignacio, et al.
Pubblicazione: (2025)
Optimal Stopping in Latent Diffusion Models
di: Wu, Yu-Han, et al.
Pubblicazione: (2025)
di: Wu, Yu-Han, et al.
Pubblicazione: (2025)
Latent Abstractions in Generative Diffusion Models
di: Franzese, Giulio, et al.
Pubblicazione: (2024)
di: Franzese, Giulio, et al.
Pubblicazione: (2024)
Improving Reasoning for Diffusion Language Models via Group Diffusion Policy Optimization
di: Rojas, Kevin, et al.
Pubblicazione: (2025)
di: Rojas, Kevin, et al.
Pubblicazione: (2025)
TokUR: Token-Level Uncertainty Estimation for Large Language Model Reasoning
di: Zhang, Tunyu, et al.
Pubblicazione: (2025)
di: Zhang, Tunyu, et al.
Pubblicazione: (2025)
Just on Time: Token-Level Early Stopping for Diffusion Language Models
di: Kohut, Zahar, et al.
Pubblicazione: (2026)
di: Kohut, Zahar, et al.
Pubblicazione: (2026)
REED-VAE: RE-Encode Decode Training for Iterative Image Editing with Diffusion Models
di: Almog, Gal, et al.
Pubblicazione: (2025)
di: Almog, Gal, et al.
Pubblicazione: (2025)
Exploring Token-Space Manipulation in Latent Audio Tokenizers
di: Paissan, Francesco, et al.
Pubblicazione: (2026)
di: Paissan, Francesco, et al.
Pubblicazione: (2026)
Stop-Think-AutoRegress: Language Modeling with Latent Diffusion Planning
di: Lovelace, Justin, et al.
Pubblicazione: (2026)
di: Lovelace, Justin, et al.
Pubblicazione: (2026)
On the Limits of Latent Reuse in Diffusion Models
di: Yu, Yifeng, et al.
Pubblicazione: (2026)
di: Yu, Yifeng, et al.
Pubblicazione: (2026)
Premise Selection for a Lean Hammer
di: Zhu, Thomas, et al.
Pubblicazione: (2025)
di: Zhu, Thomas, et al.
Pubblicazione: (2025)
Exploring and Exploiting Stability in Latent Flow Matching
di: Briq, Rania, et al.
Pubblicazione: (2026)
di: Briq, Rania, et al.
Pubblicazione: (2026)
SaDiT: Efficient Protein Backbone Design via Latent Structural Tokenization and Diffusion Transformers
di: Mo, Shentong, et al.
Pubblicazione: (2026)
di: Mo, Shentong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Rewarding the Unlikely: Lifting GRPO Beyond Distribution Sharpening
di: He, Andre, et al.
Pubblicazione: (2025) -
L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2025) -
Optimizing Temperature for Language Models with Multi-Sample Inference
di: Du, Weihua, et al.
Pubblicazione: (2025) -
Programming with Pixels: Can Computer-Use Agents do Software Engineering?
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2025) -
miniCodeProps: a Minimal Benchmark for Proving Code Properties
di: Lohn, Evan, et al.
Pubblicazione: (2024)