Latent Thinking Optimization: Your Latent Reasoning Language Model Secretly Encodes Reward Signals in Its Latent Thoughts
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Du, Hanwen, Dong, Yuxin, Ning, Xia |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Thinking Without Words: Efficient Latent Reasoning with Abstract Chain-of-Thought
par: Ramji, Keshav, et autres
Publié: (2026)
par: Ramji, Keshav, et autres
Publié: (2026)
Thinking on the Fly: Test-Time Reasoning Enhancement via Latent Thought Policy Optimization
par: Ye, Wengao, et autres
Publié: (2025)
par: Ye, Wengao, et autres
Publié: (2025)
Reasoning Beyond Language: A Comprehensive Survey on Latent Chain-of-Thought Reasoning
par: Chen, Xinghao, et autres
Publié: (2025)
par: Chen, Xinghao, et autres
Publié: (2025)
Latent Thoughts Tuning: Bridging Context and Reasoning with Fused Information in Latent Tokens
par: Liu, Weihao, et autres
Publié: (2026)
par: Liu, Weihao, et autres
Publié: (2026)
How to Train Your Latent Diffusion Language Model Jointly With the Latent Space
par: Meshchaninov, Viacheslav, et autres
Publié: (2026)
par: Meshchaninov, Viacheslav, et autres
Publié: (2026)
Latent Sketchpad: Sketching Visual Thoughts to Elicit Multimodal Reasoning in MLLMs
par: Zhang, Huanyu, et autres
Publié: (2025)
par: Zhang, Huanyu, et autres
Publié: (2025)
Latent Chain-of-Thought for Visual Reasoning
par: Sun, Guohao, et autres
Publié: (2025)
par: Sun, Guohao, et autres
Publié: (2025)
Latent Reasoning with Supervised Thinking States
par: Amos, Ido, et autres
Publié: (2026)
par: Amos, Ido, et autres
Publié: (2026)
Thoughts-as-Planning: Latent World Models for Chain-of-Thoughts Optimization via Reinforcement Planning
par: Liu, Dong, et autres
Publié: (2026)
par: Liu, Dong, et autres
Publié: (2026)
Reasoning to Learn from Latent Thoughts
par: Ruan, Yangjun, et autres
Publié: (2025)
par: Ruan, Yangjun, et autres
Publié: (2025)
Language as a Latent Variable for Reasoning Optimization
par: Wu, Linjuan, et autres
Publié: (2026)
par: Wu, Linjuan, et autres
Publié: (2026)
Beyond Chains of Thought: Benchmarking Latent-Space Reasoning Abilities in Large Language Models
par: Hagendorff, Thilo, et autres
Publié: (2025)
par: Hagendorff, Thilo, et autres
Publié: (2025)
LatentChem: From Textual CoT to Latent Thinking in Chemical Reasoning
par: Ye, Xinwu, et autres
Publié: (2026)
par: Ye, Xinwu, et autres
Publié: (2026)
Latent-GRPO: Group Relative Policy Optimization for Latent Reasoning
par: Deng, Jingcheng, et autres
Publié: (2026)
par: Deng, Jingcheng, et autres
Publié: (2026)
Uncovering Latent Chain of Thought Vectors in Language Models
par: Zhang, Jason, et autres
Publié: (2024)
par: Zhang, Jason, et autres
Publié: (2024)
Reasoning with Latent Thoughts: On the Power of Looped Transformers
par: Saunshi, Nikunj, et autres
Publié: (2025)
par: Saunshi, Nikunj, et autres
Publié: (2025)
LaRS: Latent Reasoning Skills for Chain-of-Thought Reasoning
par: Xu, Zifan, et autres
Publié: (2023)
par: Xu, Zifan, et autres
Publié: (2023)
SPOT: Span-level Pause-of-Thought for Efficient and Interpretable Latent Reasoning in Large Language Models
par: Chu, Yunlong, et autres
Publié: (2026)
par: Chu, Yunlong, et autres
Publié: (2026)
Reasoning Beyond Chain-of-Thought: A Latent Computational Mode in Large Language Models
par: He, Zhenghao, et autres
Publié: (2026)
par: He, Zhenghao, et autres
Publié: (2026)
Think Silently, Think Fast: Dynamic Latent Compression of LLM Reasoning Chains
par: Tan, Wenhui, et autres
Publié: (2025)
par: Tan, Wenhui, et autres
Publié: (2025)
Selective Latent Thinking: Adaptive Compression of LLM Reasoning Chains
par: Xie, Hui, et autres
Publié: (2026)
par: Xie, Hui, et autres
Publié: (2026)
LatentPrompt: Optimizing Promts in Latent Space
par: Bystroński, Mateusz, et autres
Publié: (2025)
par: Bystroński, Mateusz, et autres
Publié: (2025)
Latent Reasoning in TRMs is Secretly a Policy Improvement Operator
par: Asadulaev, Arip, et autres
Publié: (2025)
par: Asadulaev, Arip, et autres
Publié: (2025)
Render-of-Thought: Rendering Textual Chain-of-Thought as Images for Visual Latent Reasoning
par: Wang, Yifan, et autres
Publié: (2026)
par: Wang, Yifan, et autres
Publié: (2026)
Limited Preference Data? Learning Better Reward Model with Latent Space Synthesis
par: Tao, Leitian, et autres
Publié: (2025)
par: Tao, Leitian, et autres
Publié: (2025)
CIRF: Tokenizing Chain-of-Thoughts into Reusable Functional Units for Efficient Latent Reasoning in Large Language Models
par: Lee, Yukyung, et autres
Publié: (2026)
par: Lee, Yukyung, et autres
Publié: (2026)
Latent Chain-of-Thought as Planning: Decoupling Reasoning from Verbalization
par: Wang, Jiecong, et autres
Publié: (2026)
par: Wang, Jiecong, et autres
Publié: (2026)
Inference-Time Rethinking with Latent Thought Vectors for Math Reasoning
par: Kong, Deqian, et autres
Publié: (2026)
par: Kong, Deqian, et autres
Publié: (2026)
Scaling Latent Reasoning via Looped Language Models
par: Zhu, Rui-Jie, et autres
Publié: (2025)
par: Zhu, Rui-Jie, et autres
Publié: (2025)
Coevolutionary Continuous Discrete Diffusion: Make Your Diffusion Language Model a Latent Reasoner
par: Zhou, Cai, et autres
Publié: (2025)
par: Zhou, Cai, et autres
Publié: (2025)
Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding
par: Chen, Haolin, et autres
Publié: (2024)
par: Chen, Haolin, et autres
Publié: (2024)
The Illusion of Superposition? A Principled Analysis of Latent Thinking in Language Models
par: Rizvi-Martel, Michael, et autres
Publié: (2026)
par: Rizvi-Martel, Michael, et autres
Publié: (2026)
Stop-Think-AutoRegress: Language Modeling with Latent Diffusion Planning
par: Lovelace, Justin, et autres
Publié: (2026)
par: Lovelace, Justin, et autres
Publié: (2026)
SwiReasoning: Switch-Thinking in Latent and Explicit for Pareto-Superior Reasoning LLMs
par: Shi, Dachuan, et autres
Publié: (2025)
par: Shi, Dachuan, et autres
Publié: (2025)
Latent Visual Reasoning
par: Li, Bangzheng, et autres
Publié: (2025)
par: Li, Bangzheng, et autres
Publié: (2025)
Efficient Post-Training Refinement of Latent Reasoning in Large Language Models
par: Wang, Xinyuan, et autres
Publié: (2025)
par: Wang, Xinyuan, et autres
Publié: (2025)
LatentRAG: Latent Reasoning and Retrieval for Efficient Agentic RAG
par: Zheng, Yijia, et autres
Publié: (2026)
par: Zheng, Yijia, et autres
Publié: (2026)
A Survey on Latent Reasoning
par: Zhu, Rui-Jie, et autres
Publié: (2025)
par: Zhu, Rui-Jie, et autres
Publié: (2025)
Thinking in Latents: Adaptive Anchor Refinement for Implicit Reasoning in LLMs
par: Sheshanarayana, Disha, et autres
Publié: (2026)
par: Sheshanarayana, Disha, et autres
Publié: (2026)
Large Reasoning Models Are (Not Yet) Multilingual Latent Reasoners
par: Liu, Yihong, et autres
Publié: (2026)
par: Liu, Yihong, et autres
Publié: (2026)
Documents similaires
-
Thinking Without Words: Efficient Latent Reasoning with Abstract Chain-of-Thought
par: Ramji, Keshav, et autres
Publié: (2026) -
Thinking on the Fly: Test-Time Reasoning Enhancement via Latent Thought Policy Optimization
par: Ye, Wengao, et autres
Publié: (2025) -
Reasoning Beyond Language: A Comprehensive Survey on Latent Chain-of-Thought Reasoning
par: Chen, Xinghao, et autres
Publié: (2025) -
Latent Thoughts Tuning: Bridging Context and Reasoning with Fused Information in Latent Tokens
par: Liu, Weihao, et autres
Publié: (2026) -
How to Train Your Latent Diffusion Language Model Jointly With the Latent Space
par: Meshchaninov, Viacheslav, et autres
Publié: (2026)