Reasoning with Latent Thoughts: On the Power of Looped Transformers
Fuente:
arXiv
Salvato in:
| Autori principali: | Saunshi, Nikunj, Dikkala, Nishanth, Li, Zhiyuan, Kumar, Sanjiv, Reddi, Sashank J. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On the Inductive Bias of Stacking Towards Improving Reasoning
di: Saunshi, Nikunj, et al.
Pubblicazione: (2024)
di: Saunshi, Nikunj, et al.
Pubblicazione: (2024)
Can Looped Transformers Learn to Implement Multi-step Gradient Descent for In-context Learning?
di: Gatmiry, Khashayar, et al.
Pubblicazione: (2024)
di: Gatmiry, Khashayar, et al.
Pubblicazione: (2024)
Landscape-Aware Growing: The Power of a Little LAG
di: Karp, Stefani, et al.
Pubblicazione: (2024)
di: Karp, Stefani, et al.
Pubblicazione: (2024)
StagFormer: Time Staggering Transformer Decoding for RunningLayers In Parallel
di: Cutler, Dylan, et al.
Pubblicazione: (2025)
di: Cutler, Dylan, et al.
Pubblicazione: (2025)
Efficient Stagewise Pretraining via Progressive Subnetworks
di: Panigrahi, Abhishek, et al.
Pubblicazione: (2024)
di: Panigrahi, Abhishek, et al.
Pubblicazione: (2024)
On the Role of Depth and Looping for In-Context Learning with Task Diversity
di: Gatmiry, Khashayar, et al.
Pubblicazione: (2024)
di: Gatmiry, Khashayar, et al.
Pubblicazione: (2024)
A Implies B: Circuit Analysis in LLMs for Propositional Logical Reasoning
di: Hong, Guan Zhe, et al.
Pubblicazione: (2024)
di: Hong, Guan Zhe, et al.
Pubblicazione: (2024)
Reasoning to Learn from Latent Thoughts
di: Ruan, Yangjun, et al.
Pubblicazione: (2025)
di: Ruan, Yangjun, et al.
Pubblicazione: (2025)
Latent Chain-of-Thought? Decoding the Depth-Recurrent Transformer
di: Lu, Wenquan, et al.
Pubblicazione: (2025)
di: Lu, Wenquan, et al.
Pubblicazione: (2025)
Enhancing Auto-regressive Chain-of-Thought through Loop-Aligned Reasoning
di: Yu, Qifan, et al.
Pubblicazione: (2025)
di: Yu, Qifan, et al.
Pubblicazione: (2025)
Causal Language Modeling Can Elicit Search and Reasoning Capabilities on Logic Puzzles
di: Shah, Kulin, et al.
Pubblicazione: (2024)
di: Shah, Kulin, et al.
Pubblicazione: (2024)
Compositional Reasoning with Transformers, RNNs, and Chain of Thought
di: Yehudai, Gilad, et al.
Pubblicazione: (2025)
di: Yehudai, Gilad, et al.
Pubblicazione: (2025)
Hidden Error Awareness in Chain-of-Thought Reasoning: The Signal Is Diagnostic, Not Causal
di: Yuan, Aojie, et al.
Pubblicazione: (2026)
di: Yuan, Aojie, et al.
Pubblicazione: (2026)
A Formal Comparison Between Chain of Thought and Latent Thought
di: Xu, Kevin, et al.
Pubblicazione: (2025)
di: Xu, Kevin, et al.
Pubblicazione: (2025)
A Little Help Goes a Long Way: Efficient LLM Training by Leveraging Small LMs
di: Rawat, Ankit Singh, et al.
Pubblicazione: (2024)
di: Rawat, Ankit Singh, et al.
Pubblicazione: (2024)
Loop, Think, & Generalize: Implicit Reasoning in Recurrent-Depth Transformers
di: Kohli, Harsh, et al.
Pubblicazione: (2026)
di: Kohli, Harsh, et al.
Pubblicazione: (2026)
Neural Algorithmic Reasoning for Hypergraphs with Looped Transformers
di: Huang, Zekai, et al.
Pubblicazione: (2025)
di: Huang, Zekai, et al.
Pubblicazione: (2025)
Fractured Chain-of-Thought Reasoning
di: Liao, Baohao, et al.
Pubblicazione: (2025)
di: Liao, Baohao, et al.
Pubblicazione: (2025)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
di: Ye, Jiacheng, et al.
Pubblicazione: (2024)
di: Ye, Jiacheng, et al.
Pubblicazione: (2024)
ORION: Teaching Language Models to Reason Efficiently in the Language of Thought
di: Tanmay, Kumar, et al.
Pubblicazione: (2025)
di: Tanmay, Kumar, et al.
Pubblicazione: (2025)
Scalable Chain of Thoughts via Elastic Reasoning
di: Xu, Yuhui, et al.
Pubblicazione: (2025)
di: Xu, Yuhui, et al.
Pubblicazione: (2025)
Deep sequence models tend to memorize geometrically; it is unclear why
di: Noroozizadeh, Shahriar, et al.
Pubblicazione: (2025)
di: Noroozizadeh, Shahriar, et al.
Pubblicazione: (2025)
Stepwise Penalization for Length-Efficient Chain-of-Thought Reasoning
di: Li, Xintong, et al.
Pubblicazione: (2026)
di: Li, Xintong, et al.
Pubblicazione: (2026)
Synergy-of-Thoughts: Eliciting Efficient Reasoning in Hybrid Language Models
di: Shang, Yu, et al.
Pubblicazione: (2024)
di: Shang, Yu, et al.
Pubblicazione: (2024)
Are More Tokens Rational? Inference-Time Scaling in Language Models as Adaptive Resource Rationality
di: Hu, Zhimin, et al.
Pubblicazione: (2026)
di: Hu, Zhimin, et al.
Pubblicazione: (2026)
Toward Adaptive Reasoning in Large Language Models with Thought Rollback
di: Chen, Sijia, et al.
Pubblicazione: (2024)
di: Chen, Sijia, et al.
Pubblicazione: (2024)
Enhancing Generalization in Chain of Thought Reasoning for Smaller Models
di: Yin, Maxwell J., et al.
Pubblicazione: (2025)
di: Yin, Maxwell J., et al.
Pubblicazione: (2025)
Understanding Reasoning in Chain-of-Thought from the Hopfieldian View
di: Hu, Lijie, et al.
Pubblicazione: (2024)
di: Hu, Lijie, et al.
Pubblicazione: (2024)
Chain-of-Thought Reasoning In The Wild Is Not Always Faithful
di: Arcuschin, Iván, et al.
Pubblicazione: (2025)
di: Arcuschin, Iván, et al.
Pubblicazione: (2025)
Long Chain-of-Thought Reasoning Across Languages
di: Barua, Josh, et al.
Pubblicazione: (2025)
di: Barua, Josh, et al.
Pubblicazione: (2025)
ReasonFlux: Hierarchical LLM Reasoning via Scaling Thought Templates
di: Yang, Ling, et al.
Pubblicazione: (2025)
di: Yang, Ling, et al.
Pubblicazione: (2025)
Long-Context Reasoning Through Proxy-Based Chain-of-Thought Tuning
di: Li, Miao, et al.
Pubblicazione: (2026)
di: Li, Miao, et al.
Pubblicazione: (2026)
$T^2$ of Thoughts: Temperature Tree Elicits Reasoning in Large Language Models
di: Cai, Chengkun, et al.
Pubblicazione: (2024)
di: Cai, Chengkun, et al.
Pubblicazione: (2024)
Parallel Test-Time Scaling for Latent Reasoning Models
di: You, Runyang, et al.
Pubblicazione: (2025)
di: You, Runyang, et al.
Pubblicazione: (2025)
Weight-of-Thought Reasoning: Exploring Neural Network Weights for Enhanced LLM Reasoning
di: Punjwani, Saif, et al.
Pubblicazione: (2025)
di: Punjwani, Saif, et al.
Pubblicazione: (2025)
Value-Guided Search for Efficient Chain-of-Thought Reasoning
di: Wang, Kaiwen, et al.
Pubblicazione: (2025)
di: Wang, Kaiwen, et al.
Pubblicazione: (2025)
Thought Branches: Interpreting LLM Reasoning Requires Resampling
di: Macar, Uzay, et al.
Pubblicazione: (2025)
di: Macar, Uzay, et al.
Pubblicazione: (2025)
Thought Crime: Backdoors and Emergent Misalignment in Reasoning Models
di: Chua, James, et al.
Pubblicazione: (2025)
di: Chua, James, et al.
Pubblicazione: (2025)
Thought Anchors: Which LLM Reasoning Steps Matter?
di: Bogdan, Paul C., et al.
Pubblicazione: (2025)
di: Bogdan, Paul C., et al.
Pubblicazione: (2025)
LoRA Done RITE: Robust Invariant Transformation Equilibration for LoRA Optimization
di: Yen, Jui-Nan, et al.
Pubblicazione: (2024)
di: Yen, Jui-Nan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
On the Inductive Bias of Stacking Towards Improving Reasoning
di: Saunshi, Nikunj, et al.
Pubblicazione: (2024) -
Can Looped Transformers Learn to Implement Multi-step Gradient Descent for In-context Learning?
di: Gatmiry, Khashayar, et al.
Pubblicazione: (2024) -
Landscape-Aware Growing: The Power of a Little LAG
di: Karp, Stefani, et al.
Pubblicazione: (2024) -
StagFormer: Time Staggering Transformer Decoding for RunningLayers In Parallel
di: Cutler, Dylan, et al.
Pubblicazione: (2025) -
Efficient Stagewise Pretraining via Progressive Subnetworks
di: Panigrahi, Abhishek, et al.
Pubblicazione: (2024)