CosmicFish-HRM: Adaptive Reasoning via Hierarchical Recurrent Mechanisms in Compact Language Models
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Lakkapragada, Venkat Akhil |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Are Retrials All You Need? Enhancing Large Language Model Reasoning Without Verbalized Feedback
par: Potamitis, Nearchos, et autres
Publié: (2025)
par: Potamitis, Nearchos, et autres
Publié: (2025)
Compact Language Models via Pruning and Knowledge Distillation
par: Muralidharan, Saurav, et autres
Publié: (2024)
par: Muralidharan, Saurav, et autres
Publié: (2024)
The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models
par: Cui, Ganqu, et autres
Publié: (2025)
par: Cui, Ganqu, et autres
Publié: (2025)
Toward Adaptive Reasoning in Large Language Models with Thought Rollback
par: Chen, Sijia, et autres
Publié: (2024)
par: Chen, Sijia, et autres
Publié: (2024)
AdapThink: Adaptive Thinking Preferences for Reasoning Language Model
par: Wan, Xu, et autres
Publié: (2025)
par: Wan, Xu, et autres
Publié: (2025)
ReasonFlux: Hierarchical LLM Reasoning via Scaling Thought Templates
par: Yang, Ling, et autres
Publié: (2025)
par: Yang, Ling, et autres
Publié: (2025)
ThreadWeaver: Adaptive Threading for Efficient Parallel Reasoning in Language Models
par: Lian, Long, et autres
Publié: (2025)
par: Lian, Long, et autres
Publié: (2025)
ALaRM: Align Language Models via Hierarchical Rewards Modeling
par: Lai, Yuhang, et autres
Publié: (2024)
par: Lai, Yuhang, et autres
Publié: (2024)
ReasonBENCH: Benchmarking the (In)Stability of LLM Reasoning
par: Potamitis, Nearchos, et autres
Publié: (2025)
par: Potamitis, Nearchos, et autres
Publié: (2025)
Distilling LLMs' Decomposition Abilities into Compact Language Models
par: Tarasov, Denis, et autres
Publié: (2024)
par: Tarasov, Denis, et autres
Publié: (2024)
Reasoning Elicitation in Language Models via Counterfactual Feedback
par: Hüyük, Alihan, et autres
Publié: (2024)
par: Hüyük, Alihan, et autres
Publié: (2024)
Private Language Models via Truncated Laplacian Mechanism
par: Huang, Tianhao, et autres
Publié: (2024)
par: Huang, Tianhao, et autres
Publié: (2024)
EmbedLLM: Learning Compact Representations of Large Language Models
par: Zhuang, Richard, et autres
Publié: (2024)
par: Zhuang, Richard, et autres
Publié: (2024)
Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning
par: Jin, Jikai, et autres
Publié: (2025)
par: Jin, Jikai, et autres
Publié: (2025)
Efficient Reasoning for Large Reasoning Language Models via Certainty-Guided Reflection Suppression
par: Huang, Jiameng, et autres
Publié: (2025)
par: Huang, Jiameng, et autres
Publié: (2025)
Recurrent Knowledge Identification and Fusion for Language Model Continual Learning
par: Feng, Yujie, et autres
Publié: (2025)
par: Feng, Yujie, et autres
Publié: (2025)
Liger: Linearizing Large Language Models to Gated Recurrent Structures
par: Lan, Disen, et autres
Publié: (2025)
par: Lan, Disen, et autres
Publié: (2025)
Teaching Pretrained Language Models to Think Deeper with Retrofitted Recurrence
par: McLeish, Sean, et autres
Publié: (2025)
par: McLeish, Sean, et autres
Publié: (2025)
Mitigating Hallucinations in Large Language Models via Causal Reasoning
par: Li, Yuangang, et autres
Publié: (2025)
par: Li, Yuangang, et autres
Publié: (2025)
SHAPE: Stage-aware Hierarchical Advantage via Potential Estimation for LLM Reasoning
par: Ai, Zhengyang, et autres
Publié: (2026)
par: Ai, Zhengyang, et autres
Publié: (2026)
ArCHer: Training Language Model Agents via Hierarchical Multi-Turn RL
par: Zhou, Yifei, et autres
Publié: (2024)
par: Zhou, Yifei, et autres
Publié: (2024)
Loop, Think, & Generalize: Implicit Reasoning in Recurrent-Depth Transformers
par: Kohli, Harsh, et autres
Publié: (2026)
par: Kohli, Harsh, et autres
Publié: (2026)
RecurrentGemma: Moving Past Transformers for Efficient Open Language Models
par: Botev, Aleksandar, et autres
Publié: (2024)
par: Botev, Aleksandar, et autres
Publié: (2024)
Hierarchical Federated Unlearning for Large Language Models
par: Zhong, Yisheng, et autres
Publié: (2025)
par: Zhong, Yisheng, et autres
Publié: (2025)
Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs
par: Microsoft, et autres
Publié: (2025)
par: Microsoft, et autres
Publié: (2025)
Dissecting Persona-Driven Reasoning in Language Models via Activation Patching
par: Poonia, Ansh, et autres
Publié: (2025)
par: Poonia, Ansh, et autres
Publié: (2025)
Improving Reasoning Performance in Large Language Models via Representation Engineering
par: Højer, Bertram, et autres
Publié: (2025)
par: Højer, Bertram, et autres
Publié: (2025)
Understanding the Language Model to Solve the Symbolic Multi-Step Reasoning Problem from the Perspective of Buffer Mechanism
par: Wang, Zhiwei, et autres
Publié: (2024)
par: Wang, Zhiwei, et autres
Publié: (2024)
Adaptive Guidance Accelerates Reinforcement Learning of Reasoning Models
par: Nath, Vaskar, et autres
Publié: (2025)
par: Nath, Vaskar, et autres
Publié: (2025)
Predicting Compact Phrasal Rewrites with Large Language Models for ASR Post Editing
par: Zhang, Hao, et autres
Publié: (2025)
par: Zhang, Hao, et autres
Publié: (2025)
Variational Reasoning for Language Models
par: Zhou, Xiangxin, et autres
Publié: (2025)
par: Zhou, Xiangxin, et autres
Publié: (2025)
Reasoning Planning for Language Models
par: Nguyen, Bao, et autres
Publié: (2025)
par: Nguyen, Bao, et autres
Publié: (2025)
Depth-Recurrent Attention Mixtures: Giving Latent Reasoning the Attention it Deserves
par: Knupp, Jonas, et autres
Publié: (2026)
par: Knupp, Jonas, et autres
Publié: (2026)
Large Language and Reasoning Models are Shallow Disjunctive Reasoners
par: Khalid, Irtaza, et autres
Publié: (2025)
par: Khalid, Irtaza, et autres
Publié: (2025)
Physics of Language Models: Part 1, Learning Hierarchical Language Structures
par: Allen-Zhu, Zeyuan, et autres
Publié: (2023)
par: Allen-Zhu, Zeyuan, et autres
Publié: (2023)
MoBayes: A Modular Bayesian Framework for Separating Reasoning from Language in Conversational Clinical Decision Support
par: Kesmen, Yusuf, et autres
Publié: (2026)
par: Kesmen, Yusuf, et autres
Publié: (2026)
The Geometry of Categorical and Hierarchical Concepts in Large Language Models
par: Park, Kiho, et autres
Publié: (2024)
par: Park, Kiho, et autres
Publié: (2024)
Emergence of Hierarchical Emotion Organization in Large Language Models
par: Zhao, Bo, et autres
Publié: (2025)
par: Zhao, Bo, et autres
Publié: (2025)
Distil-xLSTM: Learning Attention Mechanisms through Recurrent Structures
par: Thiombiano, Abdoul Majid O., et autres
Publié: (2025)
par: Thiombiano, Abdoul Majid O., et autres
Publié: (2025)
LLäMmlein: Transparent, Compact and Competitive German-Only Language Models from Scratch
par: Pfister, Jan, et autres
Publié: (2024)
par: Pfister, Jan, et autres
Publié: (2024)
Documents similaires
-
Are Retrials All You Need? Enhancing Large Language Model Reasoning Without Verbalized Feedback
par: Potamitis, Nearchos, et autres
Publié: (2025) -
Compact Language Models via Pruning and Knowledge Distillation
par: Muralidharan, Saurav, et autres
Publié: (2024) -
The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models
par: Cui, Ganqu, et autres
Publié: (2025) -
Toward Adaptive Reasoning in Large Language Models with Thought Rollback
par: Chen, Sijia, et autres
Publié: (2024) -
AdapThink: Adaptive Thinking Preferences for Reasoning Language Model
par: Wan, Xu, et autres
Publié: (2025)