Recursive Models for Long-Horizon Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Chenxiao, Srebro, Nathan, Li, Zhiyuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PENCIL: Long Thoughts with Short Memory
di: Yang, Chenxiao, et al.
Pubblicazione: (2025)
di: Yang, Chenxiao, et al.
Pubblicazione: (2025)
Mem-T: Densifying Rewards for Long-Horizon Memory Agents
di: Yue, Yanwei, et al.
Pubblicazione: (2026)
di: Yue, Yanwei, et al.
Pubblicazione: (2026)
Towards More Accurate US Presidential Election via Multi-step Reasoning with Large Language Models
di: Yu, Chenxiao, et al.
Pubblicazione: (2024)
di: Yu, Chenxiao, et al.
Pubblicazione: (2024)
Beyond Language: Format-Agnostic Reasoning Subspaces in Large Language Models
di: Yuan, Aojie, et al.
Pubblicazione: (2026)
di: Yuan, Aojie, et al.
Pubblicazione: (2026)
Scaling Long-Horizon LLM Agent via Context-Folding
di: Sun, Weiwei, et al.
Pubblicazione: (2025)
di: Sun, Weiwei, et al.
Pubblicazione: (2025)
Harnessing Uncertainty: Entropy-Modulated Policy Gradients for Long-Horizon LLM Agents
di: Wang, Jiawei, et al.
Pubblicazione: (2025)
di: Wang, Jiawei, et al.
Pubblicazione: (2025)
Recursive Concept Evolution for Compositional Reasoning in Large Language Models
di: Chaudhry, Sarim
Pubblicazione: (2026)
di: Chaudhry, Sarim
Pubblicazione: (2026)
Spark: Strategic Policy-Aware Exploration via Dynamic Branching for Long-Horizon Agentic Learning
di: Wu, Jinyang, et al.
Pubblicazione: (2026)
di: Wu, Jinyang, et al.
Pubblicazione: (2026)
Why Reasoning Fails to Plan: A Planning-Centric Analysis of Long-Horizon Decision Making in LLM Agents
di: Wang, Zehong, et al.
Pubblicazione: (2026)
di: Wang, Zehong, et al.
Pubblicazione: (2026)
Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks
di: Jang, Lawrence Keunho, et al.
Pubblicazione: (2026)
di: Jang, Lawrence Keunho, et al.
Pubblicazione: (2026)
State Representation and Termination for Recursive Reasoning Systems
di: Guha, Debashis, et al.
Pubblicazione: (2026)
di: Guha, Debashis, et al.
Pubblicazione: (2026)
LongFlow: Efficient KV Cache Compression for Reasoning Models
di: Su, Yi, et al.
Pubblicazione: (2026)
di: Su, Yi, et al.
Pubblicazione: (2026)
Mitigating Hallucinations in Large Language Models via Causal Reasoning
di: Li, Yuangang, et al.
Pubblicazione: (2025)
di: Li, Yuangang, et al.
Pubblicazione: (2025)
Dissecting Long-Chain-of-Thought Reasoning Models: An Empirical Study
di: Mu, Yongyu, et al.
Pubblicazione: (2025)
di: Mu, Yongyu, et al.
Pubblicazione: (2025)
PRInTS: Reward Modeling for Long-Horizon Information Seeking
di: Lee, Jaewoo, et al.
Pubblicazione: (2025)
di: Lee, Jaewoo, et al.
Pubblicazione: (2025)
Intrinsic Language-Guided Exploration for Complex Long-Horizon Robotic Manipulation Tasks
di: Triantafyllidis, Eleftherios, et al.
Pubblicazione: (2023)
di: Triantafyllidis, Eleftherios, et al.
Pubblicazione: (2023)
Anti-Self-Distillation for Reasoning RL via Pointwise Mutual Information
di: Shen, Guobin, et al.
Pubblicazione: (2026)
di: Shen, Guobin, et al.
Pubblicazione: (2026)
Let it Calm: Exploratory Annealed Decoding for Verifiable Reinforcement Learning
di: Yang, Chenghao, et al.
Pubblicazione: (2025)
di: Yang, Chenghao, et al.
Pubblicazione: (2025)
LHAW: Controllable Underspecification for Long-Horizon Tasks
di: Pu, George, et al.
Pubblicazione: (2026)
di: Pu, George, et al.
Pubblicazione: (2026)
Mixture-of-Recursions: Learning Dynamic Recursive Depths for Adaptive Token-Level Computation
di: Bae, Sangmin, et al.
Pubblicazione: (2025)
di: Bae, Sangmin, et al.
Pubblicazione: (2025)
Demystifying Reinforcement Learning for Long-Horizon Tool-Using Agents: A Comprehensive Recipe
di: Wu, Xixi, et al.
Pubblicazione: (2026)
di: Wu, Xixi, et al.
Pubblicazione: (2026)
Memex(RL): Scaling Long-Horizon LLM Agents via Indexed Experience Memory
di: Wang, Zhenting, et al.
Pubblicazione: (2026)
di: Wang, Zhenting, et al.
Pubblicazione: (2026)
Breaking Quadratic Barriers: A Non-Attention LLM for Ultra-Long Context Horizons
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
AutoL2S: Auto Long-Short Reasoning for Efficient Large Language Models
di: Luo, Feng, et al.
Pubblicazione: (2025)
di: Luo, Feng, et al.
Pubblicazione: (2025)
Shift is Good: Mismatched Data Mixing Improves Test Performance
di: Medvedev, Marko, et al.
Pubblicazione: (2025)
di: Medvedev, Marko, et al.
Pubblicazione: (2025)
Synthetic Computers at Scale for Long-Horizon Productivity Simulation
di: Ge, Tao, et al.
Pubblicazione: (2026)
di: Ge, Tao, et al.
Pubblicazione: (2026)
ForesightKV: Optimizing KV Cache Eviction for Reasoning Models by Learning Long-Term Contribution
di: Dong, Zican, et al.
Pubblicazione: (2026)
di: Dong, Zican, et al.
Pubblicazione: (2026)
Recursive Language Models Meet Uncertainty: The Surprising Effectiveness of Self-Reflective Program Search for Long Context
di: Alizadeh, Keivan, et al.
Pubblicazione: (2026)
di: Alizadeh, Keivan, et al.
Pubblicazione: (2026)
Value-Action Alignment in Large Language Models under Privacy-Prosocial Conflict
di: Chen, Guanyu, et al.
Pubblicazione: (2026)
di: Chen, Guanyu, et al.
Pubblicazione: (2026)
LongEmbed: Extending Embedding Models for Long Context Retrieval
di: Zhu, Dawei, et al.
Pubblicazione: (2024)
di: Zhu, Dawei, et al.
Pubblicazione: (2024)
Capable but Unreliable: Canonical Path Deviation as a Causal Mechanism of Agent Failure in Long-Horizon Tasks
di: Lee, Wilson Y.
Pubblicazione: (2026)
di: Lee, Wilson Y.
Pubblicazione: (2026)
AgentFold: Long-Horizon Web Agents with Proactive Context Management
di: Ye, Rui, et al.
Pubblicazione: (2025)
di: Ye, Rui, et al.
Pubblicazione: (2025)
Demystifying Long Chain-of-Thought Reasoning in LLMs
di: Yeo, Edward, et al.
Pubblicazione: (2025)
di: Yeo, Edward, et al.
Pubblicazione: (2025)
Multipole Attention for Efficient Long Context Reasoning
di: Hooper, Coleman, et al.
Pubblicazione: (2025)
di: Hooper, Coleman, et al.
Pubblicazione: (2025)
AGGC: Adaptive Group Gradient Clipping for Stabilizing Large Language Model Training
di: Li, Zhiyuan, et al.
Pubblicazione: (2026)
di: Li, Zhiyuan, et al.
Pubblicazione: (2026)
DebateBench: A Challenging Long Context Reasoning Benchmark For Large Language Models
di: Tiwari, Utkarsh, et al.
Pubblicazione: (2025)
di: Tiwari, Utkarsh, et al.
Pubblicazione: (2025)
Thinking-Free Policy Initialization Makes Distilled Reasoning Models More Effective and Efficient Reasoners
di: Xu, Xin, et al.
Pubblicazione: (2025)
di: Xu, Xin, et al.
Pubblicazione: (2025)
Implicit Strategic Optimization: Rethinking Long-Horizon Decision-Making in Adversarial Poker Environments
di: Xia, Boyang, et al.
Pubblicazione: (2026)
di: Xia, Boyang, et al.
Pubblicazione: (2026)
Recursive Abstractive Processing for Retrieval in Dynamic Datasets
di: Chucri, Charbel, et al.
Pubblicazione: (2024)
di: Chucri, Charbel, et al.
Pubblicazione: (2024)
HINT-SD: Targeted Hindsight Self-Distillation for Long-Horizon Agents
di: Yeo, Woongyeng, et al.
Pubblicazione: (2026)
di: Yeo, Woongyeng, et al.
Pubblicazione: (2026)
Documenti analoghi
-
PENCIL: Long Thoughts with Short Memory
di: Yang, Chenxiao, et al.
Pubblicazione: (2025) -
Mem-T: Densifying Rewards for Long-Horizon Memory Agents
di: Yue, Yanwei, et al.
Pubblicazione: (2026) -
Towards More Accurate US Presidential Election via Multi-step Reasoning with Large Language Models
di: Yu, Chenxiao, et al.
Pubblicazione: (2024) -
Beyond Language: Format-Agnostic Reasoning Subspaces in Large Language Models
di: Yuan, Aojie, et al.
Pubblicazione: (2026) -
Scaling Long-Horizon LLM Agent via Context-Folding
di: Sun, Weiwei, et al.
Pubblicazione: (2025)