Reinforced Context Order Recovery for Adaptive Reasoning and Planning
Fuente:
arXiv
Guardado en:
| Autores principales: | Ma, Long, Zhong, Fangwei, Wang, Yizhou |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CoMet: Metaphor-Driven Covert Communication for Multi-Agent Language Games
por: Xu, Shuhang, et al.
Publicado: (2025)
por: Xu, Shuhang, et al.
Publicado: (2025)
Is Your LLM Really Mastering the Concept? A Multi-Agent Benchmark
por: Xu, Shuhang, et al.
Publicado: (2025)
por: Xu, Shuhang, et al.
Publicado: (2025)
Plan Then Action:High-Level Planning Guidance Reinforcement Learning for LLM Reasoning
por: Dou, Zhihao, et al.
Publicado: (2025)
por: Dou, Zhihao, et al.
Publicado: (2025)
Chain-of-Thought Tokens are Computer Program Variables
por: Zhu, Fangwei, et al.
Publicado: (2025)
por: Zhu, Fangwei, et al.
Publicado: (2025)
Fast Peer Adaptation with Context-aware Exploration
por: Ma, Long, et al.
Publicado: (2024)
por: Ma, Long, et al.
Publicado: (2024)
ReIn: Conversational Error Recovery with Reasoning Inception
por: Kim, Takyoung, et al.
Publicado: (2026)
por: Kim, Takyoung, et al.
Publicado: (2026)
Fewer is More: Boosting LLM Reasoning with Reinforced Context Pruning
por: Huang, Xijie, et al.
Publicado: (2023)
por: Huang, Xijie, et al.
Publicado: (2023)
Reasoning Pattern Alignment Merging for Adaptive Reasoning
por: Zhong, Zhaofeng, et al.
Publicado: (2026)
por: Zhong, Zhaofeng, et al.
Publicado: (2026)
Adaptive-Solver Framework for Dynamic Strategy Selection in Large Language Model Reasoning
por: Zhou, Jianpeng, et al.
Publicado: (2023)
por: Zhou, Jianpeng, et al.
Publicado: (2023)
THOUGHTSCULPT: Reasoning with Intermediate Revision and Search
por: Chi, Yizhou, et al.
Publicado: (2024)
por: Chi, Yizhou, et al.
Publicado: (2024)
When Domains Interact: Asymmetric and Order-Sensitive Cross-Domain Effects in Reinforcement Learning for Reasoning
por: Yang, Wang, et al.
Publicado: (2026)
por: Yang, Wang, et al.
Publicado: (2026)
Latent Context Compilation: Distilling Long Context into Compact Portable Memory
por: Li, Zeju, et al.
Publicado: (2026)
por: Li, Zeju, et al.
Publicado: (2026)
Simulating Human-like Daily Activities with Desire-driven Autonomy
por: Wang, Yiding, et al.
Publicado: (2024)
por: Wang, Yiding, et al.
Publicado: (2024)
RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving
por: Ding, Zepeng, et al.
Publicado: (2025)
por: Ding, Zepeng, et al.
Publicado: (2025)
Clinical Inspired MRI Lesion Segmentation
por: Yan, Lijun, et al.
Publicado: (2025)
por: Yan, Lijun, et al.
Publicado: (2025)
Reinforced Internal-External Knowledge Synergistic Reasoning for Efficient Adaptive Search Agent
por: Huang, Ziyang, et al.
Publicado: (2025)
por: Huang, Ziyang, et al.
Publicado: (2025)
Adaptive Ability Decomposing for Unlocking Large Reasoning Model Effective Reinforcement Learning
por: Chen, Zhipeng, et al.
Publicado: (2026)
por: Chen, Zhipeng, et al.
Publicado: (2026)
From Building Blocks to Planning: Multi-Step Spatial Reasoning in LLMs with Reinforcement Learning
por: Tahmasbi, Amir, et al.
Publicado: (2025)
por: Tahmasbi, Amir, et al.
Publicado: (2025)
EmbRACE-3K: Embodied Reasoning and Action in Complex Environments
por: Lin, Mingxian, et al.
Publicado: (2025)
por: Lin, Mingxian, et al.
Publicado: (2025)
Adaptive Reinforcement Learning Planning: Harnessing Large Language Models for Complex Information Extraction
por: Ding, Zepeng, et al.
Publicado: (2024)
por: Ding, Zepeng, et al.
Publicado: (2024)
ACR: Adaptive Context Refactoring via Context Refactoring Operators for Multi-Turn Dialogue
por: Shen, Jiawei, et al.
Publicado: (2026)
por: Shen, Jiawei, et al.
Publicado: (2026)
UR$^2$: Unify RAG and Reasoning through Reinforcement Learning
por: Li, Weitao, et al.
Publicado: (2025)
por: Li, Weitao, et al.
Publicado: (2025)
QUITO: Accelerating Long-Context Reasoning through Query-Guided Context Compression
por: Wang, Wenshan, et al.
Publicado: (2024)
por: Wang, Wenshan, et al.
Publicado: (2024)
Non-myopic Generation of Language Models for Reasoning and Planning
por: Ma, Chang, et al.
Publicado: (2024)
por: Ma, Chang, et al.
Publicado: (2024)
Dynamic Long Context Reasoning over Compressed Memory via End-to-End Reinforcement Learning
por: Chen, Zhuoen, et al.
Publicado: (2026)
por: Chen, Zhuoen, et al.
Publicado: (2026)
Learning Adaptive Parallel Reasoning with Language Models
por: Pan, Jiayi, et al.
Publicado: (2025)
por: Pan, Jiayi, et al.
Publicado: (2025)
AdaCtrl: Towards Adaptive and Controllable Reasoning via Difficulty-Aware Budgeting
por: Huang, Shijue, et al.
Publicado: (2025)
por: Huang, Shijue, et al.
Publicado: (2025)
Problem-Solving Logic Guided Curriculum In-Context Learning for LLMs Complex Reasoning
por: Ma, Xuetao, et al.
Publicado: (2025)
por: Ma, Xuetao, et al.
Publicado: (2025)
RAT: Retrieval Augmented Thoughts Elicit Context-Aware Reasoning in Long-Horizon Generation
por: Wang, Zihao, et al.
Publicado: (2024)
por: Wang, Zihao, et al.
Publicado: (2024)
Premise Order Matters in Reasoning with Large Language Models
por: Chen, Xinyun, et al.
Publicado: (2024)
por: Chen, Xinyun, et al.
Publicado: (2024)
PuzzlePlex: Benchmarking Foundation Models on Reasoning and Planning with Puzzles
por: Long, Yitao, et al.
Publicado: (2025)
por: Long, Yitao, et al.
Publicado: (2025)
PlanGEN: A Multi-Agent Framework for Generating Planning and Reasoning Trajectories for Complex Problem Solving
por: Parmar, Mihir, et al.
Publicado: (2025)
por: Parmar, Mihir, et al.
Publicado: (2025)
Atomic Skills are the Prerequisite: When Reinforcement Learning Synthesizes Compositional Reasoning, and When It Only Amplifies
por: Cheng, Sitao, et al.
Publicado: (2025)
por: Cheng, Sitao, et al.
Publicado: (2025)
Adaptive Guidance Accelerates Reinforcement Learning of Reasoning Models
por: Nath, Vaskar, et al.
Publicado: (2025)
por: Nath, Vaskar, et al.
Publicado: (2025)
Reinforced Efficient Reasoning via Semantically Diverse Exploration
por: Zhao, Ziqi, et al.
Publicado: (2026)
por: Zhao, Ziqi, et al.
Publicado: (2026)
CAMPHOR: Collaborative Agents for Multi-input Planning and High-Order Reasoning On Device
por: Fu, Yicheng, et al.
Publicado: (2024)
por: Fu, Yicheng, et al.
Publicado: (2024)
When to Memorize and When to Stop: Gated Recurrent Memory for Long-Context Reasoning
por: Sheng, Leheng, et al.
Publicado: (2026)
por: Sheng, Leheng, et al.
Publicado: (2026)
SocialGFs: Learning Social Gradient Fields for Multi-Agent Reinforcement Learning
por: Long, Qian, et al.
Publicado: (2024)
por: Long, Qian, et al.
Publicado: (2024)
PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization
por: Cao, Zouying, et al.
Publicado: (2025)
por: Cao, Zouying, et al.
Publicado: (2025)
Thinking Out of Order: When Output Order Stops Reflecting Reasoning Order in Diffusion Language Models
por: Yu, Longxuan, et al.
Publicado: (2026)
por: Yu, Longxuan, et al.
Publicado: (2026)
Ejemplares similares
-
CoMet: Metaphor-Driven Covert Communication for Multi-Agent Language Games
por: Xu, Shuhang, et al.
Publicado: (2025) -
Is Your LLM Really Mastering the Concept? A Multi-Agent Benchmark
por: Xu, Shuhang, et al.
Publicado: (2025) -
Plan Then Action:High-Level Planning Guidance Reinforcement Learning for LLM Reasoning
por: Dou, Zhihao, et al.
Publicado: (2025) -
Chain-of-Thought Tokens are Computer Program Variables
por: Zhu, Fangwei, et al.
Publicado: (2025) -
Fast Peer Adaptation with Context-aware Exploration
por: Ma, Long, et al.
Publicado: (2024)