ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory
Fuente:
arXiv
Guardado en:
| Autores principales: | Ouyang, Siru, Yan, Jun, Hsu, I-Hung, Chen, Yanfei, Jiang, Ke, Wang, Zifeng, Han, Rujun, Le, Long T., Daruki, Samira, Tang, Xiangru, Tirumalashetty, Vishy, Lee, George, Rofouei, Mahsan, Lin, Hangfei, Han, Jiawei, Lee, Chen-Yu, Pfister, Tomas |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SAGE: Steerable Agentic Data Generation for Deep Search with Execution Feedback
por: Xu, Fangyuan, et al.
Publicado: (2026)
por: Xu, Fangyuan, et al.
Publicado: (2026)
SkillOS: Learning Skill Curation for Self-Evolving Agents
por: Ouyang, Siru, et al.
Publicado: (2026)
por: Ouyang, Siru, et al.
Publicado: (2026)
Supervised Reinforcement Learning: From Expert Trajectories to Step-wise Reasoning
por: Deng, Yihe, et al.
Publicado: (2025)
por: Deng, Yihe, et al.
Publicado: (2025)
Budget-Aware Tool-Use Enables Effective Agent Scaling
por: Liu, Tengxiao, et al.
Publicado: (2025)
por: Liu, Tengxiao, et al.
Publicado: (2025)
Reverse Thinking Makes LLMs Stronger Reasoners
por: Chen, Justin Chih-Yao, et al.
Publicado: (2024)
por: Chen, Justin Chih-Yao, et al.
Publicado: (2024)
Deep Researcher with Test-Time Diffusion
por: Han, Rujun, et al.
Publicado: (2025)
por: Han, Rujun, et al.
Publicado: (2025)
FGBench: A Dataset and Benchmark for Molecular Property Reasoning at Functional Group-Level in Large Language Models
por: Liu, Xuan, et al.
Publicado: (2025)
por: Liu, Xuan, et al.
Publicado: (2025)
In Prospect and Retrospect: Reflective Memory Management for Long-term Personalized Dialogue Agents
por: Tan, Zhen, et al.
Publicado: (2025)
por: Tan, Zhen, et al.
Publicado: (2025)
Chain-of-Table: Evolving Tables in the Reasoning Chain for Table Understanding
por: Wang, Zilong, et al.
Publicado: (2024)
por: Wang, Zilong, et al.
Publicado: (2024)
RAST: Reasoning Activation in LLMs via Small-model Transfer
por: Ouyang, Siru, et al.
Publicado: (2025)
por: Ouyang, Siru, et al.
Publicado: (2025)
Structured Chemistry Reasoning with Large Language Models
por: Ouyang, Siru, et al.
Publicado: (2023)
por: Ouyang, Siru, et al.
Publicado: (2023)
RubricEM: Meta-RL with Rubric-guided Policy Decomposition beyond Verifiable Rewards
por: Li, Gaotang, et al.
Publicado: (2026)
por: Li, Gaotang, et al.
Publicado: (2026)
COMPASS: Enhancing Agent Long-Horizon Reasoning with Evolving Context
por: Wan, Guangya, et al.
Publicado: (2025)
por: Wan, Guangya, et al.
Publicado: (2025)
CaLM: Contrasting Large and Small Language Models to Verify Grounded Generation
por: Hsu, I-Hung, et al.
Publicado: (2024)
por: Hsu, I-Hung, et al.
Publicado: (2024)
Towards Compute-Optimal Many-Shot In-Context Learning
por: Golchin, Shahriar, et al.
Publicado: (2025)
por: Golchin, Shahriar, et al.
Publicado: (2025)
Nexus : An Agentic Framework for Time Series Forecasting
por: Das, Sarkar Snigdha Sarathi, et al.
Publicado: (2026)
por: Das, Sarkar Snigdha Sarathi, et al.
Publicado: (2026)
PolicyBank: Evolving Policy Understanding for LLM Agents
por: Choi, Jihye, et al.
Publicado: (2026)
por: Choi, Jihye, et al.
Publicado: (2026)
Speculative Knowledge Distillation: Bridging the Teacher-Student Gap Through Interleaved Sampling
por: Xu, Wenda, et al.
Publicado: (2024)
por: Xu, Wenda, et al.
Publicado: (2024)
PlanGEN: A Multi-Agent Framework for Generating Planning and Reasoning Trajectories for Complex Problem Solving
por: Parmar, Mihir, et al.
Publicado: (2025)
por: Parmar, Mihir, et al.
Publicado: (2025)
Over-Reasoning and Redundant Calculation of Large Language Models
por: Chiang, Cheng-Han, et al.
Publicado: (2024)
por: Chiang, Cheng-Han, et al.
Publicado: (2024)
When Silence Matters: The Impact of Irrelevant Audio on Text Reasoning in Large Audio-Language Models
por: Li, Chen-An, et al.
Publicado: (2025)
por: Li, Chen-An, et al.
Publicado: (2025)
Cell-o1: Training LLMs to Solve Single-Cell Reasoning Puzzles with Reinforcement Learning
por: Fang, Yin, et al.
Publicado: (2025)
por: Fang, Yin, et al.
Publicado: (2025)
Magnet: Multi-turn Tool-use Data Synthesis and Distillation via Graph Translation
por: Yin, Fan, et al.
Publicado: (2025)
por: Yin, Fan, et al.
Publicado: (2025)
Synergizing Unsupervised Episode Detection with LLMs for Large-Scale News Events
por: Kargupta, Priyanka, et al.
Publicado: (2024)
por: Kargupta, Priyanka, et al.
Publicado: (2024)
RareAgent: Self-Evolving Reasoning for Drug Repurposing in Rare Diseases
por: Qin, Lang, et al.
Publicado: (2025)
por: Qin, Lang, et al.
Publicado: (2025)
Unveiling Narrative Reasoning Limits of Large Language Models with Trope in Movie Synopses
por: Su, Hung-Ting, et al.
Publicado: (2024)
por: Su, Hung-Ting, et al.
Publicado: (2024)
RFEval: Benchmarking Reasoning Faithfulness under Counterfactual Reasoning Intervention in Large Reasoning Models
por: Han, Yunseok, et al.
Publicado: (2026)
por: Han, Yunseok, et al.
Publicado: (2026)
Search-Adaptor: Embedding Customization for Information Retrieval
por: Yoon, Jinsung, et al.
Publicado: (2023)
por: Yoon, Jinsung, et al.
Publicado: (2023)
TableRAG: Million-Token Table Understanding with Language Models
por: Chen, Si-An, et al.
Publicado: (2024)
por: Chen, Si-An, et al.
Publicado: (2024)
A Survey on Retrieval And Structuring Augmented Generation with Large Language Models
por: Jiang, Pengcheng, et al.
Publicado: (2025)
por: Jiang, Pengcheng, et al.
Publicado: (2025)
TRACT: Regression-Aware Fine-tuning Meets Chain-of-Thought Reasoning for LLM-as-a-Judge
por: Chiang, Cheng-Han, et al.
Publicado: (2025)
por: Chiang, Cheng-Han, et al.
Publicado: (2025)
ProxyThinker: Test-Time Guidance through Small Visual Reasoners
por: Xiao, Zilin, et al.
Publicado: (2025)
por: Xiao, Zilin, et al.
Publicado: (2025)
BankMathBench: A Benchmark for Numerical Reasoning in Banking Scenarios
por: Lee, Yunseung, et al.
Publicado: (2026)
por: Lee, Yunseung, et al.
Publicado: (2026)
FEVO: Financial Knowledge Expansion and Reasoning Evolution for Large Language Models
por: Pang, Bo, et al.
Publicado: (2025)
por: Pang, Bo, et al.
Publicado: (2025)
ChemAgent: Self-updating Library in Large Language Models Improves Chemical Reasoning
por: Tang, Xiangru, et al.
Publicado: (2025)
por: Tang, Xiangru, et al.
Publicado: (2025)
Stop Reasoning! When Multimodal LLM with Chain-of-Thought Reasoning Meets Adversarial Image
por: Wang, Zefeng, et al.
Publicado: (2024)
por: Wang, Zefeng, et al.
Publicado: (2024)
Investigating Video Reasoning Capability of Large Language Models with Tropes in Movies
por: Su, Hung-Ting, et al.
Publicado: (2024)
por: Su, Hung-Ting, et al.
Publicado: (2024)
Structure-Augmented Reasoning Generation
por: Parekh, Jash Rajesh, et al.
Publicado: (2025)
por: Parekh, Jash Rajesh, et al.
Publicado: (2025)
EvolveReason: Self-Evolving Reasoning Paradigm for Explainable Deepfake Facial Image Identification
por: Zhou, Binjia, et al.
Publicado: (2026)
por: Zhou, Binjia, et al.
Publicado: (2026)
Tools as Continuous Flow for Evolving Agentic Reasoning
por: Huang, Tairan, et al.
Publicado: (2026)
por: Huang, Tairan, et al.
Publicado: (2026)
Ejemplares similares
-
SAGE: Steerable Agentic Data Generation for Deep Search with Execution Feedback
por: Xu, Fangyuan, et al.
Publicado: (2026) -
SkillOS: Learning Skill Curation for Self-Evolving Agents
por: Ouyang, Siru, et al.
Publicado: (2026) -
Supervised Reinforcement Learning: From Expert Trajectories to Step-wise Reasoning
por: Deng, Yihe, et al.
Publicado: (2025) -
Budget-Aware Tool-Use Enables Effective Agent Scaling
por: Liu, Tengxiao, et al.
Publicado: (2025) -
Reverse Thinking Makes LLMs Stronger Reasoners
por: Chen, Justin Chih-Yao, et al.
Publicado: (2024)