Reinforced Internal-External Knowledge Synergistic Reasoning for Efficient Adaptive Search Agent
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Ziyang, Yuan, Xiaowei, Ju, Yiming, Zhao, Jun, Liu, Kang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Adaptive Mechanism Activation in Language Agent
por: Huang, Ziyang, et al.
Publicado: (2024)
por: Huang, Ziyang, et al.
Publicado: (2024)
Improve Rule Retrieval and Reasoning with Self-Induction and Relevance ReEstimate
por: Huang, Ziyang, et al.
Publicado: (2025)
por: Huang, Ziyang, et al.
Publicado: (2025)
InfoFlow: Reinforcing Search Agent Via Reward Density Optimization
por: Luo, Kun, et al.
Publicado: (2025)
por: Luo, Kun, et al.
Publicado: (2025)
WideSeek: Advancing Wide Research via Multi-Agent Scaling
por: Huang, Ziyang, et al.
Publicado: (2026)
por: Huang, Ziyang, et al.
Publicado: (2026)
Internal Knowledge Without External Expression: Probing the Generalization Boundary of a Classical Chinese Language Model
por: Chen, Jiuting, et al.
Publicado: (2026)
por: Chen, Jiuting, et al.
Publicado: (2026)
Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses
por: Jiang, Pengcheng, et al.
Publicado: (2026)
por: Jiang, Pengcheng, et al.
Publicado: (2026)
Pre-training Limited Memory Language Models with Internal and External Knowledge
por: Zhao, Linxi, et al.
Publicado: (2025)
por: Zhao, Linxi, et al.
Publicado: (2025)
Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns
por: Li, Xiang, et al.
Publicado: (2025)
por: Li, Xiang, et al.
Publicado: (2025)
ARise: Towards Knowledge-Augmented Reasoning via Risk-Adaptive Search
por: Zhang, Yize, et al.
Publicado: (2025)
por: Zhang, Yize, et al.
Publicado: (2025)
Commonsense Knowledge Editing Based on Free-Text in LLMs
por: Huang, Xiusheng, et al.
Publicado: (2024)
por: Huang, Xiusheng, et al.
Publicado: (2024)
LAPO: Internalizing Reasoning Efficiency via Length-Adaptive Policy Optimization
por: Wu, Xingyu, et al.
Publicado: (2025)
por: Wu, Xingyu, et al.
Publicado: (2025)
KARL: Knowledge-Aware Reasoning and Reinforcement Learning for Knowledge-Intensive Visual Grounding
por: Ma, Xinyu, et al.
Publicado: (2025)
por: Ma, Xinyu, et al.
Publicado: (2025)
ResAdapt: Adaptive Resolution for Efficient Multimodal Reasoning
por: Liao, Huanxuan, et al.
Publicado: (2026)
por: Liao, Huanxuan, et al.
Publicado: (2026)
Exploiting Contextual Knowledge in LLMs through V-usable Information based Layer Enhancement
por: Yuan, Xiaowei, et al.
Publicado: (2025)
por: Yuan, Xiaowei, et al.
Publicado: (2025)
Thought Manipulation: External Thought Can Be Efficient for Large Reasoning Models
por: Liu, Yule, et al.
Publicado: (2025)
por: Liu, Yule, et al.
Publicado: (2025)
KLoB: a Benchmark for Assessing Knowledge Locating Methods in Language Models
por: Ju, Yiming, et al.
Publicado: (2023)
por: Ju, Yiming, et al.
Publicado: (2023)
L-MARS: Legal Multi-Agent Workflow with Orchestrated Reasoning and Agentic Search
por: Wang, Ziqi, et al.
Publicado: (2025)
por: Wang, Ziqi, et al.
Publicado: (2025)
Language Modeling with Editable External Knowledge
por: Li, Belinda Z., et al.
Publicado: (2024)
por: Li, Belinda Z., et al.
Publicado: (2024)
A Study on Leveraging Search and Self-Feedback for Agent Reasoning
por: K, Karthikeyan, et al.
Publicado: (2025)
por: K, Karthikeyan, et al.
Publicado: (2025)
DA-Code: Agent Data Science Code Generation Benchmark for Large Language Models
por: Huang, Yiming, et al.
Publicado: (2024)
por: Huang, Yiming, et al.
Publicado: (2024)
WilKE: Wise-Layer Knowledge Editor for Lifelong Knowledge Editing
por: Hu, Chenhui, et al.
Publicado: (2024)
por: Hu, Chenhui, et al.
Publicado: (2024)
Metacognition as Reward: Reinforcing LLM Reasoning via Knowledge and Regulation Signals
por: Chen, Sirui, et al.
Publicado: (2026)
por: Chen, Sirui, et al.
Publicado: (2026)
The Knowledge Alignment Problem: Bridging Human and External Knowledge for Large Language Models
por: Zhang, Shuo, et al.
Publicado: (2023)
por: Zhang, Shuo, et al.
Publicado: (2023)
LINKED: Eliciting, Filtering and Integrating Knowledge in Large Language Model for Commonsense Reasoning
por: Li, Jiachun, et al.
Publicado: (2024)
por: Li, Jiachun, et al.
Publicado: (2024)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
por: Chen, Mingyang, et al.
Publicado: (2025)
por: Chen, Mingyang, et al.
Publicado: (2025)
Reinforced Efficient Reasoning via Semantically Diverse Exploration
por: Zhao, Ziqi, et al.
Publicado: (2026)
por: Zhao, Ziqi, et al.
Publicado: (2026)
An Empirical Study on Reinforcement Learning for Reasoning-Search Interleaved LLM Agents
por: Jin, Bowen, et al.
Publicado: (2025)
por: Jin, Bowen, et al.
Publicado: (2025)
OThink-SRR1: Search, Refine and Reasoning with Reinforced Learning for Large Language Models
por: Liang, Haijian, et al.
Publicado: (2026)
por: Liang, Haijian, et al.
Publicado: (2026)
DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning
por: Huang, Haoyu, et al.
Publicado: (2026)
por: Huang, Haoyu, et al.
Publicado: (2026)
MARS: Multi-Agent Adaptive Reasoning with Socratic Guidance for Automated Prompt Optimization
por: Zhang, Jian, et al.
Publicado: (2025)
por: Zhang, Jian, et al.
Publicado: (2025)
Reasoning Pattern Alignment Merging for Adaptive Reasoning
por: Zhong, Zhaofeng, et al.
Publicado: (2026)
por: Zhong, Zhaofeng, et al.
Publicado: (2026)
Reinforce LLM Reasoning through Multi-Agent Reflection
por: Yuan, Yurun, et al.
Publicado: (2025)
por: Yuan, Yurun, et al.
Publicado: (2025)
AgentsCourt: Building Judicial Decision-Making Agents with Court Debate Simulation and Legal Knowledge Augmentation
por: He, Zhitao, et al.
Publicado: (2024)
por: He, Zhitao, et al.
Publicado: (2024)
TaoSR-AGRL: Adaptive Guided Reinforcement Learning Framework for E-commerce Search Relevance
por: Yang, Jianhui, et al.
Publicado: (2025)
por: Yang, Jianhui, et al.
Publicado: (2025)
Not All Thoughts are Generated Equal: Efficient LLM Reasoning via Multi-Turn Reinforcement Learning
por: Ning, Yansong, et al.
Publicado: (2025)
por: Ning, Yansong, et al.
Publicado: (2025)
Generate-on-Graph: Treat LLM as both Agent and KG in Incomplete Knowledge Graph Question Answering
por: Xu, Yao, et al.
Publicado: (2024)
por: Xu, Yao, et al.
Publicado: (2024)
Trust-Oriented Adaptive Guardrails for Large Language Models
por: Hu, Jinwei, et al.
Publicado: (2024)
por: Hu, Jinwei, et al.
Publicado: (2024)
Unveiling Effective In-Context Configurations for Image Captioning: An External & Internal Analysis
por: Li, Li, et al.
Publicado: (2025)
por: Li, Li, et al.
Publicado: (2025)
Expanding Search Space with Diverse Prompting Agents: An Efficient Sampling Approach for LLM Mathematical Reasoning
por: Lee, Gisang, et al.
Publicado: (2024)
por: Lee, Gisang, et al.
Publicado: (2024)
Exploring Knowledge Conflicts for Faithful LLM Reasoning: Benchmark and Method
por: Zhao, Tianzhe, et al.
Publicado: (2026)
por: Zhao, Tianzhe, et al.
Publicado: (2026)
Ejemplares similares
-
Towards Adaptive Mechanism Activation in Language Agent
por: Huang, Ziyang, et al.
Publicado: (2024) -
Improve Rule Retrieval and Reasoning with Self-Induction and Relevance ReEstimate
por: Huang, Ziyang, et al.
Publicado: (2025) -
InfoFlow: Reinforcing Search Agent Via Reward Density Optimization
por: Luo, Kun, et al.
Publicado: (2025) -
WideSeek: Advancing Wide Research via Multi-Agent Scaling
por: Huang, Ziyang, et al.
Publicado: (2026) -
Internal Knowledge Without External Expression: Probing the Generalization Boundary of a Classical Chinese Language Model
por: Chen, Jiuting, et al.
Publicado: (2026)