DeepDive: Advancing Deep Search Agents with Knowledge Graphs and Multi-Turn RL
Fuente:
arXiv
Guardado en:
| Autores principales: | Lu, Rui, Hou, Zhenyu, Wang, Zihan, Zhang, Hanchen, Liu, Xiao, Li, Yujiang, Feng, Shi, Tang, Jie, Dong, Yuxiao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TreeRL: LLM Reinforcement Learning with On-Policy Tree Search
por: Hou, Zhenyu, et al.
Publicado: (2025)
por: Hou, Zhenyu, et al.
Publicado: (2025)
AgentRL: Scaling Agentic Reinforcement Learning with a Multi-Turn, Multi-Task Framework
por: Zhang, Hanchen, et al.
Publicado: (2025)
por: Zhang, Hanchen, et al.
Publicado: (2025)
DeepDiver: Adaptive Search Intensity Scaling via Open-Web Reinforcement Learning
por: Shi, Wenxuan, et al.
Publicado: (2025)
por: Shi, Wenxuan, et al.
Publicado: (2025)
DeepDive: A deep dive into the physics of the first massive quiescent galaxies in the Universe
por: Ito, K., et al.
Publicado: (2025)
por: Ito, K., et al.
Publicado: (2025)
DeepDive: Simultaneous Formation of Massive Quiescent Galaxies in High-Redshift Galaxy Proto-clusters
por: Kakimoto, Takumi, et al.
Publicado: (2026)
por: Kakimoto, Takumi, et al.
Publicado: (2026)
T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling
por: Hou, Zhenyu, et al.
Publicado: (2025)
por: Hou, Zhenyu, et al.
Publicado: (2025)
GraphAlign: Pretraining One Graph Neural Network on Multiple Graphs via Feature Alignment
por: Hou, Zhenyu, et al.
Publicado: (2024)
por: Hou, Zhenyu, et al.
Publicado: (2024)
GraphTracer: Graph-Guided Failure Tracing in LLM Agents for Robust Multi-Turn Deep Search
por: Zhang, Heng, et al.
Publicado: (2025)
por: Zhang, Heng, et al.
Publicado: (2025)
DeepDive: Tracing the early quenching pathways of massive quiescent galaxies at $z>3$ from their star-formation histories and chemical abundances
por: Hamadouche, Massissilia L., et al.
Publicado: (2026)
por: Hamadouche, Massissilia L., et al.
Publicado: (2026)
SWE-Dev: Building Software Engineering Agents with Training and Inference Scaling
por: Wang, Haoran, et al.
Publicado: (2025)
por: Wang, Haoran, et al.
Publicado: (2025)
ComputerRL: Scaling End-to-End Online Reinforcement Learning for Computer Use Agents
por: Lai, Hanyu, et al.
Publicado: (2025)
por: Lai, Hanyu, et al.
Publicado: (2025)
DEEPMED: Building a Medical DeepResearch Agent via Multi-hop Med-Search Data and Turn-Controlled Agentic Training & Inference
por: Wang, Zihan, et al.
Publicado: (2026)
por: Wang, Zihan, et al.
Publicado: (2026)
TSR: Trajectory-Search Rollouts for Multi-Turn RL of LLM Agents
por: Djuhera, Aladin, et al.
Publicado: (2026)
por: Djuhera, Aladin, et al.
Publicado: (2026)
ProRL Agent: Rollout-as-a-Service for RL Training of Multi-Turn LLM Agents
por: Zhang, Hao, et al.
Publicado: (2026)
por: Zhang, Hao, et al.
Publicado: (2026)
Beyond Turn Limits: Training Deep Search Agents with Dynamic Context Window
por: Tang, Qiaoyu, et al.
Publicado: (2025)
por: Tang, Qiaoyu, et al.
Publicado: (2025)
Scaling up Multi-Turn Off-Policy RL and Multi-Agent Tree Search for LLM Step-Provers
por: Xin, Ran, et al.
Publicado: (2025)
por: Xin, Ran, et al.
Publicado: (2025)
MobileRL: Online Agentic Reinforcement Learning for Mobile GUI Agents
por: Xu, Yifan, et al.
Publicado: (2025)
por: Xu, Yifan, et al.
Publicado: (2025)
Thinker: Training LLMs in Hierarchical Thinking for Deep Search via Multi-Turn Interaction
por: Xu, Jun, et al.
Publicado: (2025)
por: Xu, Jun, et al.
Publicado: (2025)
Part I: Tricks or Traps? A Deep Dive into RL for LLM Reasoning
por: Liu, Zihe, et al.
Publicado: (2025)
por: Liu, Zihe, et al.
Publicado: (2025)
A Deep Dive into Scaling RL for Code Generation with Synthetic Data and Curricula
por: Sancaktar, Cansu, et al.
Publicado: (2026)
por: Sancaktar, Cansu, et al.
Publicado: (2026)
EICAP: Deep Dive in Assessment and Enhancement of Large Language Models in Emotional Intelligence through Multi-Turn Conversations
por: Nazar, Nizi, et al.
Publicado: (2025)
por: Nazar, Nizi, et al.
Publicado: (2025)
Turn-PPO: Turn-Level Advantage Estimation with PPO for Improved Multi-Turn RL in Agentic LLMs
por: Li, Junbo, et al.
Publicado: (2025)
por: Li, Junbo, et al.
Publicado: (2025)
MMedAgent-RL: Optimizing Multi-Agent Collaboration for Multimodal Medical Reasoning
por: Xia, Peng, et al.
Publicado: (2025)
por: Xia, Peng, et al.
Publicado: (2025)
SceneGenAgent: Precise Industrial Scene Generation with Coding Agent
por: Xia, Xiao, et al.
Publicado: (2024)
por: Xia, Xiao, et al.
Publicado: (2024)
Unsupervised Discovery of Steerable Factors When Graph Deep Generative Models Are Entangled
por: Liu, Shengchao, et al.
Publicado: (2024)
por: Liu, Shengchao, et al.
Publicado: (2024)
Dynamic Deep Factor Graph for Multi-Agent Reinforcement Learning
por: Shi, Yuchen, et al.
Publicado: (2024)
por: Shi, Yuchen, et al.
Publicado: (2024)
Turning Search into Knowledge Management.
por: Kaufman, David
Publicado: (2002)
por: Kaufman, David
Publicado: (2002)
Learning on Graphs with Large Language Models(LLMs): A Deep Dive into Model Robustness
por: Guo, Kai, et al.
Publicado: (2024)
por: Guo, Kai, et al.
Publicado: (2024)
Direct Multi-Turn Preference Optimization for Language Agents
por: Shi, Wentao, et al.
Publicado: (2024)
por: Shi, Wentao, et al.
Publicado: (2024)
SWEET-RL: Training Multi-Turn LLM Agents on Collaborative Reasoning Tasks
por: Zhou, Yifei, et al.
Publicado: (2025)
por: Zhou, Yifei, et al.
Publicado: (2025)
Chaining the Evidence: Robust Reinforcement Learning for Deep Search Agents with Citation-Aware Rubric Rewards
por: Zhang, Jiajie, et al.
Publicado: (2026)
por: Zhang, Jiajie, et al.
Publicado: (2026)
Towards On-Policy Data Evolution for Visual-Native Multimodal Deep Search Agents
por: Huang, Shijue, et al.
Publicado: (2026)
por: Huang, Shijue, et al.
Publicado: (2026)
Consolidation via Policy Information Regularization in Deep RL for Multi-Agent Games
por: Malloy, Tailia, et al.
Publicado: (2020)
por: Malloy, Tailia, et al.
Publicado: (2020)
KARMA: Leveraging Multi-Agent LLMs for Automated Knowledge Graph Enrichment
por: Lu, Yuxing, et al.
Publicado: (2025)
por: Lu, Yuxing, et al.
Publicado: (2025)
Extensive Self-Contrast Enables Feedback-Free Language Model Alignment
por: Liu, Xiao, et al.
Publicado: (2024)
por: Liu, Xiao, et al.
Publicado: (2024)
AutoWebGLM: A Large Language Model-based Web Navigating Agent
por: Lai, Hanyu, et al.
Publicado: (2024)
por: Lai, Hanyu, et al.
Publicado: (2024)
Deep Outdated Fact Detection in Knowledge Graphs
por: Tu, Huiling, et al.
Publicado: (2024)
por: Tu, Huiling, et al.
Publicado: (2024)
Expectation Confirmation Preference Optimization for Multi-Turn Conversational Recommendation Agent
por: Feng, Xueyang, et al.
Publicado: (2025)
por: Feng, Xueyang, et al.
Publicado: (2025)
DeepEvidence: Empowering Biomedical Discovery with Deep Knowledge Graph Research
por: Wang, Zifeng, et al.
Publicado: (2025)
por: Wang, Zifeng, et al.
Publicado: (2025)
Reinforcement Learning for Long-Horizon Multi-Turn Search Agents
por: Kalyan, Vivek, et al.
Publicado: (2025)
por: Kalyan, Vivek, et al.
Publicado: (2025)
Ejemplares similares
-
TreeRL: LLM Reinforcement Learning with On-Policy Tree Search
por: Hou, Zhenyu, et al.
Publicado: (2025) -
AgentRL: Scaling Agentic Reinforcement Learning with a Multi-Turn, Multi-Task Framework
por: Zhang, Hanchen, et al.
Publicado: (2025) -
DeepDiver: Adaptive Search Intensity Scaling via Open-Web Reinforcement Learning
por: Shi, Wenxuan, et al.
Publicado: (2025) -
DeepDive: A deep dive into the physics of the first massive quiescent galaxies in the Universe
por: Ito, K., et al.
Publicado: (2025) -
DeepDive: Simultaneous Formation of Massive Quiescent Galaxies in High-Redshift Galaxy Proto-clusters
por: Kakimoto, Takumi, et al.
Publicado: (2026)