DeepPlanner: Scaling Planning Capability for Deep Research Agents via Advantage Shaping
Fuente:
arXiv
Salvato in:
| Autori principali: | Fan, Wei, Yao, Wenlin, Li, Zheng, Yao, Feng, Liu, Xin, Qiu, Liang, Yin, Qingyu, Song, Yangqiu, Yin, Bing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Vision-DeepResearch: Incentivizing DeepResearch Capability in Multimodal Large Language Models
di: Huang, Wenxuan, et al.
Pubblicazione: (2026)
di: Huang, Wenxuan, et al.
Pubblicazione: (2026)
SciResearcher: Scaling Deep Research Agents for Frontier Scientific Reasoning
di: Zheng, Tianshi, et al.
Pubblicazione: (2026)
di: Zheng, Tianshi, et al.
Pubblicazione: (2026)
Understanding Inter-Session Intentions via Complex Logical Reasoning
di: Bai, Jiaxin, et al.
Pubblicazione: (2023)
di: Bai, Jiaxin, et al.
Pubblicazione: (2023)
Improving Sampling Efficiency in RLVR through Adaptive Rollout and Response Reuse
di: Zhang, Yuheng, et al.
Pubblicazione: (2025)
di: Zhang, Yuheng, et al.
Pubblicazione: (2025)
WebAgent-R1: Training Web Agents via End-to-End Multi-Turn Reinforcement Learning
di: Wei, Zhepei, et al.
Pubblicazione: (2025)
di: Wei, Zhepei, et al.
Pubblicazione: (2025)
Planner-Centric Reinforcement Learning for Deep Research with Structure-Aware Reward
di: Hussain, Mustafa Anis, et al.
Pubblicazione: (2026)
di: Hussain, Mustafa Anis, et al.
Pubblicazione: (2026)
A Method of Constructing Superpotentials by Combining Two Functions Based on Shape Invariance
di: Wenxin Qiu, et al.
Pubblicazione: (2024)
di: Wenxin Qiu, et al.
Pubblicazione: (2024)
FinDeepResearch: Evaluating Deep Research Agents in Rigorous Financial Analysis
di: Zhu, Fengbin, et al.
Pubblicazione: (2025)
di: Zhu, Fengbin, et al.
Pubblicazione: (2025)
DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning
di: Huang, Haoyu, et al.
Pubblicazione: (2026)
di: Huang, Haoyu, et al.
Pubblicazione: (2026)
Deep Research: A Survey of Autonomous Research Agents
di: Zhang, Wenlin, et al.
Pubblicazione: (2025)
di: Zhang, Wenlin, et al.
Pubblicazione: (2025)
Training LLMs for Multi-Step Tool Orchestration with Constrained Data Synthesis and Graduated Rewards
di: Jiayang, Cheng, et al.
Pubblicazione: (2026)
di: Jiayang, Cheng, et al.
Pubblicazione: (2026)
Rethinking Complex Queries on Knowledge Graphs with Neural Link Predictors
di: Yin, Hang, et al.
Pubblicazione: (2023)
di: Yin, Hang, et al.
Pubblicazione: (2023)
Meta Operator for Complex Query Answering on Knowledge Graphs
di: Yin, Hang, et al.
Pubblicazione: (2024)
di: Yin, Hang, et al.
Pubblicazione: (2024)
Scaling Up Data Parallelism in Decentralized Deep Learning
di: Xie, Bing, et al.
Pubblicazione: (2025)
di: Xie, Bing, et al.
Pubblicazione: (2025)
DeepResearchEval: An Automated Framework for Deep Research Task Construction and Agentic Evaluation
di: Wang, Yibo, et al.
Pubblicazione: (2026)
di: Wang, Yibo, et al.
Pubblicazione: (2026)
DeepResearch-9K: A Challenging Benchmark Dataset of Deep-Research Agent
di: Wu, Tongzhou, et al.
Pubblicazione: (2026)
di: Wu, Tongzhou, et al.
Pubblicazione: (2026)
Is Your LLM-Based Multi-Agent a Reliable Real-World Planner? Exploring Fraud Detection in Travel Planning
di: Yao, Junchi, et al.
Pubblicazione: (2025)
di: Yao, Junchi, et al.
Pubblicazione: (2025)
Enterprise Deep Research: Steerable Multi-Agent Deep Research for Enterprise Analytics
di: Prabhakar, Akshara, et al.
Pubblicazione: (2025)
di: Prabhakar, Akshara, et al.
Pubblicazione: (2025)
FinDeepForecast: A Live Multi-Agent System for Benchmarking Deep Research Agents in Financial Forecasting
di: Li, Xiangyu, et al.
Pubblicazione: (2026)
di: Li, Xiangyu, et al.
Pubblicazione: (2026)
SessionIntentBench: A Multi-task Inter-session Intention-shift Modeling Benchmark for E-commerce Customer Behavior Understanding
di: Yang, Yuqi, et al.
Pubblicazione: (2025)
di: Yang, Yuqi, et al.
Pubblicazione: (2025)
DeepThinkVLA: Enhancing Reasoning Capability of Vision-Language-Action Models
di: Yin, Cheng, et al.
Pubblicazione: (2025)
di: Yin, Cheng, et al.
Pubblicazione: (2025)
Evolutionary Morphology Towards Overconstrained Locomotion via Large-Scale, Multi-Terrain Deep Reinforcement Learning
di: Chen, Yenan, et al.
Pubblicazione: (2024)
di: Chen, Yenan, et al.
Pubblicazione: (2024)
Deep Research as Rubric for Reinforcement Learning
di: Mei, Wangyi, et al.
Pubblicazione: (2026)
di: Mei, Wangyi, et al.
Pubblicazione: (2026)
DeepResearcher: Scaling Deep Research via Reinforcement Learning in Real-world Environments
di: Zheng, Yuxiang, et al.
Pubblicazione: (2025)
di: Zheng, Yuxiang, et al.
Pubblicazione: (2025)
Numerical analysis for subdiffusion problem with non-positive memory
di: Qiu, Wenlin, et al.
Pubblicazione: (2025)
di: Qiu, Wenlin, et al.
Pubblicazione: (2025)
Numerical analysis of high-order methods for variable-exponent fractional diffusion-wave equation
di: Qiu, Wenlin, et al.
Pubblicazione: (2024)
di: Qiu, Wenlin, et al.
Pubblicazione: (2024)
Conformal Prediction for Deep Classifier via Label Ranking
di: Huang, Jianguo, et al.
Pubblicazione: (2023)
di: Huang, Jianguo, et al.
Pubblicazione: (2023)
The Cognitive Bandwidth Bottleneck: Shifting Long-Horizon Agent from Planning with Actions to Planning with Schemas
di: Xu, Baixuan, et al.
Pubblicazione: (2025)
di: Xu, Baixuan, et al.
Pubblicazione: (2025)
LLM-Hanabi: Evaluating Multi-Agent Gameplays with Theory-of-Mind and Rationale Inference in Imperfect Information Collaboration Game
di: Liang, Fangzhou, et al.
Pubblicazione: (2025)
di: Liang, Fangzhou, et al.
Pubblicazione: (2025)
The Tool Illusion: Rethinking Tool Use in Web Agents
di: Lou, Renze, et al.
Pubblicazione: (2026)
di: Lou, Renze, et al.
Pubblicazione: (2026)
Marco DeepResearch: Unlocking Efficient Deep Research Agents via Verification-Centric Design
di: Zhu, Bin, et al.
Pubblicazione: (2026)
di: Zhu, Bin, et al.
Pubblicazione: (2026)
iPlanner: Imperative Path Planning
di: Yang, Fan, et al.
Pubblicazione: (2023)
di: Yang, Fan, et al.
Pubblicazione: (2023)
InteGround: On the Evaluation of Verification and Retrieval Planning in Integrative Grounding
di: Jiayang, Cheng, et al.
Pubblicazione: (2025)
di: Jiayang, Cheng, et al.
Pubblicazione: (2025)
POPI: Personalizing LLMs via Optimized Natural Language Preference Inference
di: Chen, Yizhuo, et al.
Pubblicazione: (2025)
di: Chen, Yizhuo, et al.
Pubblicazione: (2025)
Yunque DeepResearch Technical Report
di: Cai, Yuxuan, et al.
Pubblicazione: (2026)
di: Cai, Yuxuan, et al.
Pubblicazione: (2026)
MIND: Multimodal Shopping Intention Distillation from Large Vision-language Models for E-commerce Purchase Understanding
di: Xu, Baixuan, et al.
Pubblicazione: (2024)
di: Xu, Baixuan, et al.
Pubblicazione: (2024)
IntentionQA: A Benchmark for Evaluating Purchase Intention Comprehension Abilities of Language Models in E-commerce
di: Ding, Wenxuan, et al.
Pubblicazione: (2024)
di: Ding, Wenxuan, et al.
Pubblicazione: (2024)
A Closed‐Loop‐Capable Neural Interface Platform for Deep Brain Modulation via Integrated Non‐Viral Gene Delivery, NIR Optogenetics, and Electrophysiological Recording
di: Chao‐Yi Chu, et al.
Pubblicazione: (2025)
di: Chao‐Yi Chu, et al.
Pubblicazione: (2025)
EducationQ: Evaluating LLMs' Teaching Capabilities Through Multi-Agent Dialogue Framework
di: Shi, Yao, et al.
Pubblicazione: (2025)
di: Shi, Yao, et al.
Pubblicazione: (2025)
VH-Diffuser: Variable Horizon Diffusion Planner for Time-Aware Goal-Conditioned Trajectory Planning
di: Liu, Ruijia, et al.
Pubblicazione: (2025)
di: Liu, Ruijia, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Vision-DeepResearch: Incentivizing DeepResearch Capability in Multimodal Large Language Models
di: Huang, Wenxuan, et al.
Pubblicazione: (2026) -
SciResearcher: Scaling Deep Research Agents for Frontier Scientific Reasoning
di: Zheng, Tianshi, et al.
Pubblicazione: (2026) -
Understanding Inter-Session Intentions via Complex Logical Reasoning
di: Bai, Jiaxin, et al.
Pubblicazione: (2023) -
Improving Sampling Efficiency in RLVR through Adaptive Rollout and Response Reuse
di: Zhang, Yuheng, et al.
Pubblicazione: (2025) -
WebAgent-R1: Training Web Agents via End-to-End Multi-Turn Reinforcement Learning
di: Wei, Zhepei, et al.
Pubblicazione: (2025)