IntentRL: Training Proactive User-intent Agents for Open-ended Deep Research via Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Luo, Haohao, Li, Zexi, Xie, Yuexiang, Zhang, Wenhao, Li, Yaliang, Shen, Ying |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing Multimodal Retrieval via Complementary Information Extraction and Alignment
par: Zeng, Delong, et autres
Publié: (2026)
par: Zeng, Delong, et autres
Publié: (2026)
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
par: Zhang, Wenhao, et autres
Publié: (2025)
par: Zhang, Wenhao, et autres
Publié: (2025)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
par: Wang, Shumin, et autres
Publié: (2026)
par: Wang, Shumin, et autres
Publié: (2026)
Agent-Oriented Planning in Multi-Agent Systems
par: Li, Ao, et autres
Publié: (2024)
par: Li, Ao, et autres
Publié: (2024)
UserRL: Training Interactive User-Centric Agent via Reinforcement Learning
par: Qian, Cheng, et autres
Publié: (2025)
par: Qian, Cheng, et autres
Publié: (2025)
Learning Agent-Compatible Context Management for Long-Horizon Tasks
par: Yi, Lu, et autres
Publié: (2026)
par: Yi, Lu, et autres
Publié: (2026)
Exploring Selective Layer Fine-Tuning in Federated Learning
par: Sun, Yuchang, et autres
Publié: (2024)
par: Sun, Yuchang, et autres
Publié: (2024)
Tree-based Models for Vertical Federated Learning: A Survey
par: Qian, Bingchen, et autres
Publié: (2025)
par: Qian, Bingchen, et autres
Publié: (2025)
Agentic Memory: Learning Unified Long-Term and Short-Term Memory Management for Large Language Model Agents
par: Yu, Yi, et autres
Publié: (2026)
par: Yu, Yi, et autres
Publié: (2026)
Knowledge Graph-Guided Retrieval Augmented Generation
par: Zhu, Xiangrong, et autres
Publié: (2025)
par: Zhu, Xiangrong, et autres
Publié: (2025)
Understanding Byzantine Robustness in Federated Learning with A Black-box Server
par: Zhao, Fangyuan, et autres
Publié: (2024)
par: Zhao, Fangyuan, et autres
Publié: (2024)
Proactive Dialogue Model with Intent Prediction
par: Luo, Yang
Publié: (2026)
par: Luo, Yang
Publié: (2026)
OpenFedLLM: Training Large Language Models on Decentralized Private Data via Federated Learning
par: Ye, Rui, et autres
Publié: (2024)
par: Ye, Rui, et autres
Publié: (2024)
O-Researcher: An Open Ended Deep Research Model via Multi-Agent Distillation and Agentic RL
par: Yao, Yi, et autres
Publié: (2026)
par: Yao, Yi, et autres
Publié: (2026)
KIMAs: A Configurable Knowledge Integrated Multi-Agent System
par: Li, Zitao, et autres
Publié: (2025)
par: Li, Zitao, et autres
Publié: (2025)
Very Large-Scale Multi-Agent Simulation in AgentScope
par: Pan, Xuchen, et autres
Publié: (2024)
par: Pan, Xuchen, et autres
Publié: (2024)
R$^3$L: Reflect-then-Retry Reinforcement Learning with Language-Guided Exploration, Pivotal Credit, and Positive Amplification
par: Shi, Weijie, et autres
Publié: (2026)
par: Shi, Weijie, et autres
Publié: (2026)
Proactive Agent Research Environment: Simulating Active Users to Evaluate Proactive Assistants
par: Nathani, Deepak, et autres
Publié: (2026)
par: Nathani, Deepak, et autres
Publié: (2026)
LiteResearcher: A Scalable Agentic RL Training Framework for Deep Research Agent
par: Li, Wanli, et autres
Publié: (2026)
par: Li, Wanli, et autres
Publié: (2026)
PASK: Toward Intent-Aware Proactive Agents with Long-Term Memory
par: Xie, Zhifei, et autres
Publié: (2026)
par: Xie, Zhifei, et autres
Publié: (2026)
From Training-Free to Adaptive: Empirical Insights into MLLMs' Understanding of Detection Information
par: Jiao, Qirui, et autres
Publié: (2024)
par: Jiao, Qirui, et autres
Publié: (2024)
ProRL: Effective Reinforcement Learning for Proactive Recommendation via Rectified Policy Gradient Estimation
par: Hou, Hongru, et autres
Publié: (2026)
par: Hou, Hongru, et autres
Publié: (2026)
Comprehensive Evaluation and Analysis for NSFW Concept Erasure in Text-to-Image Diffusion Models
par: Chen, Die, et autres
Publié: (2025)
par: Chen, Die, et autres
Publié: (2025)
SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning
par: Li, Haozhan, et autres
Publié: (2025)
par: Li, Haozhan, et autres
Publié: (2025)
TCOD: Exploring Temporal Curriculum in On-Policy Distillation for Multi-turn Autonomous Agents
par: Wang, Jiaqi, et autres
Publié: (2026)
par: Wang, Jiaqi, et autres
Publié: (2026)
AgentDisCo: Towards Disentanglement and Collaboration in Open-ended Deep Research Agents
par: Jin, Jiarui, et autres
Publié: (2026)
par: Jin, Jiarui, et autres
Publié: (2026)
PRIME: Training Free Proactive Reasoning via Iterative Memory Evolution for User-Centric Agent
par: Wang, Prince Zizhuang, et autres
Publié: (2026)
par: Wang, Prince Zizhuang, et autres
Publié: (2026)
MemRL: Self-Evolving Agents via Runtime Reinforcement Learning on Episodic Memory
par: Zhang, Shengtao, et autres
Publié: (2026)
par: Zhang, Shengtao, et autres
Publié: (2026)
Morae: Proactively Pausing UI Agents for User Choices
par: Peng, Yi-Hao, et autres
Publié: (2025)
par: Peng, Yi-Hao, et autres
Publié: (2025)
DeepThink: Aligning Language Models with Domain-Specific User Intents
par: Li, Yang, et autres
Publié: (2025)
par: Li, Yang, et autres
Publié: (2025)
MobileGUI-RL: Advancing Mobile GUI Agent through Reinforcement Learning in Online Environment
par: Shi, Yucheng, et autres
Publié: (2025)
par: Shi, Yucheng, et autres
Publié: (2025)
MolEditRL: Structure-Preserving Molecular Editing via Discrete Diffusion and Reinforcement Learning
par: Zhuang, Yuanxin, et autres
Publié: (2025)
par: Zhuang, Yuanxin, et autres
Publié: (2025)
RLIF: Interactive Imitation Learning as Reinforcement Learning
par: Luo, Jianlan, et autres
Publié: (2023)
par: Luo, Jianlan, et autres
Publié: (2023)
PIRA-Bench: A Transition from Reactive GUI Agents to GUI-based Proactive Intent Recommendation Agents
par: Chai, Yuxiang, et autres
Publié: (2026)
par: Chai, Yuxiang, et autres
Publié: (2026)
JuggleRL: Mastering Ball Juggling with a Quadrotor via Deep Reinforcement Learning
par: Ji, Shilong, et autres
Publié: (2025)
par: Ji, Shilong, et autres
Publié: (2025)
Real-World Doctor Agent with Proactive Consultation through Multi-Agent Reinforcement Learning
par: Feng, Yichun, et autres
Publié: (2025)
par: Feng, Yichun, et autres
Publié: (2025)
MILD: Multi-Intent Learning and Disambiguation for Proactive Failure Prediction in Intent-based Networking
par: Hossain, Md. Kamrul, et autres
Publié: (2026)
par: Hossain, Md. Kamrul, et autres
Publié: (2026)
Enhancing Target-Guided Proactive Dialogue Systems via Conversational Scenario Modeling and Intent-Keyword Bridging
par: Li, Maodong, et autres
Publié: (2026)
par: Li, Maodong, et autres
Publié: (2026)
RL-Selector: Reinforcement Learning-Guided Data Selection via Redundancy Assessment
par: Yang, Suorong, et autres
Publié: (2025)
par: Yang, Suorong, et autres
Publié: (2025)
Grounded in Reality: Learning and Deploying Proactive LLM from Offline Logs
par: Wei, Fei, et autres
Publié: (2025)
par: Wei, Fei, et autres
Publié: (2025)
Documents similaires
-
Enhancing Multimodal Retrieval via Complementary Information Extraction and Alignment
par: Zeng, Delong, et autres
Publié: (2026) -
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
par: Zhang, Wenhao, et autres
Publié: (2025) -
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
par: Wang, Shumin, et autres
Publié: (2026) -
Agent-Oriented Planning in Multi-Agent Systems
par: Li, Ao, et autres
Publié: (2024) -
UserRL: Training Interactive User-Centric Agent via Reinforcement Learning
par: Qian, Cheng, et autres
Publié: (2025)