Doctor-R1: Mastering Clinical Inquiry with Experiential Agentic Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Lai, Yunghwei, Liu, Kaiming, Wang, Ziyue, Ma, Weizhi, Liu, Yang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Patient-Zero: Scaling Synthetic Patient Agents to Real-World Distributions without Real Patient Data
by: Lai, Yunghwei, et al.
Published: (2025)
by: Lai, Yunghwei, et al.
Published: (2025)
The Dialogue That Heals: A Comprehensive Evaluation of Doctor Agents' Inquiry Capability
by: Gong, Linlu, et al.
Published: (2025)
by: Gong, Linlu, et al.
Published: (2025)
TheraAgent: Self-Improving Therapeutic Agent for Precise and Comprehensive Treatment Planning
by: Li, Junkai, et al.
Published: (2026)
by: Li, Junkai, et al.
Published: (2026)
Experiential Reinforcement Learning
by: Shi, Taiwei, et al.
Published: (2026)
by: Shi, Taiwei, et al.
Published: (2026)
Agent-Environment Alignment via Automated Interface Generation
by: Liu, Kaiming, et al.
Published: (2025)
by: Liu, Kaiming, et al.
Published: (2025)
Agent Hospital: A Simulacrum of Hospital with Evolvable Medical Agents
by: Li, Junkai, et al.
Published: (2024)
by: Li, Junkai, et al.
Published: (2024)
Experiential Explanations for Reinforcement Learning
by: Alabdulkarim, Amal, et al.
Published: (2022)
by: Alabdulkarim, Amal, et al.
Published: (2022)
UR$^2$: Unify RAG and Reasoning through Reinforcement Learning
by: Li, Weitao, et al.
Published: (2025)
by: Li, Weitao, et al.
Published: (2025)
Beyond Words: Evaluating and Bridging Epistemic Divergence in User-Agent Interaction via Theory of Mind
by: Ruan, Minyuan, et al.
Published: (2026)
by: Ruan, Minyuan, et al.
Published: (2026)
Compiler-R1: Towards Agentic Compiler Auto-tuning with Reinforcement Learning
by: Pan, Haolin, et al.
Published: (2025)
by: Pan, Haolin, et al.
Published: (2025)
Smarter Together: Creating Agentic Communities of Practice through Shared Experiential Learning
by: Tablan, Valentin, et al.
Published: (2025)
by: Tablan, Valentin, et al.
Published: (2025)
Proactive Knowledge Inquiry in Doctor-Patient Dialogue: Stateful Extraction, Belief Updating, and Path-Aware Action Planning
by: Pan, Zhenhai, et al.
Published: (2026)
by: Pan, Zhenhai, et al.
Published: (2026)
ELITE: Experiential Learning and Intent-Aware Transfer for Self-improving Embodied Agents
by: Wei, Bingqing, et al.
Published: (2026)
by: Wei, Bingqing, et al.
Published: (2026)
Experiential Co-Learning of Software-Developing Agents
by: Qian, Chen, et al.
Published: (2023)
by: Qian, Chen, et al.
Published: (2023)
Learning When Not to Act: Mitigating Tool Abuse in Agentic Reinforcement Learning
by: Chen, Liuji, et al.
Published: (2026)
by: Chen, Liuji, et al.
Published: (2026)
Gradient Coupling: The Hidden Barrier to Generalization in Agentic Reinforcement Learning
by: Liu, Jingyu, et al.
Published: (2025)
by: Liu, Jingyu, et al.
Published: (2025)
PiCA: Pivot-Based Credit Assignment for Search Agentic Reinforcement Learning
by: Liu, Dongyi, et al.
Published: (2026)
by: Liu, Dongyi, et al.
Published: (2026)
Controllable and Verifiable Tool-Use Data Synthesis for Agentic Reinforcement Learning
by: Xu, Siyuan, et al.
Published: (2026)
by: Xu, Siyuan, et al.
Published: (2026)
MarsRL: Advancing Multi-Agent Reasoning System via Reinforcement Learning with Agentic Pipeline Parallelism
by: Liu, Shulin, et al.
Published: (2025)
by: Liu, Shulin, et al.
Published: (2025)
Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning
by: Guo, Weiyang, et al.
Published: (2025)
by: Guo, Weiyang, et al.
Published: (2025)
AgentRL: Scaling Agentic Reinforcement Learning with a Multi-Turn, Multi-Task Framework
by: Zhang, Hanchen, et al.
Published: (2025)
by: Zhang, Hanchen, et al.
Published: (2025)
"I Like That You Have to Poke Around": Instructors on How Experiential Approaches to AI Literacy Spark Inquiry and Critical Thinking
by: Warrier, Aparna Maya, et al.
Published: (2025)
by: Warrier, Aparna Maya, et al.
Published: (2025)
When Agents Overtrust Environmental Evidence: An Extensible Agentic Framework for Benchmarking Evidence-Grounding Defects in LLM Agents
by: Sheng, Strick, et al.
Published: (2026)
by: Sheng, Strick, et al.
Published: (2026)
MRG-R1: Reinforcement Learning for Clinically Aligned Medical Report Generation
by: Wang, Pengyu, et al.
Published: (2025)
by: Wang, Pengyu, et al.
Published: (2025)
Citation-Enhanced Generation for LLM-based Chatbots
by: Li, Weitao, et al.
Published: (2024)
by: Li, Weitao, et al.
Published: (2024)
Towards Effective Experiential Learning: Dual Guidance for Utilization and Internalization
by: Bai, Fei, et al.
Published: (2026)
by: Bai, Fei, et al.
Published: (2026)
DeepTravel: An End-to-End Agentic Reinforcement Learning Framework for Autonomous Travel Planning Agents
by: Ning, Yansong, et al.
Published: (2025)
by: Ning, Yansong, et al.
Published: (2025)
MobileRL: Online Agentic Reinforcement Learning for Mobile GUI Agents
by: Xu, Yifan, et al.
Published: (2025)
by: Xu, Yifan, et al.
Published: (2025)
CM2: Reinforcement Learning with Checklist Rewards for Multi-Turn and Multi-Step Agentic Tool Use
by: Zhang, Zhen, et al.
Published: (2026)
by: Zhang, Zhen, et al.
Published: (2026)
ExpeTrans: LLMs Are Experiential Transfer Learners
by: Gao, Jinglong, et al.
Published: (2025)
by: Gao, Jinglong, et al.
Published: (2025)
Efficient and Transferable Agentic Knowledge Graph RAG via Reinforcement Learning
by: Lin, Junhong, et al.
Published: (2025)
by: Lin, Junhong, et al.
Published: (2025)
Efficient Reinforcement Learning with Semantic and Token Entropy for LLM Reasoning
by: Cao, Hongye, et al.
Published: (2025)
by: Cao, Hongye, et al.
Published: (2025)
Cross-Task Experiential Learning on LLM-based Multi-Agent Collaboration
by: Li, Yilong, et al.
Published: (2025)
by: Li, Yilong, et al.
Published: (2025)
LightSearcher: Efficient DeepSearch via Experiential Memory
by: Lan, Hengzhi, et al.
Published: (2025)
by: Lan, Hengzhi, et al.
Published: (2025)
FactGuard: Agentic Video Misinformation Detection via Reinforcement Learning
by: Li, Zehao, et al.
Published: (2026)
by: Li, Zehao, et al.
Published: (2026)
ARLArena: A Unified Framework for Stable Agentic Reinforcement Learning
by: Wang, Xiaoxuan, et al.
Published: (2026)
by: Wang, Xiaoxuan, et al.
Published: (2026)
Self-Evolving GPT: A Lifelong Autonomous Experiential Learner
by: Gao, Jinglong, et al.
Published: (2024)
by: Gao, Jinglong, et al.
Published: (2024)
EvoMaster: A Foundational Evolving Agent Framework for Agentic Science at Scale
by: Zhu, Xinyu, et al.
Published: (2026)
by: Zhu, Xinyu, et al.
Published: (2026)
RoboGPT-R1: Enhancing Robot Planning with Reinforcement Learning
by: Liu, Jinrui, et al.
Published: (2025)
by: Liu, Jinrui, et al.
Published: (2025)
AstraFlow: Dataflow-Oriented Reinforcement Learning for Agentic LLMs
by: Zheng, Haizhong, et al.
Published: (2026)
by: Zheng, Haizhong, et al.
Published: (2026)
Similar Items
-
Patient-Zero: Scaling Synthetic Patient Agents to Real-World Distributions without Real Patient Data
by: Lai, Yunghwei, et al.
Published: (2025) -
The Dialogue That Heals: A Comprehensive Evaluation of Doctor Agents' Inquiry Capability
by: Gong, Linlu, et al.
Published: (2025) -
TheraAgent: Self-Improving Therapeutic Agent for Precise and Comprehensive Treatment Planning
by: Li, Junkai, et al.
Published: (2026) -
Experiential Reinforcement Learning
by: Shi, Taiwei, et al.
Published: (2026) -
Agent-Environment Alignment via Automated Interface Generation
by: Liu, Kaiming, et al.
Published: (2025)