EvoClinician: A Self-Evolving Agent for Multi-Turn Medical Diagnosis via Test-Time Evolutionary Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | He, Yufei, Liu, Juncheng, Hu, Zhiyuan, Chen, Yulin, Liu, Yue, Sui, Yuan, Li, Yibo, Chen, Nuo, Hu, Jun, Hooi, Bryan, Xu, Xinxing, Bian, Jiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
EvoTest: Evolutionary Test-Time Learning for Self-Improving Agentic Systems
por: He, Yufei, et al.
Publicado: (2025)
por: He, Yufei, et al.
Publicado: (2025)
APEX: Autonomous Policy Exploration for Self-Evolving LLM Agents
por: Li, Yibo, et al.
Publicado: (2026)
por: Li, Yibo, et al.
Publicado: (2026)
Conversation for Non-verifiable Learning: Self-Evolving LLMs through Meta-Evaluation
por: Sui, Yuan, et al.
Publicado: (2026)
por: Sui, Yuan, et al.
Publicado: (2026)
Enabling Self-Improving Agents to Learn at Test Time With Human-In-The-Loop Guidance
por: He, Yufei, et al.
Publicado: (2025)
por: He, Yufei, et al.
Publicado: (2025)
Can Indirect Prompt Injection Attacks Be Detected and Removed?
por: Chen, Yulin, et al.
Publicado: (2025)
por: Chen, Yulin, et al.
Publicado: (2025)
TACT: Mitigating Overthinking and Overacting in Coding Agents via Activation Steering
por: Sui, Yuan, et al.
Publicado: (2026)
por: Sui, Yuan, et al.
Publicado: (2026)
Collaborative Multi-Agent Test-Time Reinforcement Learning for Reasoning
por: Hu, Zhiyuan, et al.
Publicado: (2026)
por: Hu, Zhiyuan, et al.
Publicado: (2026)
Evaluating the Paperclip Maximizer: Are RL-Based Language Models More Likely to Pursue Instrumental Goals?
por: He, Yufei, et al.
Publicado: (2025)
por: He, Yufei, et al.
Publicado: (2025)
Meta-Reasoner: Dynamic Guidance for Optimized Inference-time Reasoning in Large Language Models
por: Sui, Yuan, et al.
Publicado: (2025)
por: Sui, Yuan, et al.
Publicado: (2025)
WebAgentGuard: A Reasoning-Driven Guard Model for Detecting Prompt Injection Attacks in Web Agents
por: Chen, Yulin, et al.
Publicado: (2026)
por: Chen, Yulin, et al.
Publicado: (2026)
Learning to Learn-at-Test-Time: Language Agents with Learnable Adaptation Policies
por: Lou, Zhanzhi, et al.
Publicado: (2026)
por: Lou, Zhanzhi, et al.
Publicado: (2026)
Zombie Agents: Persistent Control of Self-Evolving LLM Agents via Self-Reinforcing Injections
por: Yang, Xianglin, et al.
Publicado: (2026)
por: Yang, Xianglin, et al.
Publicado: (2026)
WARD: Adversarially Robust Defense of Web Agents Against Prompt Injections
por: Cao, Tri, et al.
Publicado: (2026)
por: Cao, Tri, et al.
Publicado: (2026)
CoEvoSkills: Self-Evolving Agent Skills via Co-Evolutionary Verification
por: Zhang, Hanrong, et al.
Publicado: (2026)
por: Zhang, Hanrong, et al.
Publicado: (2026)
Backdoor-Powered Prompt Injection Attacks Nullify Defense Methods
por: Chen, Yulin, et al.
Publicado: (2025)
por: Chen, Yulin, et al.
Publicado: (2025)
UniGraph2: Learning a Unified Embedding Space to Bind Multimodal Graphs
por: He, Yufei, et al.
Publicado: (2025)
por: He, Yufei, et al.
Publicado: (2025)
Towards Realistic Personalization: Evaluating Long-Horizon Preference Following in Personalized User-LLM Interactions
por: Guo, Qianyun, et al.
Publicado: (2026)
por: Guo, Qianyun, et al.
Publicado: (2026)
Can Knowledge Graphs Make Large Language Models More Trustworthy? An Empirical Study Over Open-ended Question Answering
por: Sui, Yuan, et al.
Publicado: (2024)
por: Sui, Yuan, et al.
Publicado: (2024)
UniGraph: Learning a Unified Cross-Domain Foundation Model for Text-Attributed Graphs
por: He, Yufei, et al.
Publicado: (2024)
por: He, Yufei, et al.
Publicado: (2024)
JudgeLRM: Large Reasoning Models as a Judge
por: Chen, Nuo, et al.
Publicado: (2025)
por: Chen, Nuo, et al.
Publicado: (2025)
KLong: Training LLM Agent for Extremely Long-horizon Tasks
por: Liu, Yue, et al.
Publicado: (2026)
por: Liu, Yue, et al.
Publicado: (2026)
EvoEmo: Towards Evolved Emotional Policies for Adversarial LLM Agents in Multi-Turn Price Negotiation
por: Long, Yunbo, et al.
Publicado: (2025)
por: Long, Yunbo, et al.
Publicado: (2025)
Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory
por: Wei, Tianxin, et al.
Publicado: (2025)
por: Wei, Tianxin, et al.
Publicado: (2025)
EvoMAS: Evolutionary Generation of Multi-Agent Systems
por: Hu, Yuntong, et al.
Publicado: (2026)
por: Hu, Yuntong, et al.
Publicado: (2026)
MLR-Bench: Evaluating AI Agents on Open-Ended Machine Learning Research
por: Chen, Hui, et al.
Publicado: (2025)
por: Chen, Hui, et al.
Publicado: (2025)
TopicAttack: An Indirect Prompt Injection Attack via Topic Transition
por: Chen, Yulin, et al.
Publicado: (2025)
por: Chen, Yulin, et al.
Publicado: (2025)
FiDeLiS: Faithful Reasoning in Large Language Model for Knowledge Graph Question Answering
por: Sui, Yuan, et al.
Publicado: (2024)
por: Sui, Yuan, et al.
Publicado: (2024)
Robustness via Referencing: Defending against Prompt Injection Attacks by Referencing the Executed Instruction
por: Chen, Yulin, et al.
Publicado: (2025)
por: Chen, Yulin, et al.
Publicado: (2025)
EvoAgentX: An Automated Framework for Evolving Agentic Workflows
por: Wang, Yingxu, et al.
Publicado: (2025)
por: Wang, Yingxu, et al.
Publicado: (2025)
Evo: Autoregressive-Diffusion Large Language Models with Evolving Balance
por: Wu, Junde, et al.
Publicado: (2026)
por: Wu, Junde, et al.
Publicado: (2026)
Evo-MedAgent: Beyond One-Shot Diagnosis with Agents That Remember, Reflect, and Improve
por: Shen, Weixiang, et al.
Publicado: (2026)
por: Shen, Weixiang, et al.
Publicado: (2026)
EvoFlow: Evolving Diverse Agentic Workflows On The Fly
por: Zhang, Guibin, et al.
Publicado: (2025)
por: Zhang, Guibin, et al.
Publicado: (2025)
Echoless Label-Based Pre-computation for Memory-Efficient Heterogeneous Graph Learning
por: Hu, Jun, et al.
Publicado: (2025)
por: Hu, Jun, et al.
Publicado: (2025)
EvoOpt-LLM: Evolving industrial optimization models with large language models
por: He, Yiliu, et al.
Publicado: (2026)
por: He, Yiliu, et al.
Publicado: (2026)
NTSFormer: A Self-Teaching Graph Transformer for Multimodal Isolated Cold-Start Node Classification
por: Hu, Jun, et al.
Publicado: (2025)
por: Hu, Jun, et al.
Publicado: (2025)
Towards Clinician-Preferred Segmentation: Leveraging Human-in-the-Loop for Test Time Adaptation in Medical Image Segmentation
por: Hu, Shishuai, et al.
Publicado: (2024)
por: Hu, Shishuai, et al.
Publicado: (2024)
EvoAgent: Towards Automatic Multi-Agent Generation via Evolutionary Algorithms
por: Yuan, Siyu, et al.
Publicado: (2024)
por: Yuan, Siyu, et al.
Publicado: (2024)
Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety
por: Pan, Zhenyu, et al.
Publicado: (2025)
por: Pan, Zhenyu, et al.
Publicado: (2025)
Just-In-Time Reinforcement Learning: Continual Learning in LLM Agents Without Gradient Updates
por: Li, Yibo, et al.
Publicado: (2026)
por: Li, Yibo, et al.
Publicado: (2026)
Enhancing Multi-Agent Debate System Performance via Confidence Expression
por: Lin, Zijie, et al.
Publicado: (2025)
por: Lin, Zijie, et al.
Publicado: (2025)
Ejemplares similares
-
EvoTest: Evolutionary Test-Time Learning for Self-Improving Agentic Systems
por: He, Yufei, et al.
Publicado: (2025) -
APEX: Autonomous Policy Exploration for Self-Evolving LLM Agents
por: Li, Yibo, et al.
Publicado: (2026) -
Conversation for Non-verifiable Learning: Self-Evolving LLMs through Meta-Evaluation
por: Sui, Yuan, et al.
Publicado: (2026) -
Enabling Self-Improving Agents to Learn at Test Time With Human-In-The-Loop Guidance
por: He, Yufei, et al.
Publicado: (2025) -
Can Indirect Prompt Injection Attacks Be Detected and Removed?
por: Chen, Yulin, et al.
Publicado: (2025)