medR: Reward Engineering for Clinical Offline Reinforcement Learning via Tri-Drive Potential Functions
Fuente:
arXiv
Saved in:
| Main Authors: | Xu, Qianyi, Habib, Gousia, Wu, Feng, Du, Yanrui, Chen, Zhihui, Mishra, Swapnil, Perera, Dilruk, Feng, Mengling |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
medDreamer: Model-Based Reinforcement Learning with Latent Imagination on Complex EHRs for Clinical Decision Support
by: Xu, Qianyi, et al.
Published: (2025)
by: Xu, Qianyi, et al.
Published: (2025)
Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI
by: Perera, Dilruk, et al.
Published: (2025)
by: Perera, Dilruk, et al.
Published: (2025)
Advancing Multi-Organ Disease Care: A Hierarchical Multi-Agent Reinforcement Learning Framework
by: Tan, Daniel J., et al.
Published: (2024)
by: Tan, Daniel J., et al.
Published: (2024)
DeepEN: A Deep Reinforcement Learning Framework for Personalized Enteral Nutrition in Critical Care
by: Tan, Daniel Jason, et al.
Published: (2025)
by: Tan, Daniel Jason, et al.
Published: (2025)
Med-Banana-50K: A Cross-modality Large-Scale Dataset for Text-guided Medical Image Editing
by: Chen, Zhihui, et al.
Published: (2025)
by: Chen, Zhihui, et al.
Published: (2025)
Evidential time-to-event prediction with calibrated uncertainty quantification
by: Huang, Ling, et al.
Published: (2024)
by: Huang, Ling, et al.
Published: (2024)
Harnessing The Power of Attention For Patch-Based Biomedical Image Classification
by: Habib, Gousia, et al.
Published: (2024)
by: Habib, Gousia, et al.
Published: (2024)
From Latent Signals to Reflection Behavior: Tracing Meta-Cognitive Activation Trajectory in R1-Style LLMs
by: Du, Yanrui, et al.
Published: (2026)
by: Du, Yanrui, et al.
Published: (2026)
Knowledge Distillation in Vision Transformers: A Critical Review
by: Habib, Gousia, et al.
Published: (2023)
by: Habib, Gousia, et al.
Published: (2023)
Optimizing Vision Transformers With Data‐Free Knowledge Transfer
by: Gousia Habib, et al.
Published: (2026)
by: Gousia Habib, et al.
Published: (2026)
Toward Clinically Explainable AI for Medical Diagnosis: A Foundation Model with Human-Compatible Reasoning via Reinforcement Learning
by: Lin, Qika, et al.
Published: (2025)
by: Lin, Qika, et al.
Published: (2025)
Anchoring Refusal Direction: Mitigating Safety Risks in Tuning via Projection Constraint
by: Du, Yanrui, et al.
Published: (2025)
by: Du, Yanrui, et al.
Published: (2025)
Adapting an Artificial Intelligence Sexually Transmitted Diseases Symptom Checker Tool for Mpox Detection: The HeHealth Experience
by: Tan, Rayner Kay Jin, et al.
Published: (2024)
by: Tan, Rayner Kay Jin, et al.
Published: (2024)
S3-CoT: Self-Sampled Succinct Reasoning Enables Efficient Chain-of-Thought LLMs
by: Du, Yanrui, et al.
Published: (2026)
by: Du, Yanrui, et al.
Published: (2026)
On the Hilton-Zhao vertex-splitting conjecture
by: Qi, Xuli, et al.
Published: (2026)
by: Qi, Xuli, et al.
Published: (2026)
DivScore: Zero-Shot Detection of LLM-Generated Text in Specialized Domains
by: Chen, Zhihui, et al.
Published: (2025)
by: Chen, Zhihui, et al.
Published: (2025)
Offline Reinforcement Learning with Imputed Rewards
by: Romeo, Carlo, et al.
Published: (2024)
by: Romeo, Carlo, et al.
Published: (2024)
Optimizing Vision Transformers with Data-Free Knowledge Transfer
by: Habib, Gousia, et al.
Published: (2024)
by: Habib, Gousia, et al.
Published: (2024)
Design of Reward Function on Reinforcement Learning for Automated Driving
by: Goto, Takeru, et al.
Published: (2025)
by: Goto, Takeru, et al.
Published: (2025)
ROLeR: Effective Reward Shaping in Offline Reinforcement Learning for Recommender Systems
by: Zhang, Yi, et al.
Published: (2024)
by: Zhang, Yi, et al.
Published: (2024)
The Distributional Reward Critic Framework for Reinforcement Learning Under Perturbed Rewards
by: Chen, Xi, et al.
Published: (2024)
by: Chen, Xi, et al.
Published: (2024)
MedForge: Interpretable Medical Deepfake Detection via Forgery-aware Reasoning
by: Chen, Zhihui, et al.
Published: (2026)
by: Chen, Zhihui, et al.
Published: (2026)
LIB-KD: Teaching Inductive Bias for Efficient Vision Transformer Distillation and Compression
by: Habib, Gousia, et al.
Published: (2023)
by: Habib, Gousia, et al.
Published: (2023)
Offline Reinforcement Learning using Human-Aligned Reward Labeling for Autonomous Emergency Braking in Occluded Pedestrian Crossing
by: Asodia, Vinal, et al.
Published: (2025)
by: Asodia, Vinal, et al.
Published: (2025)
Erfaringer med institusjonell etnografi
by: Magnussen, May-Linda, et al.
Published: (2023)
by: Magnussen, May-Linda, et al.
Published: (2023)
Å lytte med kroppen
by: Solli, Mattias, et al.
Published: (2025)
by: Solli, Mattias, et al.
Published: (2025)
Reward Generation via Large Vision-Language Model in Offline Reinforcement Learning
by: Lee, Younghwan, et al.
Published: (2025)
by: Lee, Younghwan, et al.
Published: (2025)
Robust Offline Reinforcement learning with Heavy-Tailed Rewards
by: Zhu, Jin, et al.
Published: (2023)
by: Zhu, Jin, et al.
Published: (2023)
Reward-Relevance-Filtered Linear Offline Reinforcement Learning
by: Zhou, Angela
Published: (2024)
by: Zhou, Angela
Published: (2024)
Binary Reward Labeling: Bridging Offline Preference and Reward-Based Reinforcement Learning
by: Xu, Yinglun, et al.
Published: (2024)
by: Xu, Yinglun, et al.
Published: (2024)
A Review of Reward Functions for Reinforcement Learning in the context of Autonomous Driving
by: Abouelazm, Ahmed, et al.
Published: (2024)
by: Abouelazm, Ahmed, et al.
Published: (2024)
Exploring the Efficacy of Group-Normalization in Deep Learning Models for Alzheimer's Disease Classification
by: Habib, Gousia, et al.
Published: (2024)
by: Habib, Gousia, et al.
Published: (2024)
Evaluating Reward Model Generalization via Pairwise Maximum Discrepancy Competitions
by: Luo, Shunyang, et al.
Published: (2026)
by: Luo, Shunyang, et al.
Published: (2026)
A new improvement to the Overfull Conjecture
by: Qi, Xuli, et al.
Published: (2025)
by: Qi, Xuli, et al.
Published: (2025)
SophiaVL-R1: Reinforcing MLLMs Reasoning with Thinking Reward
by: Fan, Kaixuan, et al.
Published: (2025)
by: Fan, Kaixuan, et al.
Published: (2025)
Home delivery for prescription vet meds
Published: (2025)
Published: (2025)
Listwise Reward Estimation for Offline Preference-based Reinforcement Learning
by: Choi, Heewoong, et al.
Published: (2024)
by: Choi, Heewoong, et al.
Published: (2024)
Offline Reinforcement Learning with Generative Trajectory Policies
by: Feng, Xinsong, et al.
Published: (2025)
by: Feng, Xinsong, et al.
Published: (2025)
Improving Offline Reinforcement Learning with Inaccurate Simulators
by: Hou, Yiwen, et al.
Published: (2024)
by: Hou, Yiwen, et al.
Published: (2024)
medIKAL: Integrating Knowledge Graphs as Assistants of LLMs for Enhanced Clinical Diagnosis on EMRs
by: Jia, Mingyi, et al.
Published: (2024)
by: Jia, Mingyi, et al.
Published: (2024)
Similar Items
-
medDreamer: Model-Based Reinforcement Learning with Latent Imagination on Complex EHRs for Clinical Decision Support
by: Xu, Qianyi, et al.
Published: (2025) -
Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI
by: Perera, Dilruk, et al.
Published: (2025) -
Advancing Multi-Organ Disease Care: A Hierarchical Multi-Agent Reinforcement Learning Framework
by: Tan, Daniel J., et al.
Published: (2024) -
DeepEN: A Deep Reinforcement Learning Framework for Personalized Enteral Nutrition in Critical Care
by: Tan, Daniel Jason, et al.
Published: (2025) -
Med-Banana-50K: A Cross-modality Large-Scale Dataset for Text-guided Medical Image Editing
by: Chen, Zhihui, et al.
Published: (2025)