MedGym:A Unified Continuous-Time Benchmark for Dynamic Medical Treatment Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Yuepeng, Kawano, Ken, Zhou, Yongqi, Fujisawa, Yoshihiko, Weiss, Richard, Wachi, Akifumi, Fujisawa, Katsuki, Chen, Ying, Sadria, Mehrshad, Liu, Xin, Kim, Kyoung-Sook, Hu, Xiao, Gros, Sebastien, Shen, Xun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Offline Guarded Safe Reinforcement Learning for Medical Treatment Optimization Strategies
par: Yan, Runze, et autres
Publié: (2025)
par: Yan, Runze, et autres
Publié: (2025)
More Than Bits: Multi-Envelope Double Binary Factorization for Extreme Quantization
par: Ichikawa, Yuma, et autres
Publié: (2025)
par: Ichikawa, Yuma, et autres
Publié: (2025)
Signs Beat Floats: Low-Rank Double-Binary Adaptation for On-Device Fine-Tuning
par: Fujisawa, Yoshihiko, et autres
Publié: (2026)
par: Fujisawa, Yoshihiko, et autres
Publié: (2026)
Flipping-based Policy for Chance-Constrained Markov Decision Processes
par: Shen, Xun, et autres
Publié: (2024)
par: Shen, Xun, et autres
Publié: (2024)
A Survey of Constraint Formulations in Safe Reinforcement Learning
par: Wachi, Akifumi, et autres
Publié: (2024)
par: Wachi, Akifumi, et autres
Publié: (2024)
Long-term Safe Reinforcement Learning with Binary Feedback
par: Wachi, Akifumi, et autres
Publié: (2024)
par: Wachi, Akifumi, et autres
Publié: (2024)
Target Return Optimizer for Multi-Game Decision Transformer
par: Tatematsu, Kensuke, et autres
Publié: (2025)
par: Tatematsu, Kensuke, et autres
Publié: (2025)
Enhancing Output Diversity Improves Conjugate Gradient-based Adversarial Attacks
par: Yamamura, Keiichiro, et autres
Publié: (2024)
par: Yamamura, Keiichiro, et autres
Publié: (2024)
Norm Anchors Make Model Edits Last
par: Liu, Mingda, et autres
Publié: (2026)
par: Liu, Mingda, et autres
Publié: (2026)
Outlier-Resistant Estimators for Average Treatment Effect in Causal Inference
par: Harada, Kazuharu, et autres
Publié: (2021)
par: Harada, Kazuharu, et autres
Publié: (2021)
Sample-Efficient Hypergradient Estimation for Decentralized Bi-Level Reinforcement Learning
par: Kudo, Mikoto, et autres
Publié: (2026)
par: Kudo, Mikoto, et autres
Publié: (2026)
Distance restricted matching extensions in regular non-bipartite graphs
par: Fujisawa, Jun
Publié: (2025)
par: Fujisawa, Jun
Publié: (2025)
Some congruences of calibers of real quadratic fields
par: Fujisawa, Naoto
Publié: (2024)
par: Fujisawa, Naoto
Publié: (2024)
Preface to the Journal of Dermatology special issue: The changing landscape of melanoma treatment
par: Yasuhiro Fujisawa
Publié: (2024)
par: Yasuhiro Fujisawa
Publié: (2024)
Modification of Sorbitol MacConkey Medium Containing Cefixime and Tellurite for Isolation of Escherichia coli O157 : H7 from Radish Sprouts. / Tomohiko Fujisawa
par: Fujisawa, Tomohiko
Publié: (2000)
par: Fujisawa, Tomohiko
Publié: (2000)
Bathymetric surveys under the continental shelf surveys from FY 2003 to FY 2008.
par: Fujisawa, Miyuki
Publié: (2009)
par: Fujisawa, Miyuki
Publié: (2009)
Learning-based Event-triggered MPC with Gaussian processes under terminal constraints
par: Onoue, Yuga, et autres
Publié: (2021)
par: Onoue, Yuga, et autres
Publié: (2021)
Superpixel Attack: Enhancing Black-box Adversarial Attack with Image-driven Division Areas
par: Oe, Issa, et autres
Publié: (2025)
par: Oe, Issa, et autres
Publié: (2025)
A Provable Approach for End-to-End Safe Reinforcement Learning
par: Wachi, Akifumi, et autres
Publié: (2025)
par: Wachi, Akifumi, et autres
Publié: (2025)
Reuse of effluent from dyeing polyester fibers by thermal fixation using acid-based colors
par: Ronaldo Shiguemi Fujisawa
Publié: (2011)
par: Ronaldo Shiguemi Fujisawa
Publié: (2011)
#YoSoy132: rastros de vídeos
par: Katia Sayuri Fujisawa
Publié: (2018)
par: Katia Sayuri Fujisawa
Publié: (2018)
A Relative-Budget Theory for Reinforcement Learning with Verifiable Rewards in Large Language Model Reasoning
par: Wachi, Akifumi, et autres
Publié: (2026)
par: Wachi, Akifumi, et autres
Publié: (2026)
OneComp: One-Line Revolution for Generative AI Model Compression
par: Ichikawa, Yuma, et autres
Publié: (2026)
par: Ichikawa, Yuma, et autres
Publié: (2026)
Enhancing Quantum-ready QUBO-based Suppression for Object Detection with Appearance and Confidence Features
par: Yamamura, Keiichiro, et autres
Publié: (2025)
par: Yamamura, Keiichiro, et autres
Publié: (2025)
D2-LoRA: A Synergistic Approach to Differential and Directional Low-Rank Adaptation
par: Fujisawa, Nozomu, et autres
Publié: (2026)
par: Fujisawa, Nozomu, et autres
Publié: (2026)
Sparse Linear Regression when Noises and Covariates are Heavy-Tailed and Contaminated by Outliers
par: Sasai, Takeyuki, et autres
Publié: (2024)
par: Sasai, Takeyuki, et autres
Publié: (2024)
PAC-Bayes Analysis for Recalibration in Classification
par: Fujisawa, Masahiro, et autres
Publié: (2024)
par: Fujisawa, Masahiro, et autres
Publié: (2024)
Information-Theoretic Generalization Bounds for Sequential Decision Making
par: Futami, Futoshi, et autres
Publié: (2026)
par: Futami, Futoshi, et autres
Publié: (2026)
An Easily Tunable Approach to Robust and Sparse High-Dimensional Linear Regression
par: Sasai, Takeyuki, et autres
Publié: (2025)
par: Sasai, Takeyuki, et autres
Publié: (2025)
Robust estimation with Lasso when outputs are adversarially contaminated
par: Sasai, Takeyuki, et autres
Publié: (2020)
par: Sasai, Takeyuki, et autres
Publié: (2020)
Robust and Sparse Regression in GLM by Stochastic Optimization
par: Kawashima, Takayuki, et autres
Publié: (2018)
par: Kawashima, Takayuki, et autres
Publié: (2018)
Estimation of Structural Causal Model via Sparsely Mixing Independent Component Analysis
par: Harada, Kazuharu, et autres
Publié: (2020)
par: Harada, Kazuharu, et autres
Publié: (2020)
Surrogate Graph Partitioning for Spatial Prediction
par: Shikuri, Yuta, et autres
Publié: (2025)
par: Shikuri, Yuta, et autres
Publié: (2025)
$L_2$-Regularized Empirical Risk Minimization Guarantees Small Smooth Calibration Error
par: Fujisawa, Masahiro, et autres
Publié: (2025)
par: Fujisawa, Masahiro, et autres
Publié: (2025)
Outlier Robust and Sparse Estimation of Linear Regression Coefficients
par: Sasai, Takeyuki, et autres
Publié: (2022)
par: Sasai, Takeyuki, et autres
Publié: (2022)
Variation of mixed Hodge structure and its applications
par: Fujino, Osamu, et autres
Publié: (2023)
par: Fujino, Osamu, et autres
Publié: (2023)
Adversarial robust weighted Huber regression
par: Sasai, Takeyuki, et autres
Publié: (2021)
par: Sasai, Takeyuki, et autres
Publié: (2021)
Adaptive Lasso, Transfer Lasso, and Beyond: An Asymptotic Perspective
par: Takada, Masaaki, et autres
Publié: (2023)
par: Takada, Masaaki, et autres
Publié: (2023)
On the Kodaira dimension
par: Fujino, Osamu, et autres
Publié: (2024)
par: Fujino, Osamu, et autres
Publié: (2024)
Learning Survival Models with Right-Censored Reporting Delays
par: Shikuri, Yuta, et autres
Publié: (2025)
par: Shikuri, Yuta, et autres
Publié: (2025)
Documents similaires
-
Offline Guarded Safe Reinforcement Learning for Medical Treatment Optimization Strategies
par: Yan, Runze, et autres
Publié: (2025) -
More Than Bits: Multi-Envelope Double Binary Factorization for Extreme Quantization
par: Ichikawa, Yuma, et autres
Publié: (2025) -
Signs Beat Floats: Low-Rank Double-Binary Adaptation for On-Device Fine-Tuning
par: Fujisawa, Yoshihiko, et autres
Publié: (2026) -
Flipping-based Policy for Chance-Constrained Markov Decision Processes
par: Shen, Xun, et autres
Publié: (2024) -
A Survey of Constraint Formulations in Safe Reinforcement Learning
par: Wachi, Akifumi, et autres
Publié: (2024)