MedGym:A Unified Continuous-Time Benchmark for Dynamic Medical Treatment Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Yuepeng, Kawano, Ken, Zhou, Yongqi, Fujisawa, Yoshihiko, Weiss, Richard, Wachi, Akifumi, Fujisawa, Katsuki, Chen, Ying, Sadria, Mehrshad, Liu, Xin, Kim, Kyoung-Sook, Hu, Xiao, Gros, Sebastien, Shen, Xun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Offline Guarded Safe Reinforcement Learning for Medical Treatment Optimization Strategies
di: Yan, Runze, et al.
Pubblicazione: (2025)
di: Yan, Runze, et al.
Pubblicazione: (2025)
More Than Bits: Multi-Envelope Double Binary Factorization for Extreme Quantization
di: Ichikawa, Yuma, et al.
Pubblicazione: (2025)
di: Ichikawa, Yuma, et al.
Pubblicazione: (2025)
Signs Beat Floats: Low-Rank Double-Binary Adaptation for On-Device Fine-Tuning
di: Fujisawa, Yoshihiko, et al.
Pubblicazione: (2026)
di: Fujisawa, Yoshihiko, et al.
Pubblicazione: (2026)
Flipping-based Policy for Chance-Constrained Markov Decision Processes
di: Shen, Xun, et al.
Pubblicazione: (2024)
di: Shen, Xun, et al.
Pubblicazione: (2024)
A Survey of Constraint Formulations in Safe Reinforcement Learning
di: Wachi, Akifumi, et al.
Pubblicazione: (2024)
di: Wachi, Akifumi, et al.
Pubblicazione: (2024)
Long-term Safe Reinforcement Learning with Binary Feedback
di: Wachi, Akifumi, et al.
Pubblicazione: (2024)
di: Wachi, Akifumi, et al.
Pubblicazione: (2024)
Target Return Optimizer for Multi-Game Decision Transformer
di: Tatematsu, Kensuke, et al.
Pubblicazione: (2025)
di: Tatematsu, Kensuke, et al.
Pubblicazione: (2025)
Enhancing Output Diversity Improves Conjugate Gradient-based Adversarial Attacks
di: Yamamura, Keiichiro, et al.
Pubblicazione: (2024)
di: Yamamura, Keiichiro, et al.
Pubblicazione: (2024)
Norm Anchors Make Model Edits Last
di: Liu, Mingda, et al.
Pubblicazione: (2026)
di: Liu, Mingda, et al.
Pubblicazione: (2026)
Outlier-Resistant Estimators for Average Treatment Effect in Causal Inference
di: Harada, Kazuharu, et al.
Pubblicazione: (2021)
di: Harada, Kazuharu, et al.
Pubblicazione: (2021)
Sample-Efficient Hypergradient Estimation for Decentralized Bi-Level Reinforcement Learning
di: Kudo, Mikoto, et al.
Pubblicazione: (2026)
di: Kudo, Mikoto, et al.
Pubblicazione: (2026)
Distance restricted matching extensions in regular non-bipartite graphs
di: Fujisawa, Jun
Pubblicazione: (2025)
di: Fujisawa, Jun
Pubblicazione: (2025)
Some congruences of calibers of real quadratic fields
di: Fujisawa, Naoto
Pubblicazione: (2024)
di: Fujisawa, Naoto
Pubblicazione: (2024)
Preface to the Journal of Dermatology special issue: The changing landscape of melanoma treatment
di: Yasuhiro Fujisawa
Pubblicazione: (2024)
di: Yasuhiro Fujisawa
Pubblicazione: (2024)
Modification of Sorbitol MacConkey Medium Containing Cefixime and Tellurite for Isolation of Escherichia coli O157 : H7 from Radish Sprouts. / Tomohiko Fujisawa
di: Fujisawa, Tomohiko
Pubblicazione: (2000)
di: Fujisawa, Tomohiko
Pubblicazione: (2000)
Bathymetric surveys under the continental shelf surveys from FY 2003 to FY 2008.
di: Fujisawa, Miyuki
Pubblicazione: (2009)
di: Fujisawa, Miyuki
Pubblicazione: (2009)
Learning-based Event-triggered MPC with Gaussian processes under terminal constraints
di: Onoue, Yuga, et al.
Pubblicazione: (2021)
di: Onoue, Yuga, et al.
Pubblicazione: (2021)
Superpixel Attack: Enhancing Black-box Adversarial Attack with Image-driven Division Areas
di: Oe, Issa, et al.
Pubblicazione: (2025)
di: Oe, Issa, et al.
Pubblicazione: (2025)
A Provable Approach for End-to-End Safe Reinforcement Learning
di: Wachi, Akifumi, et al.
Pubblicazione: (2025)
di: Wachi, Akifumi, et al.
Pubblicazione: (2025)
Reuse of effluent from dyeing polyester fibers by thermal fixation using acid-based colors
di: Ronaldo Shiguemi Fujisawa
Pubblicazione: (2011)
di: Ronaldo Shiguemi Fujisawa
Pubblicazione: (2011)
#YoSoy132: rastros de vídeos
di: Katia Sayuri Fujisawa
Pubblicazione: (2018)
di: Katia Sayuri Fujisawa
Pubblicazione: (2018)
A Relative-Budget Theory for Reinforcement Learning with Verifiable Rewards in Large Language Model Reasoning
di: Wachi, Akifumi, et al.
Pubblicazione: (2026)
di: Wachi, Akifumi, et al.
Pubblicazione: (2026)
OneComp: One-Line Revolution for Generative AI Model Compression
di: Ichikawa, Yuma, et al.
Pubblicazione: (2026)
di: Ichikawa, Yuma, et al.
Pubblicazione: (2026)
Enhancing Quantum-ready QUBO-based Suppression for Object Detection with Appearance and Confidence Features
di: Yamamura, Keiichiro, et al.
Pubblicazione: (2025)
di: Yamamura, Keiichiro, et al.
Pubblicazione: (2025)
D2-LoRA: A Synergistic Approach to Differential and Directional Low-Rank Adaptation
di: Fujisawa, Nozomu, et al.
Pubblicazione: (2026)
di: Fujisawa, Nozomu, et al.
Pubblicazione: (2026)
Sparse Linear Regression when Noises and Covariates are Heavy-Tailed and Contaminated by Outliers
di: Sasai, Takeyuki, et al.
Pubblicazione: (2024)
di: Sasai, Takeyuki, et al.
Pubblicazione: (2024)
PAC-Bayes Analysis for Recalibration in Classification
di: Fujisawa, Masahiro, et al.
Pubblicazione: (2024)
di: Fujisawa, Masahiro, et al.
Pubblicazione: (2024)
Information-Theoretic Generalization Bounds for Sequential Decision Making
di: Futami, Futoshi, et al.
Pubblicazione: (2026)
di: Futami, Futoshi, et al.
Pubblicazione: (2026)
An Easily Tunable Approach to Robust and Sparse High-Dimensional Linear Regression
di: Sasai, Takeyuki, et al.
Pubblicazione: (2025)
di: Sasai, Takeyuki, et al.
Pubblicazione: (2025)
Robust estimation with Lasso when outputs are adversarially contaminated
di: Sasai, Takeyuki, et al.
Pubblicazione: (2020)
di: Sasai, Takeyuki, et al.
Pubblicazione: (2020)
Robust and Sparse Regression in GLM by Stochastic Optimization
di: Kawashima, Takayuki, et al.
Pubblicazione: (2018)
di: Kawashima, Takayuki, et al.
Pubblicazione: (2018)
Estimation of Structural Causal Model via Sparsely Mixing Independent Component Analysis
di: Harada, Kazuharu, et al.
Pubblicazione: (2020)
di: Harada, Kazuharu, et al.
Pubblicazione: (2020)
Surrogate Graph Partitioning for Spatial Prediction
di: Shikuri, Yuta, et al.
Pubblicazione: (2025)
di: Shikuri, Yuta, et al.
Pubblicazione: (2025)
$L_2$-Regularized Empirical Risk Minimization Guarantees Small Smooth Calibration Error
di: Fujisawa, Masahiro, et al.
Pubblicazione: (2025)
di: Fujisawa, Masahiro, et al.
Pubblicazione: (2025)
Outlier Robust and Sparse Estimation of Linear Regression Coefficients
di: Sasai, Takeyuki, et al.
Pubblicazione: (2022)
di: Sasai, Takeyuki, et al.
Pubblicazione: (2022)
Variation of mixed Hodge structure and its applications
di: Fujino, Osamu, et al.
Pubblicazione: (2023)
di: Fujino, Osamu, et al.
Pubblicazione: (2023)
Adversarial robust weighted Huber regression
di: Sasai, Takeyuki, et al.
Pubblicazione: (2021)
di: Sasai, Takeyuki, et al.
Pubblicazione: (2021)
Adaptive Lasso, Transfer Lasso, and Beyond: An Asymptotic Perspective
di: Takada, Masaaki, et al.
Pubblicazione: (2023)
di: Takada, Masaaki, et al.
Pubblicazione: (2023)
On the Kodaira dimension
di: Fujino, Osamu, et al.
Pubblicazione: (2024)
di: Fujino, Osamu, et al.
Pubblicazione: (2024)
Learning Survival Models with Right-Censored Reporting Delays
di: Shikuri, Yuta, et al.
Pubblicazione: (2025)
di: Shikuri, Yuta, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Offline Guarded Safe Reinforcement Learning for Medical Treatment Optimization Strategies
di: Yan, Runze, et al.
Pubblicazione: (2025) -
More Than Bits: Multi-Envelope Double Binary Factorization for Extreme Quantization
di: Ichikawa, Yuma, et al.
Pubblicazione: (2025) -
Signs Beat Floats: Low-Rank Double-Binary Adaptation for On-Device Fine-Tuning
di: Fujisawa, Yoshihiko, et al.
Pubblicazione: (2026) -
Flipping-based Policy for Chance-Constrained Markov Decision Processes
di: Shen, Xun, et al.
Pubblicazione: (2024) -
A Survey of Constraint Formulations in Safe Reinforcement Learning
di: Wachi, Akifumi, et al.
Pubblicazione: (2024)