MoMA: Model-based Mirror Ascent for Offline Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hong, Mao, Zhang, Zhiyue, Wu, Yue, Xu, Yanxun |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
POLAR: A Pessimistic Model-based Policy Learning Algorithm for Dynamic Treatment Regimes
par: Zhang, Ruijia, et autres
Publié: (2025)
par: Zhang, Ruijia, et autres
Publié: (2025)
TransformerLSR: Attentive Joint Model of Longitudinal Data, Survival, and Recurrent Events with Concurrent Latent Structure
par: Zhang, Zhiyue, et autres
Publié: (2024)
par: Zhang, Zhiyue, et autres
Publié: (2024)
Pessimism in the Face of Confounders: Provably Efficient Offline Reinforcement Learning in Partially Observable Markov Decision Processes
par: Lu, Miao, et autres
Publié: (2022)
par: Lu, Miao, et autres
Publié: (2022)
Learning Linear Polytree Structural Equation Models
par: Lou, Xingmei, et autres
Publié: (2021)
par: Lou, Xingmei, et autres
Publié: (2021)
Model-based causal feature selection for general response types
par: Kook, Lucas, et autres
Publié: (2023)
par: Kook, Lucas, et autres
Publié: (2023)
Interaction Screening and Pseudolikelihood Approaches for Tensor Learning in Ising Models
par: Liu, Tianyu, et autres
Publié: (2023)
par: Liu, Tianyu, et autres
Publié: (2023)
Robust Unsupervised Multi-task and Transfer Learning on Gaussian Mixture Models
par: Tian, Ye, et autres
Publié: (2022)
par: Tian, Ye, et autres
Publié: (2022)
Transfer Learning for Causal Effect Estimation
par: Wei, Song, et autres
Publié: (2023)
par: Wei, Song, et autres
Publié: (2023)
Robustness Against Weak or Invalid Instruments: Exploring Nonlinear Treatment Models with Machine Learning
par: Guo, Zijian, et autres
Publié: (2022)
par: Guo, Zijian, et autres
Publié: (2022)
Transfer Learning for High-dimensional Quantile Regression with Distribution Shift
par: Bai, Ruiqi, et autres
Publié: (2024)
par: Bai, Ruiqi, et autres
Publié: (2024)
Preventing Model Collapse Under Overparametrization: Optimal Mixing Ratios for Interpolation Learning and Ridge Regression
par: Garg, Anvit, et autres
Publié: (2025)
par: Garg, Anvit, et autres
Publié: (2025)
Jointly Modeling and Clustering Tensors in High Dimensions
par: Cai, Biao, et autres
Publié: (2021)
par: Cai, Biao, et autres
Publié: (2021)
Winners with Confidence: Discrete Argmin Inference with an Application to Model Selection
par: Zhang, Tianyu, et autres
Publié: (2024)
par: Zhang, Tianyu, et autres
Publié: (2024)
Model-agnostic information transfer and fusion for classification with label noise
par: Guojun, Zhu, et autres
Publié: (2026)
par: Guojun, Zhu, et autres
Publié: (2026)
Disentangled Feature Importance
par: Du, Jin-Hong, et autres
Publié: (2025)
par: Du, Jin-Hong, et autres
Publié: (2025)
The Decaying Missing-at-Random Framework: Model Doubly Robust Causal Inference with Partially Labeled Data
par: Zhang, Yuqian, et autres
Publié: (2023)
par: Zhang, Yuqian, et autres
Publié: (2023)
On Ranking-based Tests of Independence
par: Limnios, Myrto, et autres
Publié: (2024)
par: Limnios, Myrto, et autres
Publié: (2024)
BELIEF in Dependence: Leveraging Atomic Linearity in Data Bits for Rethinking Generalized Linear Models
par: Brown, Benjamin, et autres
Publié: (2022)
par: Brown, Benjamin, et autres
Publié: (2022)
Higher-order accurate two-sample network inference and network hashing
par: Shao, Meijia, et autres
Publié: (2022)
par: Shao, Meijia, et autres
Publié: (2022)
Perturbation-based Effect Measures for Compositional Data
par: Lundborg, Anton Rask, et autres
Publié: (2023)
par: Lundborg, Anton Rask, et autres
Publié: (2023)
Semi-parametric inference based on adaptively collected data
par: Lin, Licong, et autres
Publié: (2023)
par: Lin, Licong, et autres
Publié: (2023)
Augmentation Invariant Manifold Learning
par: Wang, Shulei
Publié: (2022)
par: Wang, Shulei
Publié: (2022)
Variance-based sensitivity analysis in the presence of correlated input variables
par: Most, Thomas
Publié: (2024)
par: Most, Thomas
Publié: (2024)
Corrected generalized cross-validation for finite ensembles of penalized estimators
par: Bellec, Pierre C., et autres
Publié: (2023)
par: Bellec, Pierre C., et autres
Publié: (2023)
Markov Equivalence and Consistency in Differentiable Structure Learning
par: Deng, Chang, et autres
Publié: (2024)
par: Deng, Chang, et autres
Publié: (2024)
Minimax Regret Learning for Data with Heterogeneous Subgroups
par: Mo, Weibin, et autres
Publié: (2024)
par: Mo, Weibin, et autres
Publié: (2024)
Multi-environment Invariance Learning with Missing Data
par: Jia, Yiran, et autres
Publié: (2026)
par: Jia, Yiran, et autres
Publié: (2026)
Extrapolation in Statistical Learning with Extreme Value Theory
par: Engelke, Sebastian, et autres
Publié: (2026)
par: Engelke, Sebastian, et autres
Publié: (2026)
Transfer Learning for Nonparametric Contextual Dynamic Pricing
par: Wang, Fan, et autres
Publié: (2025)
par: Wang, Fan, et autres
Publié: (2025)
Network Learning with Semi-relaxed Gromov-Wasserstein
par: Dufour, Charles, et autres
Publié: (2026)
par: Dufour, Charles, et autres
Publié: (2026)
An introduction to Causal Modelling
par: Baishya, Gauranga Kumar
Publié: (2025)
par: Baishya, Gauranga Kumar
Publié: (2025)
A Tutorial on Doubly Robust Learning for Causal Inference
par: Hlynsson, Hlynur Davíð
Publié: (2024)
par: Hlynsson, Hlynur Davíð
Publié: (2024)
Learning large softmax mixtures with warm start EM
par: Bing, Xin, et autres
Publié: (2024)
par: Bing, Xin, et autres
Publié: (2024)
Knowledge-Embedded Latent Projection for Robust Representation Learning
par: Tang, Weijing, et autres
Publié: (2026)
par: Tang, Weijing, et autres
Publié: (2026)
Hierarchical Clustering With Confidence
par: Wu, Di, et autres
Publié: (2025)
par: Wu, Di, et autres
Publié: (2025)
Deep Learning of Multivariate Extremes via a Geometric Representation
par: Murphy-Barltrop, Callum J. R., et autres
Publié: (2024)
par: Murphy-Barltrop, Callum J. R., et autres
Publié: (2024)
Generalization Bounds and Stopping Rules for Learning with Self-Selected Data
par: Rodemann, Julian, et autres
Publié: (2025)
par: Rodemann, Julian, et autres
Publié: (2025)
Differentiable Structure Learning and Causal Discovery for General Binary Data
par: Deng, Chang, et autres
Publié: (2025)
par: Deng, Chang, et autres
Publié: (2025)
Learning under Latent Group Sparsity via Diffusion on Networks
par: Ghosh, Subhroshekhar, et autres
Publié: (2025)
par: Ghosh, Subhroshekhar, et autres
Publié: (2025)
Theoretical Analysis of Engression and Reverse Markov Engression
par: Huang, Jiaqi, et autres
Publié: (2026)
par: Huang, Jiaqi, et autres
Publié: (2026)
Documents similaires
-
POLAR: A Pessimistic Model-based Policy Learning Algorithm for Dynamic Treatment Regimes
par: Zhang, Ruijia, et autres
Publié: (2025) -
TransformerLSR: Attentive Joint Model of Longitudinal Data, Survival, and Recurrent Events with Concurrent Latent Structure
par: Zhang, Zhiyue, et autres
Publié: (2024) -
Pessimism in the Face of Confounders: Provably Efficient Offline Reinforcement Learning in Partially Observable Markov Decision Processes
par: Lu, Miao, et autres
Publié: (2022) -
Learning Linear Polytree Structural Equation Models
par: Lou, Xingmei, et autres
Publié: (2021) -
Model-based causal feature selection for general response types
par: Kook, Lucas, et autres
Publié: (2023)