Vector-Valued Distributional Reinforcement Learning Policy Evaluation: A Hilbert Space Embedding Approach
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mohammadi, Mehrdad, Zheng, Qi, Zhu, Ruoqing |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Reinforcement Learning with Continuous Actions Under Unmeasured Confounding
par: Li, Yuhan, et autres
Publié: (2025)
par: Li, Yuhan, et autres
Publié: (2025)
Distributional Off-Policy Evaluation with Deep Quantile Process Regression
par: Kuang, Qi, et autres
Publié: (2026)
par: Kuang, Qi, et autres
Publié: (2026)
Distributional Random Forests for Complex Survey Designs on Reproducing Kernel Hilbert Spaces
par: Zou, Yating, et autres
Publié: (2025)
par: Zou, Yating, et autres
Publié: (2025)
Generative Conformal Prediction with Vectorized Non-Conformity Scores
par: Zheng, Minxing, et autres
Publié: (2024)
par: Zheng, Minxing, et autres
Publié: (2024)
Wasserstein Gradient Boosting: A Framework for Distribution-Valued Supervised Learning
par: Matsubara, Takuo
Publié: (2024)
par: Matsubara, Takuo
Publié: (2024)
Fast and Provably Accurate Sequential Designs using Hilbert Space Gaussian Processes
par: Zhu, Huanyan, et autres
Publié: (2026)
par: Zhu, Huanyan, et autres
Publié: (2026)
DFNN: A Deep Fréchet Neural Network Framework for Learning Metric-Space-Valued Responses
par: Kim, Kyum, et autres
Publié: (2025)
par: Kim, Kyum, et autres
Publié: (2025)
Cluster and then Embed: A Modular Approach for Visualization
par: Coda, Elizabeth, et autres
Publié: (2025)
par: Coda, Elizabeth, et autres
Publié: (2025)
A General Control-Theoretic Approach for Reinforcement Learning: Theory and Algorithms
par: Chen, Weiqin, et autres
Publié: (2024)
par: Chen, Weiqin, et autres
Publié: (2024)
Combining Experimental and Historical Data for Policy Evaluation
par: Li, Ting, et autres
Publié: (2024)
par: Li, Ting, et autres
Publié: (2024)
Detection of Model-based Planted Pseudo-cliques in Random Dot Product Graphs by the Adjacency Spectral Embedding and the Graph Encoder Embedding
par: Qi, Tong, et autres
Publié: (2023)
par: Qi, Tong, et autres
Publié: (2023)
DANIEL: A Distributed and Scalable Approach for Global Representation Learning with EHR Applications
par: Wang, Zebin, et autres
Publié: (2025)
par: Wang, Zebin, et autres
Publié: (2025)
MMDCP: A Distribution-free Approach to Outlier Detection and Classification with Coverage Guarantees and SCW-FDR Control
par: Lin, Youwu, et autres
Publié: (2025)
par: Lin, Youwu, et autres
Publié: (2025)
STEEL: Singularity-aware Reinforcement Learning
par: Chen, Xiaohong, et autres
Publié: (2023)
par: Chen, Xiaohong, et autres
Publié: (2023)
Model-Free Kernel Conformal Depth Measures Algorithm for Uncertainty Quantification in Regression Models in Separable Hilbert Spaces
par: Matabuena, Marcos, et autres
Publié: (2025)
par: Matabuena, Marcos, et autres
Publié: (2025)
An Interpretable and Efficient Infinite-Order Vector Autoregressive Model for High-Dimensional Time Series
par: Zheng, Yao
Publié: (2022)
par: Zheng, Yao
Publié: (2022)
Doubly Robust Fusion of Many Treatments for Policy Learning
par: Zhu, Ke, et autres
Publié: (2025)
par: Zhu, Ke, et autres
Publié: (2025)
Policy Learning with Distributional Welfare
par: Cui, Yifan, et autres
Publié: (2023)
par: Cui, Yifan, et autres
Publié: (2023)
Data-Automated Policy Learning for Nonlinear Welfare
par: Ai, Chunrong, et autres
Publié: (2026)
par: Ai, Chunrong, et autres
Publié: (2026)
Designing Time Series Experiments in A/B Testing with Transformer Reinforcement Learning
par: Wu, Xiangkun, et autres
Publié: (2026)
par: Wu, Xiangkun, et autres
Publié: (2026)
End-to-End Deep Learning for Predicting Metric Space-Valued Outputs
par: Zhou, Yidong, et autres
Publié: (2025)
par: Zhou, Yidong, et autres
Publié: (2025)
On Large-Scale Multiple Testing Over Networks: An Asymptotic Approach
par: Pournaderi, Mehrdad, et autres
Publié: (2022)
par: Pournaderi, Mehrdad, et autres
Publié: (2022)
Individualized Policy Evaluation and Learning under Clustered Network Interference
par: Zhang, Yi, et autres
Publié: (2023)
par: Zhang, Yi, et autres
Publié: (2023)
Distribution-Free Robust Predict-Then-Optimize in Function Spaces
par: Patel, Yash, et autres
Publié: (2026)
par: Patel, Yash, et autres
Publié: (2026)
Distributional Matrix Completion via Nearest Neighbors in the Wasserstein Space
par: Feitelberg, Jacob, et autres
Publié: (2024)
par: Feitelberg, Jacob, et autres
Publié: (2024)
Sparse Learning and Class Probability Estimation with Weighted Support Vector Machines
par: Zeng, Liyun, et autres
Publié: (2023)
par: Zeng, Liyun, et autres
Publié: (2023)
Integrating Active Learning in Causal Inference with Interference: A Novel Approach in Online Experiments
par: Zhu, Hongtao, et autres
Publié: (2024)
par: Zhu, Hongtao, et autres
Publié: (2024)
Conditional Distribution Compression via the Kernel Conditional Mean Embedding
par: Broadbent, Dominic, et autres
Publié: (2025)
par: Broadbent, Dominic, et autres
Publié: (2025)
Externally Valid Policy Evaluation Combining Trial and Observational Data
par: Ek, Sofia, et autres
Publié: (2023)
par: Ek, Sofia, et autres
Publié: (2023)
Federated Offline Reinforcement Learning
par: Zhou, Doudou, et autres
Publié: (2022)
par: Zhou, Doudou, et autres
Publié: (2022)
Mode and Ridge Estimation in Euclidean and Directional Product Spaces: A Mean Shift Approach
par: Zhang, Yikun, et autres
Publié: (2021)
par: Zhang, Yikun, et autres
Publié: (2021)
Towards Optimal Environmental Policies: Policy Learning under Arbitrary Bipartite Network Interference
par: Kim, Raphael C., et autres
Publié: (2024)
par: Kim, Raphael C., et autres
Publié: (2024)
Vector Quantile Regression on Manifolds
par: Pegoraro, Marco, et autres
Publié: (2023)
par: Pegoraro, Marco, et autres
Publié: (2023)
DCILP: A Distributed Approach for Large-Scale Causal Structure Learning
par: Dong, Shuyu, et autres
Publié: (2024)
par: Dong, Shuyu, et autres
Publié: (2024)
Off-Policy Evaluation and Learning for Survival Outcomes under Censoring
par: Kubota, Kohsuke, et autres
Publié: (2026)
par: Kubota, Kohsuke, et autres
Publié: (2026)
Causal Decomposition Analysis with Synergistic Interventions: A Triply-Robust Machine Learning Approach to Addressing Multiple Dimensions of Social Disparities
par: Park, Soojin, et autres
Publié: (2025)
par: Park, Soojin, et autres
Publié: (2025)
Scalable Bayesian Structure Learning for Gaussian Graphical Models Using Marginal Pseudo-likelihood
par: Mohammadi, Reza, et autres
Publié: (2023)
par: Mohammadi, Reza, et autres
Publié: (2023)
Statistical Learning for Latent Embedding Alignment with Application to Brain Encoding and Decoding
par: Xu, Shuoxun, et autres
Publié: (2026)
par: Xu, Shuoxun, et autres
Publié: (2026)
Distributional Evaluation of Generative Models via Relative Density Ratio
par: Xu, Yuliang, et autres
Publié: (2025)
par: Xu, Yuliang, et autres
Publié: (2025)
Position: Benchmarking is Limited in Reinforcement Learning Research
par: Jordan, Scott M., et autres
Publié: (2024)
par: Jordan, Scott M., et autres
Publié: (2024)
Documents similaires
-
Reinforcement Learning with Continuous Actions Under Unmeasured Confounding
par: Li, Yuhan, et autres
Publié: (2025) -
Distributional Off-Policy Evaluation with Deep Quantile Process Regression
par: Kuang, Qi, et autres
Publié: (2026) -
Distributional Random Forests for Complex Survey Designs on Reproducing Kernel Hilbert Spaces
par: Zou, Yating, et autres
Publié: (2025) -
Generative Conformal Prediction with Vectorized Non-Conformity Scores
par: Zheng, Minxing, et autres
Publié: (2024) -
Wasserstein Gradient Boosting: A Framework for Distribution-Valued Supervised Learning
par: Matsubara, Takuo
Publié: (2024)