Distributional Reinforcement Learning via the Cramér Distance
Fuente:
arXiv
Salvato in:
| Autori principali: | Aziz, Vanya, Nowak, Ivo, Hendrix, E. M. T |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
StructRL: Recovering Dynamic Programming Structure from Learning Dynamics in Distributional Reinforcement Learning
di: Nowak, Ivo
Pubblicazione: (2026)
di: Nowak, Ivo
Pubblicazione: (2026)
Newton-Flow Particle Filters based on Generalized Cramér Distance
di: Hanebeck, Uwe D.
Pubblicazione: (2025)
di: Hanebeck, Uwe D.
Pubblicazione: (2025)
A Spectral Revisit of the Distributional Bellman Operator under the Cramér Metric
di: Wang, Keru, et al.
Pubblicazione: (2026)
di: Wang, Keru, et al.
Pubblicazione: (2026)
Compositional Instruction Following with Language Models and Reinforcement Learning
di: Cohen, Vanya, et al.
Pubblicazione: (2025)
di: Cohen, Vanya, et al.
Pubblicazione: (2025)
Data-driven transport modelling without overfit
di: Vanya, Peter, et al.
Pubblicazione: (2026)
di: Vanya, Peter, et al.
Pubblicazione: (2026)
Distributionally Robust Multi-Task Reinforcement Learning via Adaptive Task Sampling
di: Corrado, Nicholas E., et al.
Pubblicazione: (2026)
di: Corrado, Nicholas E., et al.
Pubblicazione: (2026)
Parameter-Efficient Distributional RL via Normalizing Flows and a Geometry-Aware Cramér Surrogate
di: C., Simo Alami, et al.
Pubblicazione: (2025)
di: C., Simo Alami, et al.
Pubblicazione: (2025)
Efficient Distribution Learning with Error Bounds in Wasserstein Distance
di: Figueiredo, Eduardo, et al.
Pubblicazione: (2026)
di: Figueiredo, Eduardo, et al.
Pubblicazione: (2026)
Distributional Inverse Reinforcement Learning
di: Wu, Feiyang, et al.
Pubblicazione: (2025)
di: Wu, Feiyang, et al.
Pubblicazione: (2025)
Transformer-based Multi-agent Reinforcement Learning for Separation Assurance in Structured and Unstructured Airspaces
di: Aziz, Arsyi, et al.
Pubblicazione: (2026)
di: Aziz, Arsyi, et al.
Pubblicazione: (2026)
Feature Selection via Maximizing Distances between Class Conditional Distributions
di: Cao, Chunxu, et al.
Pubblicazione: (2024)
di: Cao, Chunxu, et al.
Pubblicazione: (2024)
Efficient Learning Under Density Shift in Incremental Settings Using Cramér-Rao-Based Regularization
di: Khan, Behraj, et al.
Pubblicazione: (2025)
di: Khan, Behraj, et al.
Pubblicazione: (2025)
AHA: Human-Assisted Out-of-Distribution Generalization and Detection
di: Bai, Haoyue, et al.
Pubblicazione: (2024)
di: Bai, Haoyue, et al.
Pubblicazione: (2024)
Estimation and Inference in Distributional Reinforcement Learning
di: Zhang, Liangyu, et al.
Pubblicazione: (2023)
di: Zhang, Liangyu, et al.
Pubblicazione: (2023)
Efficient Active Learning with Abstention
di: Zhu, Yinglun, et al.
Pubblicazione: (2022)
di: Zhu, Yinglun, et al.
Pubblicazione: (2022)
On the attainment of the Wasserstein--Cramer--Rao lower bound
di: Nishimori, Hayato, et al.
Pubblicazione: (2025)
di: Nishimori, Hayato, et al.
Pubblicazione: (2025)
Cramer-Rao Bounds for Laplacian Matrix Estimation
di: Halihal, Morad, et al.
Pubblicazione: (2025)
di: Halihal, Morad, et al.
Pubblicazione: (2025)
Local Pairwise Distance Matching for Backpropagation-Free Reinforcement Learning
di: Tanneberg, Daniel
Pubblicazione: (2025)
di: Tanneberg, Daniel
Pubblicazione: (2025)
Value-Distributional Model-Based Reinforcement Learning
di: Luis, Carlos E., et al.
Pubblicazione: (2023)
di: Luis, Carlos E., et al.
Pubblicazione: (2023)
A Cramér-von Mises Approach to Incentivizing Truthful Data Sharing
di: Clinton, Alex, et al.
Pubblicazione: (2025)
di: Clinton, Alex, et al.
Pubblicazione: (2025)
Distributional Reinforcement Learning with Diffusion Bridge Critics
di: Ding, Shutong, et al.
Pubblicazione: (2026)
di: Ding, Shutong, et al.
Pubblicazione: (2026)
Distributional Reinforcement Learning with Regularized Wasserstein Loss
di: Sun, Ke, et al.
Pubblicazione: (2022)
di: Sun, Ke, et al.
Pubblicazione: (2022)
Explore Reinforced: Equilibrium Approximation with Reinforcement Learning
di: Yu, Ryan, et al.
Pubblicazione: (2024)
di: Yu, Ryan, et al.
Pubblicazione: (2024)
Active Learning with Neural Networks: Insights from Nonparametric Statistics
di: Zhu, Yinglun, et al.
Pubblicazione: (2022)
di: Zhu, Yinglun, et al.
Pubblicazione: (2022)
How Does Return Distribution in Distributional Reinforcement Learning Help Optimization?
di: Sun, Ke, et al.
Pubblicazione: (2022)
di: Sun, Ke, et al.
Pubblicazione: (2022)
Hilbert Curve Projection Distance for Distribution Comparison
di: Li, Tao, et al.
Pubblicazione: (2022)
di: Li, Tao, et al.
Pubblicazione: (2022)
Improving Stochastic Action-Constrained Reinforcement Learning via Truncated Distributions
di: Stolz, Roland, et al.
Pubblicazione: (2025)
di: Stolz, Roland, et al.
Pubblicazione: (2025)
A Distance-based Anomaly Detection Framework for Deep Reinforcement Learning
di: Zhang, Hongming, et al.
Pubblicazione: (2021)
di: Zhang, Hongming, et al.
Pubblicazione: (2021)
Distorted Distributional Policy Evaluation for Offline Reinforcement Learning
di: Iwaki, Ryo, et al.
Pubblicazione: (2026)
di: Iwaki, Ryo, et al.
Pubblicazione: (2026)
Multivariate Distributional Reinforcement Learning Using Sliced Divergences
di: Debes, Baptiste, et al.
Pubblicazione: (2026)
di: Debes, Baptiste, et al.
Pubblicazione: (2026)
Convergence Theorems for Entropy-Regularized and Distributional Reinforcement Learning
di: Jhaveri, Yash, et al.
Pubblicazione: (2025)
di: Jhaveri, Yash, et al.
Pubblicazione: (2025)
Distributionally Robust Self Paced Curriculum Reinforcement Learning
di: Satheesh, Anirudh, et al.
Pubblicazione: (2025)
di: Satheesh, Anirudh, et al.
Pubblicazione: (2025)
DROP: Distributional and Regular Optimism and Pessimism for Reinforcement Learning
di: Kobayashi, Taisuke
Pubblicazione: (2024)
di: Kobayashi, Taisuke
Pubblicazione: (2024)
Using Kolmogorov-Smirnov Distance for Measuring Distribution Shift in Machine Learning
di: Tonguz, Ozan K., et al.
Pubblicazione: (2025)
di: Tonguz, Ozan K., et al.
Pubblicazione: (2025)
Computing the Distance between unbalanced Distributions -- The flat Metric
di: Schmidt, Henri, et al.
Pubblicazione: (2023)
di: Schmidt, Henri, et al.
Pubblicazione: (2023)
Foundations of Multivariate Distributional Reinforcement Learning
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
Goal Exploration via Adaptive Skill Distribution for Goal-Conditioned Reinforcement Learning
di: Wu, Lisheng, et al.
Pubblicazione: (2024)
di: Wu, Lisheng, et al.
Pubblicazione: (2024)
Breaking the Grid: Distance-Guided Reinforcement Learning in Large Discrete Action Spaces
di: Hoppe, Heiko, et al.
Pubblicazione: (2026)
di: Hoppe, Heiko, et al.
Pubblicazione: (2026)
Deep Learning Approaches to Quantum Error Mitigation
di: Placidi, Leonardo, et al.
Pubblicazione: (2026)
di: Placidi, Leonardo, et al.
Pubblicazione: (2026)
Bayesian Cramér-Rao Bound Estimation with Score-Based Models
di: Crafts, Evan Scope, et al.
Pubblicazione: (2023)
di: Crafts, Evan Scope, et al.
Pubblicazione: (2023)
Documenti analoghi
-
StructRL: Recovering Dynamic Programming Structure from Learning Dynamics in Distributional Reinforcement Learning
di: Nowak, Ivo
Pubblicazione: (2026) -
Newton-Flow Particle Filters based on Generalized Cramér Distance
di: Hanebeck, Uwe D.
Pubblicazione: (2025) -
A Spectral Revisit of the Distributional Bellman Operator under the Cramér Metric
di: Wang, Keru, et al.
Pubblicazione: (2026) -
Compositional Instruction Following with Language Models and Reinforcement Learning
di: Cohen, Vanya, et al.
Pubblicazione: (2025) -
Data-driven transport modelling without overfit
di: Vanya, Peter, et al.
Pubblicazione: (2026)