Risk-sensitive reinforcement learning using expectiles, shortfall risk and optimized certainty equivalent risk
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gupte, Sumedh, Patel, Shrey Rakeshkumar, Pachal, Soumen, A., Prashanth L., Bhat, Sanjay P. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Learning to optimize convex risk measures: The cases of utility-based shortfall risk and optimized certainty equivalent risk
par: Gupte, Sumedh, et autres
Publié: (2025)
par: Gupte, Sumedh, et autres
Publié: (2025)
Optimization of utility-based shortfall risk: A non-asymptotic viewpoint
par: Gupte, Sumedh, et autres
Publié: (2023)
par: Gupte, Sumedh, et autres
Publié: (2023)
Policy Newton methods for Distortion Riskmetrics
par: Pachal, Soumen, et autres
Publié: (2025)
par: Pachal, Soumen, et autres
Publié: (2025)
Generalized Random Direction Newton Algorithms for Stochastic Optimization
par: Pachal, Soumen, et autres
Publié: (2026)
par: Pachal, Soumen, et autres
Publié: (2026)
Risk Estimation in a Markov Cost Process: Lower and Upper Bounds
par: Thoppe, Gugan, et autres
Publié: (2023)
par: Thoppe, Gugan, et autres
Publié: (2023)
Public Transit Arrival Prediction: a Seq2Seq RNN Approach
par: Bhutani, Nancy, et autres
Publié: (2022)
par: Bhutani, Nancy, et autres
Publié: (2022)
A policy gradient approach for optimization of smooth risk measures
par: Vijayan, Nithia, et autres
Publié: (2022)
par: Vijayan, Nithia, et autres
Publié: (2022)
Early Detection of At-Risk Students Using Machine Learning
par: Martinez, Azucena L. Jimenez, et autres
Publié: (2024)
par: Martinez, Azucena L. Jimenez, et autres
Publié: (2024)
Reinforcement Learning for Exponential Utility: Algorithms and Convergence in Discounted MDPs
par: Thoppe, Gugan, et autres
Publié: (2026)
par: Thoppe, Gugan, et autres
Publié: (2026)
Smoothed functional-based gradient algorithms for off-policy reinforcement learning: A non-asymptotic viewpoint
par: Vijayan, Nithia, et autres
Publié: (2021)
par: Vijayan, Nithia, et autres
Publié: (2021)
The hidden risks of temporal resampling in clinical reinforcement learning
par: Frost, Thomas, et autres
Publié: (2026)
par: Frost, Thomas, et autres
Publié: (2026)
Risk-sensitive Bandits: Arm Mixture Optimality and Regret-efficient Algorithms
par: Tatlı, Meltem, et autres
Publié: (2025)
par: Tatlı, Meltem, et autres
Publié: (2025)
Extending the application of dynamic Bayesian networks in calculating market risk: Standard and stressed expected shortfall
par: Gross, Eden, et autres
Publié: (2025)
par: Gross, Eden, et autres
Publié: (2025)
Catastrophic-risk-aware reinforcement learning with extreme-value-theory-based policy gradients
par: Davar, Parisa, et autres
Publié: (2024)
par: Davar, Parisa, et autres
Publié: (2024)
Policy Gradient Methods for Distortion Risk Measures
par: Vijayan, Nithia, et autres
Publié: (2021)
par: Vijayan, Nithia, et autres
Publié: (2021)
Optimizing Shortfall Risk Metric for Learning Regression Models
par: Ramaswamy, Harish G., et autres
Publié: (2025)
par: Ramaswamy, Harish G., et autres
Publié: (2025)
Risk-averse policies for natural gas futures trading using distributional reinforcement learning
par: Hêche, Félicien, et autres
Publié: (2025)
par: Hêche, Félicien, et autres
Publié: (2025)
Concentration Bounds for Optimized Certainty Equivalent Risk Estimation
par: Ghosh, Ayon, et autres
Publié: (2024)
par: Ghosh, Ayon, et autres
Publié: (2024)
Multimodal Graph Neural Networks for Prognostic Modeling of Brain Network Reorganization
par: Girish, Preksha, et autres
Publié: (2025)
par: Girish, Preksha, et autres
Publié: (2025)
An interpretable data-driven approach to optimizing clinical fall risk assessment
par: Ganjkhanloo, Fardin, et autres
Publié: (2025)
par: Ganjkhanloo, Fardin, et autres
Publié: (2025)
An interpretable data-driven approach to optimizing clinical fall risk assessment
par: Ganjkhanloo, Fardin, et autres
Publié: (2026)
par: Ganjkhanloo, Fardin, et autres
Publié: (2026)
Heart disease risk prediction using deep learning techniques with feature augmentation
par: García-Ordás, María Teresa, et autres
Publié: (2024)
par: García-Ordás, María Teresa, et autres
Publié: (2024)
Learning optimal treatment strategies for intraoperative hypotension using deep reinforcement learning
par: Adiyeke, Esra, et autres
Publié: (2025)
par: Adiyeke, Esra, et autres
Publié: (2025)
Policy-Guided Search on Tree-of-Thoughts for Efficient Problem Solving with Bounded Language Model Queries
par: Pendurkar, Sumedh, et autres
Publié: (2026)
par: Pendurkar, Sumedh, et autres
Publié: (2026)
Assessing the risk of future Dunkelflaute events for Germany using generative deep learning
par: Strnad, Felix, et autres
Publié: (2025)
par: Strnad, Felix, et autres
Publié: (2025)
Mixture Density Networks for Classification with an Application to Product Bundling
par: Gugulothu, Narendhar, et autres
Publié: (2024)
par: Gugulothu, Narendhar, et autres
Publié: (2024)
Adaptive sampling using variational autoencoder and reinforcement learning
par: Rasheed, Adil, et autres
Publié: (2025)
par: Rasheed, Adil, et autres
Publié: (2025)
Enhancing variational quantum state diagonalization using reinforcement learning techniques
par: Kundu, Akash, et autres
Publié: (2023)
par: Kundu, Akash, et autres
Publié: (2023)
Accelerating Malware Classification: A Vision Transformer Solution
par: Bavishi, Shrey, et autres
Publié: (2024)
par: Bavishi, Shrey, et autres
Publié: (2024)
Mitigating optimistic bias in entropic risk estimation and optimization
par: Sadana, Utsav, et autres
Publié: (2024)
par: Sadana, Utsav, et autres
Publié: (2024)
Ergodicity in reinforcement learning
par: Baumann, Dominik, et autres
Publié: (2026)
par: Baumann, Dominik, et autres
Publié: (2026)
Deep reinforcement learning for optimal trading with partial information
par: Macrì, Andrea, et autres
Publié: (2025)
par: Macrì, Andrea, et autres
Publié: (2025)
Statistical curriculum learning: An elimination algorithm achieving an oracle risk
par: Cohen, Omer, et autres
Publié: (2024)
par: Cohen, Omer, et autres
Publié: (2024)
Group-realizable multi-group learning by minimizing empirical risk
par: Ardeshir, Navid, et autres
Publié: (2026)
par: Ardeshir, Navid, et autres
Publié: (2026)
Asymptotic Bayes risk of semi-supervised learning with uncertain labeling
par: Leger, Victor, et autres
Publié: (2024)
par: Leger, Victor, et autres
Publié: (2024)
Orthogonal machine learning for conditional odds and risk ratios
par: Ge, Jiacheng, et autres
Publié: (2026)
par: Ge, Jiacheng, et autres
Publié: (2026)
On-line reinforcement learning for optimization of real-life energy trading strategy
par: Lepak, Łukasz, et autres
Publié: (2023)
par: Lepak, Łukasz, et autres
Publié: (2023)
Generalized Bayesian deep reinforcement learning
par: Roy, Shreya Sinha, et autres
Publié: (2024)
par: Roy, Shreya Sinha, et autres
Publié: (2024)
Active learning for regression in engineering populations: A risk-informed approach
par: Clarkson, Daniel R., et autres
Publié: (2024)
par: Clarkson, Daniel R., et autres
Publié: (2024)
Continuous-time reinforcement learning for optimal switching over multiple regimes
par: Huang, Yijie, et autres
Publié: (2025)
par: Huang, Yijie, et autres
Publié: (2025)
Documents similaires
-
Learning to optimize convex risk measures: The cases of utility-based shortfall risk and optimized certainty equivalent risk
par: Gupte, Sumedh, et autres
Publié: (2025) -
Optimization of utility-based shortfall risk: A non-asymptotic viewpoint
par: Gupte, Sumedh, et autres
Publié: (2023) -
Policy Newton methods for Distortion Riskmetrics
par: Pachal, Soumen, et autres
Publié: (2025) -
Generalized Random Direction Newton Algorithms for Stochastic Optimization
par: Pachal, Soumen, et autres
Publié: (2026) -
Risk Estimation in a Markov Cost Process: Lower and Upper Bounds
par: Thoppe, Gugan, et autres
Publié: (2023)