Risk-Averse Constrained Reinforcement Learning with Optimized Certainty Equivalents
Fuente:
arXiv
Salvato in:
| Autori principali: | Lee, Jane H., Saglam, Baturay, Pougkakiotis, Spyridon, Karbasi, Amin, Kalogerias, Dionysis |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Test-Time Detoxification without Training or Learning Anything
di: Saglam, Baturay, et al.
Pubblicazione: (2026)
di: Saglam, Baturay, et al.
Pubblicazione: (2026)
Compatible Gradient Approximations for Actor-Critic Algorithms
di: Saglam, Baturay, et al.
Pubblicazione: (2024)
di: Saglam, Baturay, et al.
Pubblicazione: (2024)
Learning Task Representations from In-Context Learning
di: Saglam, Baturay, et al.
Pubblicazione: (2025)
di: Saglam, Baturay, et al.
Pubblicazione: (2025)
Test-Time Safety Alignment
di: Saglam, Baturay, et al.
Pubblicazione: (2026)
di: Saglam, Baturay, et al.
Pubblicazione: (2026)
Ultra-Reliable Risk-Aggregated Sum Rate Maximization via Model-Aided Deep Learning
di: Hashmi, Hassaan, et al.
Pubblicazione: (2025)
di: Hashmi, Hassaan, et al.
Pubblicazione: (2025)
Strong Duality in Risk-Constrained Nonconvex Functional Programming
di: Kalogerias, Dionysis, et al.
Pubblicazione: (2022)
di: Kalogerias, Dionysis, et al.
Pubblicazione: (2022)
Inexact Zeroth-Order Nonsmooth and Nonconvex Stochastic Composite Optimization and Applications
di: Pougkakiotis, Spyridon, et al.
Pubblicazione: (2025)
di: Pougkakiotis, Spyridon, et al.
Pubblicazione: (2025)
Data-Driven Learning of Two-Stage Beamformers in Passive IRS-Assisted Systems with Inexact Oracles
di: Pougkakiotis, Spyridon, et al.
Pubblicazione: (2024)
di: Pougkakiotis, Spyridon, et al.
Pubblicazione: (2024)
Data-Driven Two-Stage IRS-Aided Sumrate Maximization with Inexact Precoding
di: Hashmi, Hassaan, et al.
Pubblicazione: (2025)
di: Hashmi, Hassaan, et al.
Pubblicazione: (2025)
An efficient active-set method with applications to sparse approximations and risk minimization
di: Pougkakiotis, Spyridon, et al.
Pubblicazione: (2024)
di: Pougkakiotis, Spyridon, et al.
Pubblicazione: (2024)
A Zeroth-order Proximal Stochastic Gradient Method for Weakly Convex Stochastic Optimization
di: Pougkakiotis, Spyridon, et al.
Pubblicazione: (2022)
di: Pougkakiotis, Spyridon, et al.
Pubblicazione: (2022)
FedAVOT: Exact Distribution Alignment in Federated Learning via Masked Optimal Transport
di: Herlock, et al.
Pubblicazione: (2025)
di: Herlock, et al.
Pubblicazione: (2025)
Large Language Models Encode Semantics and Alignment in Linearly Separable Representations
di: Saglam, Baturay, et al.
Pubblicazione: (2025)
di: Saglam, Baturay, et al.
Pubblicazione: (2025)
A Reductions Approach to Risk-Sensitive Reinforcement Learning with Optimized Certainty Equivalents
di: Wang, Kaiwen, et al.
Pubblicazione: (2024)
di: Wang, Kaiwen, et al.
Pubblicazione: (2024)
Convergence of Agnostic Federated Averaging
di: Herlock, et al.
Pubblicazione: (2025)
di: Herlock, et al.
Pubblicazione: (2025)
Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning
di: McCarthy, James, et al.
Pubblicazione: (2025)
di: McCarthy, James, et al.
Pubblicazione: (2025)
Concentration Bounds for Optimized Certainty Equivalent Risk Estimation
di: Ghosh, Ayon, et al.
Pubblicazione: (2024)
di: Ghosh, Ayon, et al.
Pubblicazione: (2024)
On the Sample Complexity of Discounted Reinforcement Learning with Optimized Certainty Equivalents
di: Mortensen, Oliver, et al.
Pubblicazione: (2026)
di: Mortensen, Oliver, et al.
Pubblicazione: (2026)
Optimized Certainty Equivalent Risk-Controlling Prediction Sets
di: Huang, Jiayi, et al.
Pubblicazione: (2026)
di: Huang, Jiayi, et al.
Pubblicazione: (2026)
Risk-Averse Total-Reward Reinforcement Learning
di: Su, Xihong, et al.
Pubblicazione: (2025)
di: Su, Xihong, et al.
Pubblicazione: (2025)
Online Bayesian Risk-Averse Reinforcement Learning
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
FEDSTR: Money-In AI-Out | A Decentralized Marketplace for Federated Learning and LLM Training on the NOSTR Protocol
di: Nikolakakis, Konstantinos E., et al.
Pubblicazione: (2024)
di: Nikolakakis, Konstantinos E., et al.
Pubblicazione: (2024)
Risk-Averse Reinforcement Learning with Itakura-Saito Loss
di: Udovichenko, Igor, et al.
Pubblicazione: (2025)
di: Udovichenko, Igor, et al.
Pubblicazione: (2025)
Think Before You Retrieve: Learning Test-Time Adaptive Search with Small Language Models
di: Vijay, Supriti, et al.
Pubblicazione: (2025)
di: Vijay, Supriti, et al.
Pubblicazione: (2025)
Conflict-Averse Gradient Aggregation for Constrained Multi-Objective Reinforcement Learning
di: Kim, Dohyeong, et al.
Pubblicazione: (2024)
di: Kim, Dohyeong, et al.
Pubblicazione: (2024)
Risk-Averse Learning with Varying Risk Levels
di: Wang, Siyi, et al.
Pubblicazione: (2025)
di: Wang, Siyi, et al.
Pubblicazione: (2025)
Diffusion Policies for Risk-Averse Behavior Modeling in Offline Reinforcement Learning
di: Chen, Xiaocong, et al.
Pubblicazione: (2024)
di: Chen, Xiaocong, et al.
Pubblicazione: (2024)
Criteria and Bias of Parameterized Linear Regression under Edge of Stability Regime
di: Zhang, Peiyuan, et al.
Pubblicazione: (2024)
di: Zhang, Peiyuan, et al.
Pubblicazione: (2024)
On the Computational Landscape of Replicable Learning
di: Kalavasis, Alkis, et al.
Pubblicazione: (2024)
di: Kalavasis, Alkis, et al.
Pubblicazione: (2024)
Gödel Test: Can Large Language Models Solve Easy Conjectures?
di: Feldman, Moran, et al.
Pubblicazione: (2025)
di: Feldman, Moran, et al.
Pubblicazione: (2025)
Optimal Guarantees for Algorithmic Reproducibility and Gradient Complexity in Convex Optimization
di: Zhang, Liang, et al.
Pubblicazione: (2023)
di: Zhang, Liang, et al.
Pubblicazione: (2023)
Risk-Averse Certification of Bayesian Neural Networks
di: Zhang, Xiyue, et al.
Pubblicazione: (2024)
di: Zhang, Xiyue, et al.
Pubblicazione: (2024)
A View of the Certainty-Equivalence Method for PAC RL as an Application of the Trajectory Tree Method
di: Kalyanakrishnan, Shivaram, et al.
Pubblicazione: (2025)
di: Kalyanakrishnan, Shivaram, et al.
Pubblicazione: (2025)
The Over-Certainty Phenomenon in Modern Test-Time Adaptation Algorithms
di: Amin, Fin, et al.
Pubblicazione: (2024)
di: Amin, Fin, et al.
Pubblicazione: (2024)
On Union-Closedness of Language Generation
di: Hanneke, Steve, et al.
Pubblicazione: (2025)
di: Hanneke, Steve, et al.
Pubblicazione: (2025)
Optimal Learners for Realizable Regression: PAC Learning and Online Learning
di: Attias, Idan, et al.
Pubblicazione: (2023)
di: Attias, Idan, et al.
Pubblicazione: (2023)
A Distributionally Robust Estimator that Dominates the Empirical Average
di: Koumpis, Nikolas, et al.
Pubblicazione: (2024)
di: Koumpis, Nikolas, et al.
Pubblicazione: (2024)
Shape Derivative-Informed Neural Operators with Application to Risk-Averse Shape Optimization
di: Gong, Xindi, et al.
Pubblicazione: (2026)
di: Gong, Xindi, et al.
Pubblicazione: (2026)
RASR: Risk-Averse Soft-Robust MDPs with EVaR and Entropic Risk
di: Hau, Jia Lin, et al.
Pubblicazione: (2022)
di: Hau, Jia Lin, et al.
Pubblicazione: (2022)
ESLM: Risk-Averse Selective Language Modeling for Efficient Pretraining
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2025)
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Test-Time Detoxification without Training or Learning Anything
di: Saglam, Baturay, et al.
Pubblicazione: (2026) -
Compatible Gradient Approximations for Actor-Critic Algorithms
di: Saglam, Baturay, et al.
Pubblicazione: (2024) -
Learning Task Representations from In-Context Learning
di: Saglam, Baturay, et al.
Pubblicazione: (2025) -
Test-Time Safety Alignment
di: Saglam, Baturay, et al.
Pubblicazione: (2026) -
Ultra-Reliable Risk-Aggregated Sum Rate Maximization via Model-Aided Deep Learning
di: Hashmi, Hassaan, et al.
Pubblicazione: (2025)