Optimization Solution Functions as Deterministic Policies for Offline Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Khattar, Vanshaj, Jin, Ming |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Offline Reinforcement Learning via Inverse Optimization
par: Dimanidis, Ioannis, et autres
Publié: (2025)
par: Dimanidis, Ioannis, et autres
Publié: (2025)
Offline Hierarchical Reinforcement Learning via Inverse Optimization
par: Schmidt, Carolin, et autres
Publié: (2024)
par: Schmidt, Carolin, et autres
Publié: (2024)
Entropy-regularized Diffusion Policy with Q-Ensembles for Offline Reinforcement Learning
par: Zhang, Ruoqi, et autres
Publié: (2024)
par: Zhang, Ruoqi, et autres
Publié: (2024)
Parameter Stress Analysis in Reinforcement Learning: Applying Synaptic Filtering to Policy Networks
par: Abdeen, Zain ul, et autres
Publié: (2025)
par: Abdeen, Zain ul, et autres
Publié: (2025)
Offline Guarded Safe Reinforcement Learning for Medical Treatment Optimization Strategies
par: Yan, Runze, et autres
Publié: (2025)
par: Yan, Runze, et autres
Publié: (2025)
A CMDP-within-online framework for Meta-Safe Reinforcement Learning
par: Khattar, Vanshaj, et autres
Publié: (2024)
par: Khattar, Vanshaj, et autres
Publié: (2024)
Operator Models for Continuous-Time Offline Reinforcement Learning
par: Hoischen, Nicolas, et autres
Publié: (2025)
par: Hoischen, Nicolas, et autres
Publié: (2025)
Solving Offline Reinforcement Learning with Decision Tree Regression
par: Koirala, Prajwal, et autres
Publié: (2024)
par: Koirala, Prajwal, et autres
Publié: (2024)
Data Center Cooling System Optimization Using Offline Reinforcement Learning
par: Zhan, Xianyuan, et autres
Publié: (2025)
par: Zhan, Xianyuan, et autres
Publié: (2025)
Robust Bandwidth Estimation for Real-Time Communication with Offline Reinforcement Learning
par: Kai, Jian, et autres
Publié: (2025)
par: Kai, Jian, et autres
Publié: (2025)
Quasi-Newton Compatible Actor-Critic for Deterministic Policies
par: Kordabad, Arash Bahari, et autres
Publié: (2025)
par: Kordabad, Arash Bahari, et autres
Publié: (2025)
LexiSafe: Offline Safe Reinforcement Learning with Lexicographic Safety-Reward Hierarchy
par: Yang, Hsin-Jung, et autres
Publié: (2026)
par: Yang, Hsin-Jung, et autres
Publié: (2026)
Certifying Stability of Reinforcement Learning Policies using Generalized Lyapunov Functions
par: Long, Kehan, et autres
Publié: (2025)
par: Long, Kehan, et autres
Publié: (2025)
Deterministic Trajectory Optimization through Probabilistic Optimal Control
par: Filabadi, Mohammad Mahmoudi, et autres
Publié: (2024)
par: Filabadi, Mohammad Mahmoudi, et autres
Publié: (2024)
Feasible Policy Iteration for Safe Reinforcement Learning
par: Yang, Yujie, et autres
Publié: (2023)
par: Yang, Yujie, et autres
Publié: (2023)
Offline Reinforcement-Learning-Based Power Control for Application-Agnostic Energy Efficiency
par: Raj, Akhilesh, et autres
Publié: (2026)
par: Raj, Akhilesh, et autres
Publié: (2026)
Concurrent Learning of Policy and Unknown Safety Constraints in Reinforcement Learning
par: Yifru, Lunet, et autres
Publié: (2024)
par: Yifru, Lunet, et autres
Publié: (2024)
Offline Reinforcement Learning and Sequence Modeling for Downlink Link Adaptation
par: Peri, Samuele, et autres
Publié: (2024)
par: Peri, Samuele, et autres
Publié: (2024)
HOFLON: Hybrid Offline Learning and Online Optimization for Process Start-Up and Grade-Transition Control
par: Durkin, Alex, et autres
Publié: (2025)
par: Durkin, Alex, et autres
Publié: (2025)
On Robust Reinforcement Learning with Lipschitz-Bounded Policy Networks
par: Barbara, Nicholas H., et autres
Publié: (2024)
par: Barbara, Nicholas H., et autres
Publié: (2024)
Finite-Time Analysis of On-Policy Heterogeneous Federated Reinforcement Learning
par: Zhang, Chenyu, et autres
Publié: (2024)
par: Zhang, Chenyu, et autres
Publié: (2024)
Proximal Reliability Optimization for Reinforcement Learning
par: Patwardhan, Narendra, et autres
Publié: (2019)
par: Patwardhan, Narendra, et autres
Publié: (2019)
Nonuniqueness and Convergence to Equivalent Solutions in Observer-based Inverse Reinforcement Learning
par: Town, Jared, et autres
Publié: (2022)
par: Town, Jared, et autres
Publié: (2022)
Safety Optimized Reinforcement Learning via Multi-Objective Policy Optimization
par: Honari, Homayoun, et autres
Publié: (2024)
par: Honari, Homayoun, et autres
Publié: (2024)
Reinforced Model Predictive Control via Trust-Region Quasi-Newton Policy Optimization
par: Brandner, Dean, et autres
Publié: (2024)
par: Brandner, Dean, et autres
Publié: (2024)
Predictive Lagrangian Optimization for Constrained Reinforcement Learning
par: Zhang, Tianqi, et autres
Publié: (2025)
par: Zhang, Tianqi, et autres
Publié: (2025)
Joint Optimization of Multi-Objective Reinforcement Learning with Policy Gradient Based Algorithm
par: Bai, Qinbo, et autres
Publié: (2021)
par: Bai, Qinbo, et autres
Publié: (2021)
Off Policy Lyapunov Stability in Reinforcement Learning
par: Gill, Sarvan, et autres
Publié: (2025)
par: Gill, Sarvan, et autres
Publié: (2025)
Safe Deployment of Offline Reinforcement Learning via Input Convex Action Correction
par: Durkin, Alex, et autres
Publié: (2025)
par: Durkin, Alex, et autres
Publié: (2025)
Stable Inverse Reinforcement Learning: Policies from Control Lyapunov Landscapes
par: Tesfazgi, Samuel, et autres
Publié: (2024)
par: Tesfazgi, Samuel, et autres
Publié: (2024)
Relative Entropy Regularized Reinforcement Learning for Efficient Encrypted Policy Synthesis
par: Suh, Jihoon, et autres
Publié: (2025)
par: Suh, Jihoon, et autres
Publié: (2025)
Power Allocation for Delay Optimization in Device-to-Device Networks: A Graph Reinforcement Learning Approach
par: Fang, Hao, et autres
Publié: (2025)
par: Fang, Hao, et autres
Publié: (2025)
Decomposing Control Lyapunov Functions for Efficient Reinforcement Learning
par: Lopez, Antonio, et autres
Publié: (2024)
par: Lopez, Antonio, et autres
Publié: (2024)
Online Residual Learning from Offline Experts for Pedestrian Tracking
par: Vlachos, Anastasios, et autres
Publié: (2024)
par: Vlachos, Anastasios, et autres
Publié: (2024)
Solving Reach-Avoid-Stay Problems Using Deep Deterministic Policy Gradients
par: Chenevert, Gabriel, et autres
Publié: (2024)
par: Chenevert, Gabriel, et autres
Publié: (2024)
Structured Reinforcement Learning for Incentivized Stochastic Covert Optimization
par: Jain, Adit, et autres
Publié: (2024)
par: Jain, Adit, et autres
Publié: (2024)
MAD: A Magnitude And Direction Policy Parametrization for Stability Constrained Reinforcement Learning
par: Furieri, Luca, et autres
Publié: (2025)
par: Furieri, Luca, et autres
Publié: (2025)
Game-Theory-Assisted Reinforcement Learning for Border Defense: Early Termination based on Analytical Solutions
par: Das, Goutam, et autres
Publié: (2026)
par: Das, Goutam, et autres
Publié: (2026)
Investigating the Impact of Observation Space Design Choices On Training Reinforcement Learning Solutions for Spacecraft Problems
par: Hamilton, Nathaniel, et autres
Publié: (2025)
par: Hamilton, Nathaniel, et autres
Publié: (2025)
On the Sample Complexity of Discounted Reinforcement Learning with Optimized Certainty Equivalents
par: Mortensen, Oliver, et autres
Publié: (2026)
par: Mortensen, Oliver, et autres
Publié: (2026)
Documents similaires
-
Offline Reinforcement Learning via Inverse Optimization
par: Dimanidis, Ioannis, et autres
Publié: (2025) -
Offline Hierarchical Reinforcement Learning via Inverse Optimization
par: Schmidt, Carolin, et autres
Publié: (2024) -
Entropy-regularized Diffusion Policy with Q-Ensembles for Offline Reinforcement Learning
par: Zhang, Ruoqi, et autres
Publié: (2024) -
Parameter Stress Analysis in Reinforcement Learning: Applying Synaptic Filtering to Policy Networks
par: Abdeen, Zain ul, et autres
Publié: (2025) -
Offline Guarded Safe Reinforcement Learning for Medical Treatment Optimization Strategies
par: Yan, Runze, et autres
Publié: (2025)