Offline Reinforcement Learning via Linear-Programming with Error-Bound Induced Constraints
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ozdaglar, Asuman, Pattathil, Sarath, Zhang, Jiawei, Zhang, Kaiqing |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Optimism as Risk-Seeking in Multi-Agent Reinforcement Learning
par: Zhang, Runyu, et autres
Publié: (2025)
par: Zhang, Runyu, et autres
Publié: (2025)
What Data Enables Optimal Decisions? An Exact Characterization for Linear Optimization
par: Bennouna, Omar, et autres
Publié: (2025)
par: Bennouna, Omar, et autres
Publié: (2025)
Offline-Online Reinforcement Learning for Linear Mixture MDPs
par: Zhang, Zhongjun, et autres
Publié: (2026)
par: Zhang, Zhongjun, et autres
Publié: (2026)
Finite-Sample Guarantees for Learning Dynamics in Zero-Sum Polymatrix Games
par: Faizal, Fathima Zarin, et autres
Publié: (2024)
par: Faizal, Fathima Zarin, et autres
Publié: (2024)
Cost-Driven Representation Learning for Linear Quadratic Gaussian Control: Part I
par: Tian, Yi, et autres
Publié: (2022)
par: Tian, Yi, et autres
Publié: (2022)
Cost-Driven Representation Learning for Linear Quadratic Gaussian Control: Part II
par: Tian, Yi, et autres
Publié: (2026)
par: Tian, Yi, et autres
Publié: (2026)
Reward-Relevance-Filtered Linear Offline Reinforcement Learning
par: Zhou, Angela
Publié: (2024)
par: Zhou, Angela
Publié: (2024)
Addressing misspecification in contextual optimization
par: Bennouna, Omar, et autres
Publié: (2024)
par: Bennouna, Omar, et autres
Publié: (2024)
Zeroth-Order Constrained Optimization from a Control Perspective via Feedback Linearization
par: Zhang, Runyu, et autres
Publié: (2025)
par: Zhang, Runyu, et autres
Publié: (2025)
Stochastic Smoothed Primal-Dual Algorithms for Nonconvex Optimization with Linear Inequality Constraints
par: Huang, Ruichuan, et autres
Publié: (2025)
par: Huang, Ruichuan, et autres
Publié: (2025)
Offline Reinforcement Learning via Inverse Optimization
par: Dimanidis, Ioannis, et autres
Publié: (2025)
par: Dimanidis, Ioannis, et autres
Publié: (2025)
A Unified Linear Programming Framework for Offline Reward Learning from Human Demonstrations and Feedback
par: Kim, Kihyun, et autres
Publié: (2024)
par: Kim, Kihyun, et autres
Publié: (2024)
Data Informativeness in Linear Optimization under Uncertainty
par: Bennouna, Omar, et autres
Publié: (2026)
par: Bennouna, Omar, et autres
Publié: (2026)
Learning Decision-Sufficient Representations for Linear Optimization
par: Ye, Yuhan, et autres
Publié: (2026)
par: Ye, Yuhan, et autres
Publié: (2026)
Offline Hierarchical Reinforcement Learning via Inverse Optimization
par: Schmidt, Carolin, et autres
Publié: (2024)
par: Schmidt, Carolin, et autres
Publié: (2024)
Residuals-based Offline Reinforcement Learning
par: Zhu, Qing, et autres
Publié: (2026)
par: Zhu, Qing, et autres
Publié: (2026)
Machine Learning Augmented Branch and Bound for Mixed Integer Linear Programming
par: Scavuzzo, Lara, et autres
Publié: (2024)
par: Scavuzzo, Lara, et autres
Publié: (2024)
Principled Learning-to-Communicate with Quasi-Classical Information Structures
par: Liu, Xiangyu, et autres
Publié: (2026)
par: Liu, Xiangyu, et autres
Publié: (2026)
CLT-Optimal Parameter Error Bounds for Linear System Identification
par: Zhou, Yichen, et autres
Publié: (2026)
par: Zhou, Yichen, et autres
Publié: (2026)
Online Reinforcement Learning in Markov Decision Process Using Linear Programming
par: Leon, Vincent, et autres
Publié: (2023)
par: Leon, Vincent, et autres
Publié: (2023)
Operator Models for Continuous-Time Offline Reinforcement Learning
par: Hoischen, Nicolas, et autres
Publié: (2025)
par: Hoischen, Nicolas, et autres
Publié: (2025)
Pessimism Meets Risk: Risk-Sensitive Offline Reinforcement Learning
par: Zhang, Dake, et autres
Publié: (2024)
par: Zhang, Dake, et autres
Publié: (2024)
Iterative Minimax Games with Coupled Linear Constraints
par: Zhang, Huiling, et autres
Publié: (2022)
par: Zhang, Huiling, et autres
Publié: (2022)
Learning Infinite-Horizon Average-Reward Linear Mixture MDPs of Bounded Span
par: Chae, Woojin, et autres
Publié: (2024)
par: Chae, Woojin, et autres
Publié: (2024)
Pessimistic Nonlinear Least-Squares Value Iteration for Offline Reinforcement Learning
par: Di, Qiwei, et autres
Publié: (2023)
par: Di, Qiwei, et autres
Publié: (2023)
Equilibrium Selection for Multi-agent Reinforcement Learning: A Unified Framework
par: Zhang, Runyu, et autres
Publié: (2024)
par: Zhang, Runyu, et autres
Publié: (2024)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
par: Ding, Dongsheng, et autres
Publié: (2023)
par: Ding, Dongsheng, et autres
Publié: (2023)
Multi-Player Zero-Sum Markov Games with Networked Separable Interactions
par: Park, Chanwoo, et autres
Publié: (2023)
par: Park, Chanwoo, et autres
Publié: (2023)
Reinforcement Learning and Regret Bounds for Admission Control
par: Weber, Lucas, et autres
Publié: (2024)
par: Weber, Lucas, et autres
Publié: (2024)
A Neural Network Framework for Discovering Closed-form Solutions to Quadratic Programs with Linear Constraints
par: Beylunioglu, Fuat Can, et autres
Publié: (2025)
par: Beylunioglu, Fuat Can, et autres
Publié: (2025)
Inexact Moreau Envelope Lagrangian Method for Non-Convex Constrained Optimization under Local Error Bound Conditions on Constraint Functions
par: Huang, Yankun, et autres
Publié: (2025)
par: Huang, Yankun, et autres
Publié: (2025)
Regret Lower Bounds for Learning Linear Quadratic Gaussian Systems
par: Ziemann, Ingvar, et autres
Publié: (2022)
par: Ziemann, Ingvar, et autres
Publié: (2022)
Improved Regret Bound for Safe Reinforcement Learning via Tighter Cost Pessimism and Reward Optimism
par: Yu, Kihyun, et autres
Publié: (2024)
par: Yu, Kihyun, et autres
Publié: (2024)
Towards Optimal Offline Reinforcement Learning
par: Li, Mengmeng, et autres
Publié: (2025)
par: Li, Mengmeng, et autres
Publié: (2025)
Certified Approximate Reachability (CARe): Formal Error Bounds on Deep Learning of Reachable Sets
par: Solanki, Prashant, et autres
Publié: (2025)
par: Solanki, Prashant, et autres
Publié: (2025)
Tight Bounds for Online Convex Optimization with Adversarial Constraints
par: Sinha, Abhishek, et autres
Publié: (2024)
par: Sinha, Abhishek, et autres
Publié: (2024)
On the Linear Speedup of Personalized Federated Reinforcement Learning with Shared Representations
par: Xiong, Guojun, et autres
Publié: (2024)
par: Xiong, Guojun, et autres
Publié: (2024)
Online Linear Programming with Batching
par: Xu, Haoran, et autres
Publié: (2024)
par: Xu, Haoran, et autres
Publié: (2024)
PDHG-Unrolled Learning-to-Optimize Method for Large-Scale Linear Programming
par: Li, Bingheng, et autres
Publié: (2024)
par: Li, Bingheng, et autres
Publié: (2024)
CORL: Reinforcement Learning of MILP Policies Solved via Branch and Bound
par: Anand, Akhil S, et autres
Publié: (2025)
par: Anand, Akhil S, et autres
Publié: (2025)
Documents similaires
-
Optimism as Risk-Seeking in Multi-Agent Reinforcement Learning
par: Zhang, Runyu, et autres
Publié: (2025) -
What Data Enables Optimal Decisions? An Exact Characterization for Linear Optimization
par: Bennouna, Omar, et autres
Publié: (2025) -
Offline-Online Reinforcement Learning for Linear Mixture MDPs
par: Zhang, Zhongjun, et autres
Publié: (2026) -
Finite-Sample Guarantees for Learning Dynamics in Zero-Sum Polymatrix Games
par: Faizal, Fathima Zarin, et autres
Publié: (2024) -
Cost-Driven Representation Learning for Linear Quadratic Gaussian Control: Part I
par: Tian, Yi, et autres
Publié: (2022)