Offline Reinforcement Learning via Linear-Programming with Error-Bound Induced Constraints
Fuente:
arXiv
Salvato in:
| Autori principali: | Ozdaglar, Asuman, Pattathil, Sarath, Zhang, Jiawei, Zhang, Kaiqing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Optimism as Risk-Seeking in Multi-Agent Reinforcement Learning
di: Zhang, Runyu, et al.
Pubblicazione: (2025)
di: Zhang, Runyu, et al.
Pubblicazione: (2025)
What Data Enables Optimal Decisions? An Exact Characterization for Linear Optimization
di: Bennouna, Omar, et al.
Pubblicazione: (2025)
di: Bennouna, Omar, et al.
Pubblicazione: (2025)
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
Finite-Sample Guarantees for Learning Dynamics in Zero-Sum Polymatrix Games
di: Faizal, Fathima Zarin, et al.
Pubblicazione: (2024)
di: Faizal, Fathima Zarin, et al.
Pubblicazione: (2024)
Cost-Driven Representation Learning for Linear Quadratic Gaussian Control: Part I
di: Tian, Yi, et al.
Pubblicazione: (2022)
di: Tian, Yi, et al.
Pubblicazione: (2022)
Cost-Driven Representation Learning for Linear Quadratic Gaussian Control: Part II
di: Tian, Yi, et al.
Pubblicazione: (2026)
di: Tian, Yi, et al.
Pubblicazione: (2026)
Reward-Relevance-Filtered Linear Offline Reinforcement Learning
di: Zhou, Angela
Pubblicazione: (2024)
di: Zhou, Angela
Pubblicazione: (2024)
Addressing misspecification in contextual optimization
di: Bennouna, Omar, et al.
Pubblicazione: (2024)
di: Bennouna, Omar, et al.
Pubblicazione: (2024)
Zeroth-Order Constrained Optimization from a Control Perspective via Feedback Linearization
di: Zhang, Runyu, et al.
Pubblicazione: (2025)
di: Zhang, Runyu, et al.
Pubblicazione: (2025)
Stochastic Smoothed Primal-Dual Algorithms for Nonconvex Optimization with Linear Inequality Constraints
di: Huang, Ruichuan, et al.
Pubblicazione: (2025)
di: Huang, Ruichuan, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning via Inverse Optimization
di: Dimanidis, Ioannis, et al.
Pubblicazione: (2025)
di: Dimanidis, Ioannis, et al.
Pubblicazione: (2025)
A Unified Linear Programming Framework for Offline Reward Learning from Human Demonstrations and Feedback
di: Kim, Kihyun, et al.
Pubblicazione: (2024)
di: Kim, Kihyun, et al.
Pubblicazione: (2024)
Data Informativeness in Linear Optimization under Uncertainty
di: Bennouna, Omar, et al.
Pubblicazione: (2026)
di: Bennouna, Omar, et al.
Pubblicazione: (2026)
Learning Decision-Sufficient Representations for Linear Optimization
di: Ye, Yuhan, et al.
Pubblicazione: (2026)
di: Ye, Yuhan, et al.
Pubblicazione: (2026)
Offline Hierarchical Reinforcement Learning via Inverse Optimization
di: Schmidt, Carolin, et al.
Pubblicazione: (2024)
di: Schmidt, Carolin, et al.
Pubblicazione: (2024)
Residuals-based Offline Reinforcement Learning
di: Zhu, Qing, et al.
Pubblicazione: (2026)
di: Zhu, Qing, et al.
Pubblicazione: (2026)
Machine Learning Augmented Branch and Bound for Mixed Integer Linear Programming
di: Scavuzzo, Lara, et al.
Pubblicazione: (2024)
di: Scavuzzo, Lara, et al.
Pubblicazione: (2024)
Principled Learning-to-Communicate with Quasi-Classical Information Structures
di: Liu, Xiangyu, et al.
Pubblicazione: (2026)
di: Liu, Xiangyu, et al.
Pubblicazione: (2026)
CLT-Optimal Parameter Error Bounds for Linear System Identification
di: Zhou, Yichen, et al.
Pubblicazione: (2026)
di: Zhou, Yichen, et al.
Pubblicazione: (2026)
Online Reinforcement Learning in Markov Decision Process Using Linear Programming
di: Leon, Vincent, et al.
Pubblicazione: (2023)
di: Leon, Vincent, et al.
Pubblicazione: (2023)
Operator Models for Continuous-Time Offline Reinforcement Learning
di: Hoischen, Nicolas, et al.
Pubblicazione: (2025)
di: Hoischen, Nicolas, et al.
Pubblicazione: (2025)
Pessimism Meets Risk: Risk-Sensitive Offline Reinforcement Learning
di: Zhang, Dake, et al.
Pubblicazione: (2024)
di: Zhang, Dake, et al.
Pubblicazione: (2024)
Iterative Minimax Games with Coupled Linear Constraints
di: Zhang, Huiling, et al.
Pubblicazione: (2022)
di: Zhang, Huiling, et al.
Pubblicazione: (2022)
Learning Infinite-Horizon Average-Reward Linear Mixture MDPs of Bounded Span
di: Chae, Woojin, et al.
Pubblicazione: (2024)
di: Chae, Woojin, et al.
Pubblicazione: (2024)
Pessimistic Nonlinear Least-Squares Value Iteration for Offline Reinforcement Learning
di: Di, Qiwei, et al.
Pubblicazione: (2023)
di: Di, Qiwei, et al.
Pubblicazione: (2023)
Equilibrium Selection for Multi-agent Reinforcement Learning: A Unified Framework
di: Zhang, Runyu, et al.
Pubblicazione: (2024)
di: Zhang, Runyu, et al.
Pubblicazione: (2024)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
Multi-Player Zero-Sum Markov Games with Networked Separable Interactions
di: Park, Chanwoo, et al.
Pubblicazione: (2023)
di: Park, Chanwoo, et al.
Pubblicazione: (2023)
Reinforcement Learning and Regret Bounds for Admission Control
di: Weber, Lucas, et al.
Pubblicazione: (2024)
di: Weber, Lucas, et al.
Pubblicazione: (2024)
A Neural Network Framework for Discovering Closed-form Solutions to Quadratic Programs with Linear Constraints
di: Beylunioglu, Fuat Can, et al.
Pubblicazione: (2025)
di: Beylunioglu, Fuat Can, et al.
Pubblicazione: (2025)
Inexact Moreau Envelope Lagrangian Method for Non-Convex Constrained Optimization under Local Error Bound Conditions on Constraint Functions
di: Huang, Yankun, et al.
Pubblicazione: (2025)
di: Huang, Yankun, et al.
Pubblicazione: (2025)
Regret Lower Bounds for Learning Linear Quadratic Gaussian Systems
di: Ziemann, Ingvar, et al.
Pubblicazione: (2022)
di: Ziemann, Ingvar, et al.
Pubblicazione: (2022)
Improved Regret Bound for Safe Reinforcement Learning via Tighter Cost Pessimism and Reward Optimism
di: Yu, Kihyun, et al.
Pubblicazione: (2024)
di: Yu, Kihyun, et al.
Pubblicazione: (2024)
Towards Optimal Offline Reinforcement Learning
di: Li, Mengmeng, et al.
Pubblicazione: (2025)
di: Li, Mengmeng, et al.
Pubblicazione: (2025)
Certified Approximate Reachability (CARe): Formal Error Bounds on Deep Learning of Reachable Sets
di: Solanki, Prashant, et al.
Pubblicazione: (2025)
di: Solanki, Prashant, et al.
Pubblicazione: (2025)
Tight Bounds for Online Convex Optimization with Adversarial Constraints
di: Sinha, Abhishek, et al.
Pubblicazione: (2024)
di: Sinha, Abhishek, et al.
Pubblicazione: (2024)
On the Linear Speedup of Personalized Federated Reinforcement Learning with Shared Representations
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
Online Linear Programming with Batching
di: Xu, Haoran, et al.
Pubblicazione: (2024)
di: Xu, Haoran, et al.
Pubblicazione: (2024)
PDHG-Unrolled Learning-to-Optimize Method for Large-Scale Linear Programming
di: Li, Bingheng, et al.
Pubblicazione: (2024)
di: Li, Bingheng, et al.
Pubblicazione: (2024)
CORL: Reinforcement Learning of MILP Policies Solved via Branch and Bound
di: Anand, Akhil S, et al.
Pubblicazione: (2025)
di: Anand, Akhil S, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Optimism as Risk-Seeking in Multi-Agent Reinforcement Learning
di: Zhang, Runyu, et al.
Pubblicazione: (2025) -
What Data Enables Optimal Decisions? An Exact Characterization for Linear Optimization
di: Bennouna, Omar, et al.
Pubblicazione: (2025) -
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026) -
Finite-Sample Guarantees for Learning Dynamics in Zero-Sum Polymatrix Games
di: Faizal, Fathima Zarin, et al.
Pubblicazione: (2024) -
Cost-Driven Representation Learning for Linear Quadratic Gaussian Control: Part I
di: Tian, Yi, et al.
Pubblicazione: (2022)