DiffOP: Reinforcement Learning of Optimization-Based Control Policies via Implicit Policy Gradients
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bian, Yuexin, Feng, Jie, Shi, Yuanyuan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Efficient Policy Adaptation for Voltage Control Under Unknown Topology Changes
par: Feng, Jie, et autres
Publié: (2026)
par: Feng, Jie, et autres
Publié: (2026)
Ventilation and Temperature Control for Energy-efficient and Healthy Buildings: A Differentiable PDE Approach
par: Bian, Yuexin, et autres
Publié: (2024)
par: Bian, Yuexin, et autres
Publié: (2024)
Operator learning for energy-efficient building ventilation control with computational fluid dynamics simulation of a real-world classroom
par: Bian, Yuexin, et autres
Publié: (2025)
par: Bian, Yuexin, et autres
Publié: (2025)
Improving Sequential Market Coordination via Value-oriented Renewable Energy Forecasting
par: Zhang, Yufan, et autres
Publié: (2024)
par: Zhang, Yufan, et autres
Publié: (2024)
Toward Value-oriented Renewable Energy Forecasting: An Iterative Learning Approach
par: Zhang, Yufan, et autres
Publié: (2023)
par: Zhang, Yufan, et autres
Publié: (2023)
PDE Control Gym: A Benchmark for Data-Driven Boundary Control of Partial Differential Equations
par: Bhan, Luke, et autres
Publié: (2024)
par: Bhan, Luke, et autres
Publié: (2024)
Implicit Constraint-Aware Off-Policy Correction for Offline Reinforcement Learning
par: Baheri, Ali
Publié: (2025)
par: Baheri, Ali
Publié: (2025)
Joint Optimization of Multi-Objective Reinforcement Learning with Policy Gradient Based Algorithm
par: Bai, Qinbo, et autres
Publié: (2021)
par: Bai, Qinbo, et autres
Publié: (2021)
Predicting Strategic Energy Storage Behaviors
par: Bian, Yuexin, et autres
Publié: (2023)
par: Bian, Yuexin, et autres
Publié: (2023)
Off-Policy Reinforcement Learning with Anytime Safety Guarantees via Robust Safe Gradient Flow
par: Mestres, Pol, et autres
Publié: (2025)
par: Mestres, Pol, et autres
Publié: (2025)
Stability-Certified On-Policy Data-Driven LQR via Recursive Learning and Policy Gradient
par: Sforni, Lorenzo, et autres
Publié: (2024)
par: Sforni, Lorenzo, et autres
Publié: (2024)
Active Perception with Initial-State Uncertainty: A Policy Gradient Method
par: Shi, Chongyang, et autres
Publié: (2024)
par: Shi, Chongyang, et autres
Publié: (2024)
A Control-Barrier-Function-Based Algorithm for Policy Adaptation in Reinforcement Learning
par: Hao, Wenjian, et autres
Publié: (2025)
par: Hao, Wenjian, et autres
Publié: (2025)
Reward-Augmented Reinforcement Learning for Continuous Control in Precision Autonomous Parking via Policy Optimization Methods
par: Suleman, Ahmad, et autres
Publié: (2025)
par: Suleman, Ahmad, et autres
Publié: (2025)
Policy Optimization in Robust Control: Weak Convexity and Subgradient Methods
par: Watanabe, Yuto, et autres
Publié: (2025)
par: Watanabe, Yuto, et autres
Publié: (2025)
Receding-Horizon Policy Gradient for Polytopic Controller Synthesis
par: Shakeri, Shiva, et autres
Publié: (2026)
par: Shakeri, Shiva, et autres
Publié: (2026)
Policy Gradient Methods for Information-Theoretic Opacity in Markov Decision Processes
par: Shi, Chongyang, et autres
Publié: (2025)
par: Shi, Chongyang, et autres
Publié: (2025)
Adaptive Event-Triggered Policy Gradient for Multi-Agent Reinforcement Learning
par: Siddique, Umer, et autres
Publié: (2025)
par: Siddique, Umer, et autres
Publié: (2025)
Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches
par: Zhao, Feiran, et autres
Publié: (2025)
par: Zhao, Feiran, et autres
Publié: (2025)
Implicit Bias of Policy Gradient in Linear Quadratic Control: Extrapolation to Unseen Initial States
par: Razin, Noam, et autres
Publié: (2024)
par: Razin, Noam, et autres
Publié: (2024)
Hierarchical Policy-Gradient Reinforcement Learning for Multi-Agent Shepherding Control of Non-Cohesive Targets
par: Covone, Stefano, et autres
Publié: (2025)
par: Covone, Stefano, et autres
Publié: (2025)
Towards Safe Reinforcement Learning Using NMPC and Policy Gradients: Part I - Stochastic case
par: Gros, Sebastien, et autres
Publié: (2019)
par: Gros, Sebastien, et autres
Publié: (2019)
Towards Safe Reinforcement Learning Using NMPC and Policy Gradients: Part II - Deterministic Case
par: Gros, Sebastien, et autres
Publié: (2019)
par: Gros, Sebastien, et autres
Publié: (2019)
Policy Gradient-Based EMT-in-the-Loop Learning to Mitigate Sub-Synchronous Control Interactions
par: Mukherjee, Sayak, et autres
Publié: (2025)
par: Mukherjee, Sayak, et autres
Publié: (2025)
Reinforced Model Predictive Control via Trust-Region Quasi-Newton Policy Optimization
par: Brandner, Dean, et autres
Publié: (2024)
par: Brandner, Dean, et autres
Publié: (2024)
Proximal Policy Optimization-Based Reinforcement Learning Approach for DC-DC Boost Converter Control: A Comparative Evaluation Against Traditional Control Techniques
par: Saha, Utsab, et autres
Publié: (2023)
par: Saha, Utsab, et autres
Publié: (2023)
Policy Gradient Methods for Designing Dynamic Output Feedback Controllers
par: Sadamoto, Tomonori, et autres
Publié: (2022)
par: Sadamoto, Tomonori, et autres
Publié: (2022)
Local-Global Learning of Interpretable Control Policies: The Interface between MPC and Reinforcement Learning
par: Banker, Thomas, et autres
Publié: (2025)
par: Banker, Thomas, et autres
Publié: (2025)
Stability Constrained Voltage Control in Distribution Grids with Arbitrary Communication Infrastructure
par: Yuan, Zhenyi, et autres
Publié: (2025)
par: Yuan, Zhenyi, et autres
Publié: (2025)
USLC: Universal Self-Learning Control via Physical Performance Policy-Optimization Neural Network
par: Zhang, Yanhui, et autres
Publié: (2024)
par: Zhang, Yanhui, et autres
Publié: (2024)
Safety Optimized Reinforcement Learning via Multi-Objective Policy Optimization
par: Honari, Homayoun, et autres
Publié: (2024)
par: Honari, Homayoun, et autres
Publié: (2024)
Policy Gradient Bounds in Multitask LQR
par: Stamouli, Charis, et autres
Publié: (2025)
par: Stamouli, Charis, et autres
Publié: (2025)
Optimization Solution Functions as Deterministic Policies for Offline Reinforcement Learning
par: Khattar, Vanshaj, et autres
Publié: (2024)
par: Khattar, Vanshaj, et autres
Publié: (2024)
Safe Policy Optimization via Control Barrier Function-based Safety Filters
par: Chen, Yiting, et autres
Publié: (2026)
par: Chen, Yiting, et autres
Publié: (2026)
Optimisation of Structured Neural Controller Based on Continuous-Time Policy Gradient
par: Cho, Namhoon, et autres
Publié: (2022)
par: Cho, Namhoon, et autres
Publié: (2022)
Algorithm-Relative Trajectory Valuation in Policy Gradient Control
par: Li, Shihao, et autres
Publié: (2025)
par: Li, Shihao, et autres
Publié: (2025)
A Globally Convergent Policy Gradient Method for Linear Quadratic Gaussian (LQG) Control
par: Sadamoto, Tomonori, et autres
Publié: (2023)
par: Sadamoto, Tomonori, et autres
Publié: (2023)
Global Convergence of Policy Gradient Methods for ReLU Controllers in Linear Quadratic Regulation
par: Rodriguez-Gil, Jhojan A., et autres
Publié: (2026)
par: Rodriguez-Gil, Jhojan A., et autres
Publié: (2026)
Policy Optimization in Control: Geometry and Algorithmic Implications
par: Talebi, Shahriar, et autres
Publié: (2024)
par: Talebi, Shahriar, et autres
Publié: (2024)
From Optimization to Control: Quasi Policy Iteration
par: Kolarijani, Mohammad Amin Sharifi, et autres
Publié: (2023)
par: Kolarijani, Mohammad Amin Sharifi, et autres
Publié: (2023)
Documents similaires
-
Efficient Policy Adaptation for Voltage Control Under Unknown Topology Changes
par: Feng, Jie, et autres
Publié: (2026) -
Ventilation and Temperature Control for Energy-efficient and Healthy Buildings: A Differentiable PDE Approach
par: Bian, Yuexin, et autres
Publié: (2024) -
Operator learning for energy-efficient building ventilation control with computational fluid dynamics simulation of a real-world classroom
par: Bian, Yuexin, et autres
Publié: (2025) -
Improving Sequential Market Coordination via Value-oriented Renewable Energy Forecasting
par: Zhang, Yufan, et autres
Publié: (2024) -
Toward Value-oriented Renewable Energy Forecasting: An Iterative Learning Approach
par: Zhang, Yufan, et autres
Publié: (2023)