An Optimal Policy for Learning Controllable Dynamics by Exploration
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Loxley, Peter N. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Optimal Control with Natural Images: Efficient Reinforcement Learning using Overcomplete Sparse Codes
par: Loxley, Peter N.
Publié: (2024)
par: Loxley, Peter N.
Publié: (2024)
Optimal Control-Based Baseline for Guided Exploration in Policy Gradient Methods
par: Lyu, Xubo, et autres
Publié: (2020)
par: Lyu, Xubo, et autres
Publié: (2020)
Benchmarking Reinforcement Learning via Stochastic Converse Optimality: Generating Systems with Known Optimal Policies
par: Ibrahim, Sinan, et autres
Publié: (2026)
par: Ibrahim, Sinan, et autres
Publié: (2026)
Model-Free Learning and Optimal Policy Design in Multi-Agent MDPs Under Probabilistic Agent Dropout
par: Fiscko, Carmel, et autres
Publié: (2023)
par: Fiscko, Carmel, et autres
Publié: (2023)
Co-Learning Port-Hamiltonian Systems and Optimal Energy-Shaping Control
par: Kamboj, Ankur, et autres
Publié: (2026)
par: Kamboj, Ankur, et autres
Publié: (2026)
Control Policy Correction Framework for Reinforcement Learning-based Energy Arbitrage Strategies
par: Madahi, Seyed Soroush Karimi, et autres
Publié: (2024)
par: Madahi, Seyed Soroush Karimi, et autres
Publié: (2024)
Go Beyond Black-box Policies: Rethinking the Design of Learning Agent for Interpretable and Verifiable HVAC Control
par: An, Zhiyu, et autres
Publié: (2024)
par: An, Zhiyu, et autres
Publié: (2024)
Learning controllable dynamics through informative exploration
par: Loxley, Peter N., et autres
Publié: (2025)
par: Loxley, Peter N., et autres
Publié: (2025)
Transfer of Safety Controllers Through Learning Deep Inverse Dynamics Model
par: Nadali, Alireza, et autres
Publié: (2024)
par: Nadali, Alireza, et autres
Publié: (2024)
Hierarchical Policy-Gradient Reinforcement Learning for Multi-Agent Shepherding Control of Non-Cohesive Targets
par: Covone, Stefano, et autres
Publié: (2025)
par: Covone, Stefano, et autres
Publié: (2025)
Optimistic World Models: Efficient Exploration in Model-Based Deep Reinforcement Learning
par: Mete, Akshay, et autres
Publié: (2026)
par: Mete, Akshay, et autres
Publié: (2026)
Unifying Goal-Conditioned RL and Unsupervised Skill Learning via Control-Maximization
par: Modirshanechi, Alireza, et autres
Publié: (2026)
par: Modirshanechi, Alireza, et autres
Publié: (2026)
Optimal Control Operator Perspective and a Neural Adaptive Spectral Method
par: Feng, Mingquan, et autres
Publié: (2024)
par: Feng, Mingquan, et autres
Publié: (2024)
Revisiting LQR Control from the Perspective of Receding-Horizon Policy Gradient
par: Zhang, Xiangyuan, et autres
Publié: (2023)
par: Zhang, Xiangyuan, et autres
Publié: (2023)
Scaling Learning based Policy Optimization for Temporal Logic Tasks by Controller Network Dropout
par: Hashemi, Navid, et autres
Publié: (2024)
par: Hashemi, Navid, et autres
Publié: (2024)
Can Transformers Learn Optimal Filtering for Unknown Systems?
par: Balim, Haldun, et autres
Publié: (2023)
par: Balim, Haldun, et autres
Publié: (2023)
Receding Hamiltonian-Informed Optimal Neural Control and State Estimation for Closed-Loop Dynamical Systems
par: Rivera, Josue N., et autres
Publié: (2024)
par: Rivera, Josue N., et autres
Publié: (2024)
SCI: A Metacognitive Control for Signal Dynamics
par: Meesala, Vishal Joshua
Publié: (2025)
par: Meesala, Vishal Joshua
Publié: (2025)
Implicit Bias of Policy Gradient in Linear Quadratic Control: Extrapolation to Unseen Initial States
par: Razin, Noam, et autres
Publié: (2024)
par: Razin, Noam, et autres
Publié: (2024)
DCoPilot: Generative AI-Empowered Policy Adaptation for Dynamic Data Center Operations
par: Li, Minghao, et autres
Publié: (2026)
par: Li, Minghao, et autres
Publié: (2026)
Data-Driven Exploration for a Class of Continuous-Time Indefinite Linear--Quadratic Reinforcement Learning Problems
par: Huang, Yilie, et autres
Publié: (2025)
par: Huang, Yilie, et autres
Publié: (2025)
Action Dependency Graphs for Globally Optimal Coordinated Reinforcement Learning
par: Ding, Jianglin, et autres
Publié: (2025)
par: Ding, Jianglin, et autres
Publié: (2025)
PGLearn -- An Open-Source Learning Toolkit for Optimal Power Flow
par: Klamkin, Michael, et autres
Publié: (2025)
par: Klamkin, Michael, et autres
Publié: (2025)
Parallel Differentiable Reachability for Learning and Planning with Certified Neural Dynamics and Controllers
par: Shen, Keyi, et autres
Publié: (2026)
par: Shen, Keyi, et autres
Publié: (2026)
Local Linearity of LLMs Enables Activation Steering via Model-Based Linear Optimal Control
par: Skifstad, Julian, et autres
Publié: (2026)
par: Skifstad, Julian, et autres
Publié: (2026)
Representation Learning Enhanced Deep Reinforcement Learning for Optimal Operation of Hydrogen-based Multi-Energy Systems
par: Pu, Zhenyu, et autres
Publié: (2026)
par: Pu, Zhenyu, et autres
Publié: (2026)
A General Approach of Automated Environment Design for Learning the Optimal Power Flow
par: Wolgast, Thomas, et autres
Publié: (2025)
par: Wolgast, Thomas, et autres
Publié: (2025)
From Explainability to Interpretability: Interpretable Policies in Reinforcement Learning Via Model Explanation
par: Li, Peilang, et autres
Publié: (2025)
par: Li, Peilang, et autres
Publié: (2025)
Joint Optimization of Multi-Objective Reinforcement Learning with Policy Gradient Based Algorithm
par: Bai, Qinbo, et autres
Publié: (2021)
par: Bai, Qinbo, et autres
Publié: (2021)
CORL: Reinforcement Learning of MILP Policies Solved via Branch and Bound
par: Anand, Akhil S, et autres
Publié: (2025)
par: Anand, Akhil S, et autres
Publié: (2025)
Epidemic Control on a Large-Scale-Agent-Based Epidemiology Model using Deep Deterministic Policy Gradient
par: Deshkar, Gaurav, et autres
Publié: (2023)
par: Deshkar, Gaurav, et autres
Publié: (2023)
Learning System Dynamics without Forgetting
par: Zhang, Xikun, et autres
Publié: (2024)
par: Zhang, Xikun, et autres
Publié: (2024)
ControlSynth Neural ODEs: Modeling Dynamical Systems with Guaranteed Convergence
par: Mei, Wenjie, et autres
Publié: (2024)
par: Mei, Wenjie, et autres
Publié: (2024)
Towards Machine Learning-based Model Predictive Control for HVAC Control in Multi-Context Buildings at Scale via Ensemble Learning
par: Deng, Yang, et autres
Publié: (2025)
par: Deng, Yang, et autres
Publié: (2025)
Worst-Case Regret Bounds for Exploration via Randomized Value Functions
par: Russo, Daniel
Publié: (2019)
par: Russo, Daniel
Publié: (2019)
RL for Mitigating Cascading Failures: Targeted Exploration via Sensitivity Factors
par: Dwivedi, Anmol, et autres
Publié: (2024)
par: Dwivedi, Anmol, et autres
Publié: (2024)
Differentiable Optimization for Deep Learning-Enhanced DC Approximation of AC Optimal Power Flow
par: Rosemberg, Andrew, et autres
Publié: (2025)
par: Rosemberg, Andrew, et autres
Publié: (2025)
Continual Reinforcement Learning for HVAC Systems Control: Integrating Hypernetworks and Transfer Learning
par: Bekal, Gautham Udayakumar, et autres
Publié: (2025)
par: Bekal, Gautham Udayakumar, et autres
Publié: (2025)
Facilitating Reinforcement Learning for Process Control Using Transfer Learning: Overview and Perspectives
par: Lin, Runze, et autres
Publié: (2024)
par: Lin, Runze, et autres
Publié: (2024)
Constrained Reinforcement Learning for Safe Heat Pump Control
par: Zhang, Baohe, et autres
Publié: (2024)
par: Zhang, Baohe, et autres
Publié: (2024)
Documents similaires
-
Optimal Control with Natural Images: Efficient Reinforcement Learning using Overcomplete Sparse Codes
par: Loxley, Peter N.
Publié: (2024) -
Optimal Control-Based Baseline for Guided Exploration in Policy Gradient Methods
par: Lyu, Xubo, et autres
Publié: (2020) -
Benchmarking Reinforcement Learning via Stochastic Converse Optimality: Generating Systems with Known Optimal Policies
par: Ibrahim, Sinan, et autres
Publié: (2026) -
Model-Free Learning and Optimal Policy Design in Multi-Agent MDPs Under Probabilistic Agent Dropout
par: Fiscko, Carmel, et autres
Publié: (2023) -
Co-Learning Port-Hamiltonian Systems and Optimal Energy-Shaping Control
par: Kamboj, Ankur, et autres
Publié: (2026)