Implicit Bias of Policy Gradient in Linear Quadratic Control: Extrapolation to Unseen Initial States
Fuente:
arXiv
Salvato in:
| Autori principali: | Razin, Noam, Alexander, Yotam, Cohen-Karlik, Edo, Giryes, Raja, Globerson, Amir, Cohen, Nadav |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Provable Benefits of Complex Parameterizations for Structured State Space Models
di: Ran-Milo, Yuval, et al.
Pubblicazione: (2024)
di: Ran-Milo, Yuval, et al.
Pubblicazione: (2024)
The Implicit Bias of Structured State Space Models Can Be Poisoned With Clean Labels
di: Slutzky, Yonatan, et al.
Pubblicazione: (2024)
di: Slutzky, Yonatan, et al.
Pubblicazione: (2024)
Lecture Notes on Linear Neural Networks: A Tale of Optimization and Generalization in Deep Learning
di: Cohen, Nadav, et al.
Pubblicazione: (2024)
di: Cohen, Nadav, et al.
Pubblicazione: (2024)
DeciMamba: Exploring the Length Extrapolation Potential of Mamba
di: Ben-Kish, Assaf, et al.
Pubblicazione: (2024)
di: Ben-Kish, Assaf, et al.
Pubblicazione: (2024)
A Globally Convergent Policy Gradient Method for Linear Quadratic Gaussian (LQG) Control
di: Sadamoto, Tomonori, et al.
Pubblicazione: (2023)
di: Sadamoto, Tomonori, et al.
Pubblicazione: (2023)
Global Convergence of Policy Gradient Methods for ReLU Controllers in Linear Quadratic Regulation
di: Rodriguez-Gil, Jhojan A., et al.
Pubblicazione: (2026)
di: Rodriguez-Gil, Jhojan A., et al.
Pubblicazione: (2026)
Optimality of Linear Policies in Distributionally Robust Linear Quadratic Control
di: Taşkesen, Bahar, et al.
Pubblicazione: (2025)
di: Taşkesen, Bahar, et al.
Pubblicazione: (2025)
Second-Order Policy Gradient Methods for the Linear Quadratic Regulator
di: Valaei, Amirreza, et al.
Pubblicazione: (2025)
di: Valaei, Amirreza, et al.
Pubblicazione: (2025)
Adaptive Kalman-Informed Transformer
di: Cohen, Nadav, et al.
Pubblicazione: (2024)
di: Cohen, Nadav, et al.
Pubblicazione: (2024)
Seamless Underwater Navigation with Limited Doppler Velocity Log Measurements
di: Cohen, Nadav, et al.
Pubblicazione: (2024)
di: Cohen, Nadav, et al.
Pubblicazione: (2024)
What Makes Data Suitable for a Locally Connected Neural Network? A Necessary and Sufficient Condition Based on Quantum Entanglement
di: Alexander, Yotam, et al.
Pubblicazione: (2023)
di: Alexander, Yotam, et al.
Pubblicazione: (2023)
Data-driven Linear Quadratic Integral Control: A Convex Formulation and Policy Gradient Approach
di: Gießler, Armin, et al.
Pubblicazione: (2026)
di: Gießler, Armin, et al.
Pubblicazione: (2026)
Distributed Policy Gradient for Linear Quadratic Networked Control with Limited Communication Range
di: Yan, Yuzi, et al.
Pubblicazione: (2024)
di: Yan, Yuzi, et al.
Pubblicazione: (2024)
Convergence of Flow-Policy Gradient Learning for Linear Quadratic Regulator Problems
di: Yaghmaie, Farnaz Adib, et al.
Pubblicazione: (2025)
di: Yaghmaie, Farnaz Adib, et al.
Pubblicazione: (2025)
On the Global Optimality of Linear Policies for Sinkhorn Distributionally Robust Linear Quadratic Control
di: Cescon, Riccardo, et al.
Pubblicazione: (2025)
di: Cescon, Riccardo, et al.
Pubblicazione: (2025)
Gaussian Process Regression for Improved Underwater Navigation
di: Cohen, Nadav, et al.
Pubblicazione: (2025)
di: Cohen, Nadav, et al.
Pubblicazione: (2025)
Data-Driven Strategies for Coping with Incomplete DVL Measurements
di: Cohen, Nadav, et al.
Pubblicazione: (2024)
di: Cohen, Nadav, et al.
Pubblicazione: (2024)
Inertial Navigation Meets Deep Learning: A Survey of Current Trends and Future Directions
di: Cohen, Nadav, et al.
Pubblicazione: (2023)
di: Cohen, Nadav, et al.
Pubblicazione: (2023)
On the Expressivity of Selective State-Space Layers: A Multivariate Polynomial Approach
di: Cohen-Karlik, Edo, et al.
Pubblicazione: (2025)
di: Cohen-Karlik, Edo, et al.
Pubblicazione: (2025)
Active Perception with Initial-State Uncertainty: A Policy Gradient Method
di: Shi, Chongyang, et al.
Pubblicazione: (2024)
di: Shi, Chongyang, et al.
Pubblicazione: (2024)
Inverse Optimal Control for Linear Quadratic Tracking with Unknown Target States
di: Li, Yao, et al.
Pubblicazione: (2024)
di: Li, Yao, et al.
Pubblicazione: (2024)
Sample Complexity of Linear Quadratic Regulator Without Initial Stability
di: Moghaddam, Amirreza Neshaei, et al.
Pubblicazione: (2025)
di: Moghaddam, Amirreza Neshaei, et al.
Pubblicazione: (2025)
Linear Convergence of Data-Enabled Policy Optimization for Linear Quadratic Tracking
di: Kang, Shubo, et al.
Pubblicazione: (2024)
di: Kang, Shubo, et al.
Pubblicazione: (2024)
DiffOP: Reinforcement Learning of Optimization-Based Control Policies via Implicit Policy Gradients
di: Bian, Yuexin, et al.
Pubblicazione: (2024)
di: Bian, Yuexin, et al.
Pubblicazione: (2024)
Data-Enabled Policy and Value Iteration for Continuous-Time Linear Quadratic Output Feedback Control
di: Xie, Jun, et al.
Pubblicazione: (2026)
di: Xie, Jun, et al.
Pubblicazione: (2026)
Ergodic-Risk Constrained Policy Optimization: The Linear Quadratic Case
di: Talebi, Shahriar, et al.
Pubblicazione: (2025)
di: Talebi, Shahriar, et al.
Pubblicazione: (2025)
Direct Data-Driven Linear Quadratic Tracking via Policy Optimization
di: Kang, Shubo, et al.
Pubblicazione: (2026)
di: Kang, Shubo, et al.
Pubblicazione: (2026)
Robustness and Consistency in Linear Quadratic Control with Untrusted Predictions
di: Li, Tongxin, et al.
Pubblicazione: (2021)
di: Li, Tongxin, et al.
Pubblicazione: (2021)
Global Convergence of Policy Gradient for Entropy Regularized Linear-Quadratic Control with Multiplicative Noise
di: Diaz, Gabriel, et al.
Pubblicazione: (2025)
di: Diaz, Gabriel, et al.
Pubblicazione: (2025)
Input-to-State Safe Backstepping: Robust Safety-Critical Control with Unmatched Uncertainties
di: Cohen, Max H., et al.
Pubblicazione: (2026)
di: Cohen, Max H., et al.
Pubblicazione: (2026)
Quadratic Optimal Control of Graphon Q-noise Linear Systems
di: Dunyak, Alex, et al.
Pubblicazione: (2024)
di: Dunyak, Alex, et al.
Pubblicazione: (2024)
Domain Randomization is Sample Efficient for Linear Quadratic Control
di: Fujinami, Tesshu, et al.
Pubblicazione: (2025)
di: Fujinami, Tesshu, et al.
Pubblicazione: (2025)
Deception Against Data-Driven Linear-Quadratic Control
di: Fotiadis, Filippos, et al.
Pubblicazione: (2025)
di: Fotiadis, Filippos, et al.
Pubblicazione: (2025)
Scalable Reinforcement Learning for Linear-Quadratic Control of Networks
di: Olsson, Johan, et al.
Pubblicazione: (2024)
di: Olsson, Johan, et al.
Pubblicazione: (2024)
An Efficient Data-Driven Framework for Linear Quadratic Output Feedback Control
di: Xie, Jun, et al.
Pubblicazione: (2025)
di: Xie, Jun, et al.
Pubblicazione: (2025)
Complete Decentralization of Linear Quadratic Gaussian Control for the Discrete Wave Equation
di: McCurdy, Addie, et al.
Pubblicazione: (2025)
di: McCurdy, Addie, et al.
Pubblicazione: (2025)
Online Actuator Selection and Controller Design for Linear Quadratic Regulation with Unknown System Model
di: Ye, Lintao, et al.
Pubblicazione: (2022)
di: Ye, Lintao, et al.
Pubblicazione: (2022)
Controlling Dynamical Systems into Unseen Target States Using Machine Learning
di: Köglmayr, Daniel, et al.
Pubblicazione: (2024)
di: Köglmayr, Daniel, et al.
Pubblicazione: (2024)
Gradient Dominance in the Linear Quadratic Regulator: A Unified Analysis for Continuous-Time and Discrete-Time Systems
di: Watanabe, Yuto, et al.
Pubblicazione: (2026)
di: Watanabe, Yuto, et al.
Pubblicazione: (2026)
Control-Oriented Identification for the Linear Quadratic Regulator: Technical Report
di: Anderson, Sean, et al.
Pubblicazione: (2024)
di: Anderson, Sean, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Provable Benefits of Complex Parameterizations for Structured State Space Models
di: Ran-Milo, Yuval, et al.
Pubblicazione: (2024) -
The Implicit Bias of Structured State Space Models Can Be Poisoned With Clean Labels
di: Slutzky, Yonatan, et al.
Pubblicazione: (2024) -
Lecture Notes on Linear Neural Networks: A Tale of Optimization and Generalization in Deep Learning
di: Cohen, Nadav, et al.
Pubblicazione: (2024) -
DeciMamba: Exploring the Length Extrapolation Potential of Mamba
di: Ben-Kish, Assaf, et al.
Pubblicazione: (2024) -
A Globally Convergent Policy Gradient Method for Linear Quadratic Gaussian (LQG) Control
di: Sadamoto, Tomonori, et al.
Pubblicazione: (2023)