Salvato in:
| Autori principali: | Shi, Chongyang, Han, Shuo, Dorothy, Michael, Fu, Jie |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2409.16439 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Policy Gradient Methods for Information-Theoretic Opacity in Markov Decision Processes
di: Shi, Chongyang, et al.
Pubblicazione: (2025)
di: Shi, Chongyang, et al.
Pubblicazione: (2025)
Integrated Control and Active Perception in POMDPs for Temporal Logic Tasks and Information Acquisition
di: Shi, Chongyang, et al.
Pubblicazione: (2025)
di: Shi, Chongyang, et al.
Pubblicazione: (2025)
IMAS$^2$: Joint Agent Selection and Information-Theoretic Coordinated Perception In Dec-POMDPs
di: Shi, Chongyang, et al.
Pubblicazione: (2025)
di: Shi, Chongyang, et al.
Pubblicazione: (2025)
C-IDS: Solving Contextual POMDP via Information-Directed Objective
di: Shi, Chongyang, et al.
Pubblicazione: (2026)
di: Shi, Chongyang, et al.
Pubblicazione: (2026)
Active Inference through Incentive Design in Markov Decision Processes
di: Wei, Xinyi, et al.
Pubblicazione: (2025)
di: Wei, Xinyi, et al.
Pubblicazione: (2025)
Information-Theoretic Opacity-Enforcement in Markov Decision Processes
di: Shi, Chongyang, et al.
Pubblicazione: (2024)
di: Shi, Chongyang, et al.
Pubblicazione: (2024)
Synthesis of Dynamic Masks for Information-Theoretic Opacity in Stochastic Systems
di: Udupa, Sumukha, et al.
Pubblicazione: (2025)
di: Udupa, Sumukha, et al.
Pubblicazione: (2025)
Information-Driven Active Perception for k-step Predictive Safety Monitoring
di: Udupa, Sumukha, et al.
Pubblicazione: (2026)
di: Udupa, Sumukha, et al.
Pubblicazione: (2026)
DiffOP: Reinforcement Learning of Optimization-Based Control Policies via Implicit Policy Gradients
di: Bian, Yuexin, et al.
Pubblicazione: (2024)
di: Bian, Yuexin, et al.
Pubblicazione: (2024)
Implicit Bias of Policy Gradient in Linear Quadratic Control: Extrapolation to Unseen Initial States
di: Razin, Noam, et al.
Pubblicazione: (2024)
di: Razin, Noam, et al.
Pubblicazione: (2024)
LQR for Systems with Probabilistic Parametric Uncertainties: A Gradient Method
di: Cui, Leilei, et al.
Pubblicazione: (2026)
di: Cui, Leilei, et al.
Pubblicazione: (2026)
A Stochastic Gradient Descent Approach to Design Policy Gradient Methods for LQR
di: Song, Bowen, et al.
Pubblicazione: (2026)
di: Song, Bowen, et al.
Pubblicazione: (2026)
A Globally Convergent Policy Gradient Method for Linear Quadratic Gaussian (LQG) Control
di: Sadamoto, Tomonori, et al.
Pubblicazione: (2023)
di: Sadamoto, Tomonori, et al.
Pubblicazione: (2023)
Policy Gradient Methods for the Cost-Constrained LQR: Strong Duality and Global Convergence
di: Zhao, Feiran, et al.
Pubblicazione: (2024)
di: Zhao, Feiran, et al.
Pubblicazione: (2024)
Policy Gradient Methods for Designing Dynamic Output Feedback Controllers
di: Sadamoto, Tomonori, et al.
Pubblicazione: (2022)
di: Sadamoto, Tomonori, et al.
Pubblicazione: (2022)
Second-Order Policy Gradient Methods for the Linear Quadratic Regulator
di: Valaei, Amirreza, et al.
Pubblicazione: (2025)
di: Valaei, Amirreza, et al.
Pubblicazione: (2025)
Global Convergence of Policy Gradient Methods for ReLU Controllers in Linear Quadratic Regulation
di: Rodriguez-Gil, Jhojan A., et al.
Pubblicazione: (2026)
di: Rodriguez-Gil, Jhojan A., et al.
Pubblicazione: (2026)
Model-Free Output Feedback Stabilization via Policy Gradient Methods
di: Zhang, Ankang, et al.
Pubblicazione: (2026)
di: Zhang, Ankang, et al.
Pubblicazione: (2026)
Convergence Guarantees of Model-free Policy Gradient Methods for LQR with Stochastic Data
di: Song, Bowen, et al.
Pubblicazione: (2025)
di: Song, Bowen, et al.
Pubblicazione: (2025)
On Globally Optimal Stochastic Policy Gradient Methods for Domain Randomized LQR Synthesis
di: Nguyen-Le, Alex, et al.
Pubblicazione: (2026)
di: Nguyen-Le, Alex, et al.
Pubblicazione: (2026)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
Policy Gradient Bounds in Multitask LQR
di: Stamouli, Charis, et al.
Pubblicazione: (2025)
di: Stamouli, Charis, et al.
Pubblicazione: (2025)
Planning Stealthy Backdoor Attacks in MDPs with Observation-Based Triggers
di: Wei, Xinyi, et al.
Pubblicazione: (2025)
di: Wei, Xinyi, et al.
Pubblicazione: (2025)
Data-Driven Contextual-Aware Uncertainty Set for Robust Dispatch of Power Systems
di: Ruan, Zhaojun, et al.
Pubblicazione: (2026)
di: Ruan, Zhaojun, et al.
Pubblicazione: (2026)
Heterogeneous Roles against Assignment Based Policies in Two vs Two Target Defense Game
di: Das, Goutam, et al.
Pubblicazione: (2024)
di: Das, Goutam, et al.
Pubblicazione: (2024)
Policy Gradient Method for LQG Control via Input-Output-History Representation: Convergence to $O(ε)$-Stationary Points
di: Sadamoto, Tomonori, et al.
Pubblicazione: (2025)
di: Sadamoto, Tomonori, et al.
Pubblicazione: (2025)
Stabilizing Policy Gradient Methods via Reward Profiling
di: Ahmed, Shihab, et al.
Pubblicazione: (2025)
di: Ahmed, Shihab, et al.
Pubblicazione: (2025)
Receding-Horizon Policy Gradient for Polytopic Controller Synthesis
di: Shakeri, Shiva, et al.
Pubblicazione: (2026)
di: Shakeri, Shiva, et al.
Pubblicazione: (2026)
Efficient Policy Adaptation for Voltage Control Under Unknown Topology Changes
di: Feng, Jie, et al.
Pubblicazione: (2026)
di: Feng, Jie, et al.
Pubblicazione: (2026)
Sample-Efficient Model-Free Policy Gradient Methods for Stochastic LQR via Robust Linear Regression
di: Song, Bowen, et al.
Pubblicazione: (2025)
di: Song, Bowen, et al.
Pubblicazione: (2025)
A Twin Delayed Deep Deterministic Policy Gradient Algorithm for Autonomous Ground Vehicle Navigation via Digital Twin Perception Awareness
di: Olayemi, Kabirat, et al.
Pubblicazione: (2024)
di: Olayemi, Kabirat, et al.
Pubblicazione: (2024)
Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches
di: Zhao, Feiran, et al.
Pubblicazione: (2025)
di: Zhao, Feiran, et al.
Pubblicazione: (2025)
Policy Optimization with Differentiable MPC: Convergence Analysis under Uncertainty
di: Zuliani, Riccardo, et al.
Pubblicazione: (2026)
di: Zuliani, Riccardo, et al.
Pubblicazione: (2026)
Initial State Privacy of Nonlinear Systems on Riemannian Manifolds
di: Liu, Le, et al.
Pubblicazione: (2025)
di: Liu, Le, et al.
Pubblicazione: (2025)
Active Learning-Based Input Design for Angle-Only Initial Relative Orbit Determination
di: Xie, Kui, et al.
Pubblicazione: (2025)
di: Xie, Kui, et al.
Pubblicazione: (2025)
Variance-Reduced Gradient Estimator for Nonconvex Zeroth-Order Distributed Optimization
di: Mu, Huaiyi, et al.
Pubblicazione: (2024)
di: Mu, Huaiyi, et al.
Pubblicazione: (2024)
Relax, Estimate, and Track: a Simple Battery State-of-charge and State-of-health Estimation Method
di: Jiang, Shida, et al.
Pubblicazione: (2024)
di: Jiang, Shida, et al.
Pubblicazione: (2024)
Uncertainty-Aware Perception-Based Control for Autonomous Racing
di: Trisovic, Jelena, et al.
Pubblicazione: (2025)
di: Trisovic, Jelena, et al.
Pubblicazione: (2025)
Event-triggered Dual Gradient Tracking for Distributed Resource Allocation
di: Xu, Xiayan, et al.
Pubblicazione: (2025)
di: Xu, Xiayan, et al.
Pubblicazione: (2025)
Stability-Certified On-Policy Data-Driven LQR via Recursive Learning and Policy Gradient
di: Sforni, Lorenzo, et al.
Pubblicazione: (2024)
di: Sforni, Lorenzo, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Policy Gradient Methods for Information-Theoretic Opacity in Markov Decision Processes
di: Shi, Chongyang, et al.
Pubblicazione: (2025) -
Integrated Control and Active Perception in POMDPs for Temporal Logic Tasks and Information Acquisition
di: Shi, Chongyang, et al.
Pubblicazione: (2025) -
IMAS$^2$: Joint Agent Selection and Information-Theoretic Coordinated Perception In Dec-POMDPs
di: Shi, Chongyang, et al.
Pubblicazione: (2025) -
C-IDS: Solving Contextual POMDP via Information-Directed Objective
di: Shi, Chongyang, et al.
Pubblicazione: (2026) -
Active Inference through Incentive Design in Markov Decision Processes
di: Wei, Xinyi, et al.
Pubblicazione: (2025)