End-to-End Learning Framework for Solving Non-Markovian Optimal Control
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Xiaole, Zhang, Peiyu, Xiao, Xiongye, Li, Shixuan, Tzoumas, Vasileios, Gupta, Vijay, Bogdan, Paul |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Distributed Online Submodular Maximization under Communication Delays: A Simultaneous Decision-Making Approach
di: Xu, Zirui, et al.
Pubblicazione: (2026)
di: Xu, Zirui, et al.
Pubblicazione: (2026)
Self-Configurable Mesh-Networks for Scalable Distributed Submodular Bandit Optimization
di: Xu, Zirui, et al.
Pubblicazione: (2026)
di: Xu, Zirui, et al.
Pubblicazione: (2026)
Model-Free Learning for the Linear Quadratic Regulator over Rate-Limited Channels
di: Ye, Lintao, et al.
Pubblicazione: (2024)
di: Ye, Lintao, et al.
Pubblicazione: (2024)
Learning Decentralized Linear Quadratic Regulators with $\sqrt{T}$ Regret
di: Ye, Lintao, et al.
Pubblicazione: (2022)
di: Ye, Lintao, et al.
Pubblicazione: (2022)
Resource-Aware Distributed Submodular Maximization: A Paradigm for Multi-Robot Decision-Making
di: Xu, Zirui, et al.
Pubblicazione: (2022)
di: Xu, Zirui, et al.
Pubblicazione: (2022)
Performance-Aware Self-Configurable Multi-Agent Networks: A Distributed Submodular Approach for Simultaneous Coordination and Network Design
di: Xu, Zirui, et al.
Pubblicazione: (2024)
di: Xu, Zirui, et al.
Pubblicazione: (2024)
InterQ: A DQN Framework for Optimal Intermittent Control
di: Aggarwal, Shubham, et al.
Pubblicazione: (2025)
di: Aggarwal, Shubham, et al.
Pubblicazione: (2025)
End-to-end guarantees for indirect data-driven control of bilinear systems with finite stochastic data
di: Chatzikiriakos, Nicolas, et al.
Pubblicazione: (2024)
di: Chatzikiriakos, Nicolas, et al.
Pubblicazione: (2024)
Harnessing Data from Clustered LQR Systems: Personalized and Collaborative Policy Optimization
di: Kanakeri, Vinay, et al.
Pubblicazione: (2025)
di: Kanakeri, Vinay, et al.
Pubblicazione: (2025)
A Sampling Complexity-aware Framework for Discrete-time Fractional-Order Dynamical System Identification
di: Zhang, Xiaole, et al.
Pubblicazione: (2025)
di: Zhang, Xiaole, et al.
Pubblicazione: (2025)
Adversarially-Robust TD Learning with Markovian Data: Finite-Time Rates and Fundamental Limits
di: Maity, Sreejeet, et al.
Pubblicazione: (2025)
di: Maity, Sreejeet, et al.
Pubblicazione: (2025)
Learning-Based Optimal Control with Performance Guarantees for Unknown Systems with Latent States
di: Lefringhausen, Robert, et al.
Pubblicazione: (2023)
di: Lefringhausen, Robert, et al.
Pubblicazione: (2023)
Learning Optimal Control and Dynamical Structure of Global Trajectory Search Problems with Diffusion Models
di: Graebner, Jannik, et al.
Pubblicazione: (2024)
di: Graebner, Jannik, et al.
Pubblicazione: (2024)
End-to-End Training of High-Dimensional Optimal Control with Implicit Hamiltonians via Jacobian-Free Backpropagation
di: Gelphman, Eric, et al.
Pubblicazione: (2025)
di: Gelphman, Eric, et al.
Pubblicazione: (2025)
A Control Theoretic Framework for Adaptive Gradient Optimizers in Machine Learning
di: Chakrabarti, Kushal, et al.
Pubblicazione: (2022)
di: Chakrabarti, Kushal, et al.
Pubblicazione: (2022)
Stochastic Approximation with Unbounded Markovian Noise: A General-Purpose Theorem
di: Haque, Shaan Ul, et al.
Pubblicazione: (2024)
di: Haque, Shaan Ul, et al.
Pubblicazione: (2024)
Deterministic Trajectory Optimization through Probabilistic Optimal Control
di: Filabadi, Mohammad Mahmoudi, et al.
Pubblicazione: (2024)
di: Filabadi, Mohammad Mahmoudi, et al.
Pubblicazione: (2024)
Towards an Optimal Control Perspective of ResNet Training
di: Püttschneider, Jens, et al.
Pubblicazione: (2025)
di: Püttschneider, Jens, et al.
Pubblicazione: (2025)
Achieving Tractable Minimax Optimal Regret in Average Reward MDPs
di: Boone, Victor, et al.
Pubblicazione: (2024)
di: Boone, Victor, et al.
Pubblicazione: (2024)
High-Probability Bounds for SGD under the Polyak-Lojasiewicz Condition with Markovian Noise
di: Kar, Avik, et al.
Pubblicazione: (2026)
di: Kar, Avik, et al.
Pubblicazione: (2026)
Mutual Information Optimal Control of Discrete-Time Linear Systems
di: Enami, Shoju, et al.
Pubblicazione: (2025)
di: Enami, Shoju, et al.
Pubblicazione: (2025)
On Policy Stochasticity in Mutual Information Optimal Control of Linear Systems
di: Enami, Shoju, et al.
Pubblicazione: (2025)
di: Enami, Shoju, et al.
Pubblicazione: (2025)
Communication- and Computation-Efficient Distributed Submodular Optimization in Robot Mesh Networks
di: Xu, Zirui, et al.
Pubblicazione: (2024)
di: Xu, Zirui, et al.
Pubblicazione: (2024)
Cost-Driven Representation Learning for Linear Quadratic Gaussian Control: Part I
di: Tian, Yi, et al.
Pubblicazione: (2022)
di: Tian, Yi, et al.
Pubblicazione: (2022)
Cost-Driven Representation Learning for Linear Quadratic Gaussian Control: Part II
di: Tian, Yi, et al.
Pubblicazione: (2026)
di: Tian, Yi, et al.
Pubblicazione: (2026)
Data-Driven Stochastic Optimal Control in Reproducing Kernel Hilbert Spaces
di: Hoischen, Nicolas, et al.
Pubblicazione: (2024)
di: Hoischen, Nicolas, et al.
Pubblicazione: (2024)
Safe and Near-Optimal Control with Online Dynamics Learning
di: Prajapat, Manish, et al.
Pubblicazione: (2025)
di: Prajapat, Manish, et al.
Pubblicazione: (2025)
Tight Finite Time Bounds of Two-Time-Scale Linear Stochastic Approximation with Markovian Noise
di: Haque, Shaan Ul, et al.
Pubblicazione: (2023)
di: Haque, Shaan Ul, et al.
Pubblicazione: (2023)
Distributionally Robust Regret Optimal Control Under Moment-Based Ambiguity Sets
di: Taha, Feras Al, et al.
Pubblicazione: (2025)
di: Taha, Feras Al, et al.
Pubblicazione: (2025)
Recursively Feasible Probabilistic Safe Online Learning with Control Barrier Functions
di: Castañeda, Fernando, et al.
Pubblicazione: (2022)
di: Castañeda, Fernando, et al.
Pubblicazione: (2022)
Finite-Time Bounds for Two-Time-Scale Stochastic Approximation with Arbitrary Norm Contractions and Markovian Noise
di: Chandak, Siddharth, et al.
Pubblicazione: (2025)
di: Chandak, Siddharth, et al.
Pubblicazione: (2025)
Optimal Parameter Adaptation for Safety-Critical Control via Safe Barrier Bayesian Optimization
di: Wang, Shengbo, et al.
Pubblicazione: (2025)
di: Wang, Shengbo, et al.
Pubblicazione: (2025)
Corruption-Tolerant Asynchronous Q-Learning with Near-Optimal Rates
di: Maity, Sreejeet, et al.
Pubblicazione: (2025)
di: Maity, Sreejeet, et al.
Pubblicazione: (2025)
Non-Parametric Learning of Stochastic Differential Equations with Non-asymptotic Fast Rates of Convergence
di: Bonalli, Riccardo, et al.
Pubblicazione: (2023)
di: Bonalli, Riccardo, et al.
Pubblicazione: (2023)
Mutual Information Optimal Density Control of Linear Systems and Generalized Schrödinger Bridges with Reference Refinement
di: Enami, Shoju, et al.
Pubblicazione: (2026)
di: Enami, Shoju, et al.
Pubblicazione: (2026)
Beyond the Neural Fog: Interpretable Learning for AC Optimal Power Flow
di: Pineda, Salvador, et al.
Pubblicazione: (2024)
di: Pineda, Salvador, et al.
Pubblicazione: (2024)
Distributionally Robust Control with End-to-End Statistically Guaranteed Metric Learning
di: Wu, Jingyi, et al.
Pubblicazione: (2025)
di: Wu, Jingyi, et al.
Pubblicazione: (2025)
Fractional Risk Analysis of Stochastic Systems with Jumps and Memory
di: Sun, Yimeng, et al.
Pubblicazione: (2026)
di: Sun, Yimeng, et al.
Pubblicazione: (2026)
Information Theoretically Optimal Sample Complexity of Learning Dynamical Directed Acyclic Graphs
di: Veedu, Mishfad Shaikh, et al.
Pubblicazione: (2023)
di: Veedu, Mishfad Shaikh, et al.
Pubblicazione: (2023)
Safe Online Control-Informed Learning
di: Zhou, Tianyu, et al.
Pubblicazione: (2025)
di: Zhou, Tianyu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Distributed Online Submodular Maximization under Communication Delays: A Simultaneous Decision-Making Approach
di: Xu, Zirui, et al.
Pubblicazione: (2026) -
Self-Configurable Mesh-Networks for Scalable Distributed Submodular Bandit Optimization
di: Xu, Zirui, et al.
Pubblicazione: (2026) -
Model-Free Learning for the Linear Quadratic Regulator over Rate-Limited Channels
di: Ye, Lintao, et al.
Pubblicazione: (2024) -
Learning Decentralized Linear Quadratic Regulators with $\sqrt{T}$ Regret
di: Ye, Lintao, et al.
Pubblicazione: (2022) -
Resource-Aware Distributed Submodular Maximization: A Paradigm for Multi-Robot Decision-Making
di: Xu, Zirui, et al.
Pubblicazione: (2022)