Convergence Rates of Online Critic Value Function Approximation in Native Spaces
Fuente:
arXiv
Guardado en:
| Autores principales: | Niu, Shengyuan, Bouland, Ali, Wang, Haoran, Fotiadis, Filippos, Kurdila, Andrew, L'Afflitto, Andrea, Paruchuri, Sai Tej, Vamvoudakis, Kyriakos G. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Tailoring Reproducing Kernels for Optimal Control via Policy Iteration
por: Niu, Shengyuan, et al.
Publicado: (2025)
por: Niu, Shengyuan, et al.
Publicado: (2025)
Vector-Valued Native Space Embedding for Adaptive State Observation
por: Niu, Shengyuan, et al.
Publicado: (2025)
por: Niu, Shengyuan, et al.
Publicado: (2025)
A Physics-Informed Learning Framework to Solve the Infinite-Horizon Optimal Control Problem
por: Fotiadis, Filippos, et al.
Publicado: (2025)
por: Fotiadis, Filippos, et al.
Publicado: (2025)
Input-Output Data-Driven Sensor Selection for Cyber-Physical Systems
por: Fotiadis, Filippos, et al.
Publicado: (2025)
por: Fotiadis, Filippos, et al.
Publicado: (2025)
Functional Uncertainty Classes, Nonparametric Adaptive Contro Functional Uncertainty Classes for Nonparametric Adaptive Control: the Curse of Dimensionality
por: Wang, Haoran, et al.
Publicado: (2025)
por: Wang, Haoran, et al.
Publicado: (2025)
Robust Model Reference Adaptive Control Based on Reproducing Kernel Hilbert Spaces
por: Haoran Wang, et al.
Publicado: (2025)
por: Haoran Wang, et al.
Publicado: (2025)
Deception Against Data-Driven Linear-Quadratic Control
por: Fotiadis, Filippos, et al.
Publicado: (2025)
por: Fotiadis, Filippos, et al.
Publicado: (2025)
A Novel Framework for Honey-X Deception in Zero-Sum Games
por: Gould, Brendan, et al.
Publicado: (2025)
por: Gould, Brendan, et al.
Publicado: (2025)
Adversarial Observability and Performance Trade-offs in Optimal Control
por: Fotiadis, Filippos, et al.
Publicado: (2025)
por: Fotiadis, Filippos, et al.
Publicado: (2025)
Adversarial Pursuits in Cislunar Space
por: Fotiadis, Filippos, et al.
Publicado: (2025)
por: Fotiadis, Filippos, et al.
Publicado: (2025)
Quantum Deception: Honey-X Deception using Quantum Games
por: Reppas, Efstratios, et al.
Publicado: (2025)
por: Reppas, Efstratios, et al.
Publicado: (2025)
Decentralized and Privacy-Preserving Learning of Approximate Stackelberg Solutions in Energy Trading Games with Demand Response Aggregators
por: Kampezidou, Styliani I., et al.
Publicado: (2023)
por: Kampezidou, Styliani I., et al.
Publicado: (2023)
Synthesizing Interacting Model‐Based Optimal Control and Model‐Free Learning Approaches for Nonlinear Systems
por: Surabhi Athalye, et al.
Publicado: (2026)
por: Surabhi Athalye, et al.
Publicado: (2026)
Coordinated UAV Beamforming and Control for Directional Jamming and Nulling
por: Fotiadis, Filippos, et al.
Publicado: (2025)
por: Fotiadis, Filippos, et al.
Publicado: (2025)
Cost-Matching Model Predictive Control for Efficient Reinforcement Learning in Humanoid Locomotion
por: Cai, Wenqi, et al.
Publicado: (2026)
por: Cai, Wenqi, et al.
Publicado: (2026)
Control of the Fluidic Pinball using the Quadratic-Quadratic Regulator
por: Bouland, Ali, et al.
Publicado: (2026)
por: Bouland, Ali, et al.
Publicado: (2026)
Robust Multi-Agent Reinforcement Learning for Small UAS Separation Assurance under GPS Degradation and Spoofing
por: Zongo, Alex, et al.
Publicado: (2026)
por: Zongo, Alex, et al.
Publicado: (2026)
Over-Approximating Minimizer Sets of Constrained Convex Programs with Parametric Uncertainty via Reachability Analysis
por: Gould, Brendan, et al.
Publicado: (2026)
por: Gould, Brendan, et al.
Publicado: (2026)
Actively Learning Reinforcement Learning: A Stochastic Optimal Control Approach
por: Ramadan, Mohammad S., et al.
Publicado: (2023)
por: Ramadan, Mohammad S., et al.
Publicado: (2023)
Resilient Learning-Based Control Under Denial-of-Service Attacks
por: Chakraborty, Sayan, et al.
Publicado: (2024)
por: Chakraborty, Sayan, et al.
Publicado: (2024)
Optimal Satellite Maneuvers for Spaceborne Jamming Attacks
por: Fotiadis, Filippos, et al.
Publicado: (2025)
por: Fotiadis, Filippos, et al.
Publicado: (2025)
Secure Coordination for Vertiport Sequencing in Advanced Air Mobility
por: Im, Jaehan, et al.
Publicado: (2026)
por: Im, Jaehan, et al.
Publicado: (2026)
Approximate Feedback Nash Equilibria with Sparse Inter-Agent Dependencies
por: Liu, Xinjie, et al.
Publicado: (2024)
por: Liu, Xinjie, et al.
Publicado: (2024)
Noncooperative Consensus via a Trading-based Auction
por: Im, Jaehan, et al.
Publicado: (2025)
por: Im, Jaehan, et al.
Publicado: (2025)
On‐Design and Off‐Design Performance of Variable Area Ejectors: A Comparative Study of Constant Rate of Momentum Change and Constant Rate of Kinetic Energy Change Methods
por: Virendra Kumar, et al.
Publicado: (2025)
por: Virendra Kumar, et al.
Publicado: (2025)
Provably Efficient Offline-to-Online Value Adaptation with General Function Approximation
por: Li, Shangzhe, et al.
Publicado: (2026)
por: Li, Shangzhe, et al.
Publicado: (2026)
A Convergent Primal-Dual Algorithm for Computing Rate-Distortion-Perception Functions
por: Chen, Chunhui, et al.
Publicado: (2025)
por: Chen, Chunhui, et al.
Publicado: (2025)
Democratizing Scalable Cloud Applications: Transactional Stateful Functions on Streaming Dataflows
por: Psarakis, Kyriakos
Publicado: (2025)
por: Psarakis, Kyriakos
Publicado: (2025)
On the Monotonicity and Rate of Convergence of the Markovian Persuasion Value
por: Shaiderman, Dimitry
Publicado: (2025)
por: Shaiderman, Dimitry
Publicado: (2025)
Preserving the Privacy of Reward Functions in MDPs through Deception
por: Chirra, Shashank Reddy, et al.
Publicado: (2024)
por: Chirra, Shashank Reddy, et al.
Publicado: (2024)
Online Multi-Contact Receding Horizon Planning via Value Function Approximation
por: Wang, Jiayi, et al.
Publicado: (2023)
por: Wang, Jiayi, et al.
Publicado: (2023)
SPICE: Scaling-Aware Prediction Correction Methods with a Free Convergence Rate for Nonlinear Convex Optimization
por: Wang, Sai
Publicado: (2024)
por: Wang, Sai
Publicado: (2024)
Computation and Critical Transitions of Rate-Distortion-Perception Functions With Wasserstein Barycenter
por: Chen, Chunhui, et al.
Publicado: (2024)
por: Chen, Chunhui, et al.
Publicado: (2024)
Optimal Convergence Rates in Multiscale Elliptic Homogenization
por: Weisheng Niu, et al.
Publicado: (2026)
por: Weisheng Niu, et al.
Publicado: (2026)
On the hardness of learning ground state entanglement of geometrically local Hamiltonians
por: Bouland, Adam, et al.
Publicado: (2024)
por: Bouland, Adam, et al.
Publicado: (2024)
On Joint Convergence of Traffic State and Weight Vector in Learning-Based Dynamic Routing with Value Function Approximation
por: Wu, Yidan, et al.
Publicado: (2024)
por: Wu, Yidan, et al.
Publicado: (2024)
Universal Approximation with XL MIMO Systems: OTA Classification via Trainable Analog Combining
por: Stylianopoulos, Kyriakos, et al.
Publicado: (2025)
por: Stylianopoulos, Kyriakos, et al.
Publicado: (2025)
Sampling in Shift‐Invariant Spaces Generated by Hilbert Space‐Valued Functions
por: Md Hasan Ali Biswas, et al.
Publicado: (2025)
por: Md Hasan Ali Biswas, et al.
Publicado: (2025)
Approximation Rates of Shallow Neural Networks: Barron Spaces, Activation Functions and Optimality Analysis
por: Lu, Jian, et al.
Publicado: (2025)
por: Lu, Jian, et al.
Publicado: (2025)
Explicit harmonic and wave maps into variable-curvature surfaces
por: Fotiadis, Anestis, et al.
Publicado: (2025)
por: Fotiadis, Anestis, et al.
Publicado: (2025)
Ejemplares similares
-
Tailoring Reproducing Kernels for Optimal Control via Policy Iteration
por: Niu, Shengyuan, et al.
Publicado: (2025) -
Vector-Valued Native Space Embedding for Adaptive State Observation
por: Niu, Shengyuan, et al.
Publicado: (2025) -
A Physics-Informed Learning Framework to Solve the Infinite-Horizon Optimal Control Problem
por: Fotiadis, Filippos, et al.
Publicado: (2025) -
Input-Output Data-Driven Sensor Selection for Cyber-Physical Systems
por: Fotiadis, Filippos, et al.
Publicado: (2025) -
Functional Uncertainty Classes, Nonparametric Adaptive Contro Functional Uncertainty Classes for Nonparametric Adaptive Control: the Curse of Dimensionality
por: Wang, Haoran, et al.
Publicado: (2025)