Hereditary Geometric Meta-RL: Nonlocal Generalization via Task Symmetries
Fuente:
arXiv
Salvato in:
| Autori principali: | Nitschke, Paul, Talebi, Shahriar |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Benchmarking Reinforcement Learning via Stochastic Converse Optimality: Generating Systems with Known Optimal Policies
di: Ibrahim, Sinan, et al.
Pubblicazione: (2026)
di: Ibrahim, Sinan, et al.
Pubblicazione: (2026)
Enhanced-FQL($λ$), an Efficient and Interpretable RL with novel Fuzzy Eligibility Traces and Segmented Experience Replay
di: Jalaeian-Farimani, Mohsen, et al.
Pubblicazione: (2026)
di: Jalaeian-Farimani, Mohsen, et al.
Pubblicazione: (2026)
Learning Kalman Policy for Singular Unknown Covariances via Riemannian Regularization
di: Bier, Larsen, et al.
Pubblicazione: (2026)
di: Bier, Larsen, et al.
Pubblicazione: (2026)
Recursive Entropic Risk Optimization in Discounted MDPs: Sample Complexity Bounds with a Generative Model
di: Mortensen, Oliver, et al.
Pubblicazione: (2025)
di: Mortensen, Oliver, et al.
Pubblicazione: (2025)
Provably Safe Generative Sampling with Constricting Barrier Functions
di: Gadginmath, Darshan, et al.
Pubblicazione: (2026)
di: Gadginmath, Darshan, et al.
Pubblicazione: (2026)
Generative AI and Process Systems Engineering: The Next Frontier
di: Decardi-Nelson, Benjamin, et al.
Pubblicazione: (2024)
di: Decardi-Nelson, Benjamin, et al.
Pubblicazione: (2024)
Fitted Q-Iteration via Max-Plus-Linear Approximation
di: Liu, Y., et al.
Pubblicazione: (2024)
di: Liu, Y., et al.
Pubblicazione: (2024)
CORL: Reinforcement Learning of MILP Policies Solved via Branch and Bound
di: Anand, Akhil S, et al.
Pubblicazione: (2025)
di: Anand, Akhil S, et al.
Pubblicazione: (2025)
Infinite-Horizon Reach-Avoid Zero-Sum Games via Deep Reinforcement Learning
di: Li, Jingqi, et al.
Pubblicazione: (2022)
di: Li, Jingqi, et al.
Pubblicazione: (2022)
Distributionally Robust Safety Verification of Neural Networks via Worst-Case CVaR
di: Kishida, Masako
Pubblicazione: (2025)
di: Kishida, Masako
Pubblicazione: (2025)
Local Linearity of LLMs Enables Activation Steering via Model-Based Linear Optimal Control
di: Skifstad, Julian, et al.
Pubblicazione: (2026)
di: Skifstad, Julian, et al.
Pubblicazione: (2026)
Asynchronous Distributed Reinforcement Learning for LQR Control via Zeroth-Order Block Coordinate Descent
di: Jing, Gangshan, et al.
Pubblicazione: (2021)
di: Jing, Gangshan, et al.
Pubblicazione: (2021)
DiscoverDCP: A Data-Driven Approach for Construction of Disciplined Convex Programs via Symbolic Regression
di: Myhre, Sveinung
Pubblicazione: (2025)
di: Myhre, Sveinung
Pubblicazione: (2025)
gridfm-datakit-v1: A Python Library for Scalable and Realistic Power Flow and Optimal Power Flow Data Generation
di: Puech, Alban, et al.
Pubblicazione: (2025)
di: Puech, Alban, et al.
Pubblicazione: (2025)
Ergodic-risk Criterion for Stochastically Stabilizing Policy Optimization
di: Talebi, Shahriar, et al.
Pubblicazione: (2024)
di: Talebi, Shahriar, et al.
Pubblicazione: (2024)
Ergodic-Risk Constrained Policy Optimization: The Linear Quadratic Case
di: Talebi, Shahriar, et al.
Pubblicazione: (2025)
di: Talebi, Shahriar, et al.
Pubblicazione: (2025)
Distributed Optimization via Energy Conservation Laws in Dilated Coordinates
di: Baranwal, Mayank, et al.
Pubblicazione: (2024)
di: Baranwal, Mayank, et al.
Pubblicazione: (2024)
WARP: A Benchmark for Primal-Dual Warm-Starting of Interior-Point Solvers
di: Suri, Dhruv, et al.
Pubblicazione: (2026)
di: Suri, Dhruv, et al.
Pubblicazione: (2026)
Nonlinear Non-Gaussian Density Steering with Input and Noise Channel Mismatch: Sinkhorn with Memory for Solving the Control-affine Schrödinger Bridge Problem
di: Bondar, Georgiy A., et al.
Pubblicazione: (2026)
di: Bondar, Georgiy A., et al.
Pubblicazione: (2026)
ART for Diffusion Sampling: A Reinforcement Learning Approach to Timestep Schedule
di: Huang, Yilie, et al.
Pubblicazione: (2026)
di: Huang, Yilie, et al.
Pubblicazione: (2026)
Bridging Control with Neural Network Verifier alpha-beta-CROWN: A Tutorial
di: Li, Haoyu, et al.
Pubblicazione: (2026)
di: Li, Haoyu, et al.
Pubblicazione: (2026)
Co-Learning Port-Hamiltonian Systems and Optimal Energy-Shaping Control
di: Kamboj, Ankur, et al.
Pubblicazione: (2026)
di: Kamboj, Ankur, et al.
Pubblicazione: (2026)
Deep Learning for Sequential Decision Making under Uncertainty: Foundations, Frameworks, and Frontiers
di: Buyuktahtakin, I. Esra
Pubblicazione: (2026)
di: Buyuktahtakin, I. Esra
Pubblicazione: (2026)
On the Convergence of Overparameterized Problems: Inherent Properties of the Compositional Structure of Neural Networks
di: de Oliveira, Arthur Castello Branco, et al.
Pubblicazione: (2025)
di: de Oliveira, Arthur Castello Branco, et al.
Pubblicazione: (2025)
Action Dependency Graphs for Globally Optimal Coordinated Reinforcement Learning
di: Ding, Jianglin, et al.
Pubblicazione: (2025)
di: Ding, Jianglin, et al.
Pubblicazione: (2025)
Achieving Tighter Finite-Time Rates for Heterogeneous Federated Stochastic Approximation under Markovian Sampling
di: Zhu, Feng, et al.
Pubblicazione: (2025)
di: Zhu, Feng, et al.
Pubblicazione: (2025)
Intersection of Reinforcement Learning and Bayesian Optimization for Intelligent Control of Industrial Processes: A Safe MPC-based DPG using Multi-Objective BO
di: Esfahani, Hossein Nejatbakhsh, et al.
Pubblicazione: (2025)
di: Esfahani, Hossein Nejatbakhsh, et al.
Pubblicazione: (2025)
A Riemannian Optimization Perspective of the Gauss-Newton Method for Feedforward Neural Networks
di: Cayci, Semih
Pubblicazione: (2024)
di: Cayci, Semih
Pubblicazione: (2024)
PGLearn -- An Open-Source Learning Toolkit for Optimal Power Flow
di: Klamkin, Michael, et al.
Pubblicazione: (2025)
di: Klamkin, Michael, et al.
Pubblicazione: (2025)
Optimizing Inventory Routing: A Decision-Focused Learning Approach using Neural Networks
di: Islam, MD Shafikul, et al.
Pubblicazione: (2023)
di: Islam, MD Shafikul, et al.
Pubblicazione: (2023)
Lyapunov Function Consistent Adaptive Network Signal Control with Back Pressure and Reinforcement Learning
di: Ma, Chaolun, et al.
Pubblicazione: (2022)
di: Ma, Chaolun, et al.
Pubblicazione: (2022)
Stability of Primal-Dual Gradient Flow Dynamics for Multi-Block Convex Optimization Problems
di: Ozaslan, Ibrahim K., et al.
Pubblicazione: (2024)
di: Ozaslan, Ibrahim K., et al.
Pubblicazione: (2024)
Optimal Control Operator Perspective and a Neural Adaptive Spectral Method
di: Feng, Mingquan, et al.
Pubblicazione: (2024)
di: Feng, Mingquan, et al.
Pubblicazione: (2024)
Sublinear Regret for a Class of Continuous-Time Linear-Quadratic Reinforcement Learning Problems
di: Huang, Yilie, et al.
Pubblicazione: (2024)
di: Huang, Yilie, et al.
Pubblicazione: (2024)
From Automation to Autonomy in Smart Manufacturing: A Bayesian Optimization Framework for Modeling Multi-Objective Experimentation and Sequential Decision Making
di: Asru, Avijit Saha, et al.
Pubblicazione: (2025)
di: Asru, Avijit Saha, et al.
Pubblicazione: (2025)
Faster Reinforcement Learning by Freezing Slow States
di: Wang, Yijia, et al.
Pubblicazione: (2023)
di: Wang, Yijia, et al.
Pubblicazione: (2023)
Primitive Agentic First-Order Optimization
di: Sala, R.
Pubblicazione: (2024)
di: Sala, R.
Pubblicazione: (2024)
Differentiable Distributionally Robust Optimization Layers
di: Ma, Xutao, et al.
Pubblicazione: (2024)
di: Ma, Xutao, et al.
Pubblicazione: (2024)
Bucketized Active Sampling for Learning ACOPF
di: Klamkin, Michael, et al.
Pubblicazione: (2022)
di: Klamkin, Michael, et al.
Pubblicazione: (2022)
Convergence and sample complexity of natural policy gradient primal-dual methods for constrained MDPs
di: Ding, Dongsheng, et al.
Pubblicazione: (2022)
di: Ding, Dongsheng, et al.
Pubblicazione: (2022)
Documenti analoghi
-
Benchmarking Reinforcement Learning via Stochastic Converse Optimality: Generating Systems with Known Optimal Policies
di: Ibrahim, Sinan, et al.
Pubblicazione: (2026) -
Enhanced-FQL($λ$), an Efficient and Interpretable RL with novel Fuzzy Eligibility Traces and Segmented Experience Replay
di: Jalaeian-Farimani, Mohsen, et al.
Pubblicazione: (2026) -
Learning Kalman Policy for Singular Unknown Covariances via Riemannian Regularization
di: Bier, Larsen, et al.
Pubblicazione: (2026) -
Recursive Entropic Risk Optimization in Discounted MDPs: Sample Complexity Bounds with a Generative Model
di: Mortensen, Oliver, et al.
Pubblicazione: (2025) -
Provably Safe Generative Sampling with Constricting Barrier Functions
di: Gadginmath, Darshan, et al.
Pubblicazione: (2026)