Guardado en:
| Autores principales: | Paolo, Giuseppe, Gonzalez-Billandon, Jonas, Thomas, Albert, Kégl, Balázs |
|---|---|
| Formato: | Preprint |
| Publicado: |
2022
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2206.09743 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TAG: A Decentralized Framework for Multi-Agent Hierarchical Reinforcement Learning
por: Paolo, Giuseppe, et al.
Publicado: (2025)
por: Paolo, Giuseppe, et al.
Publicado: (2025)
A call for embodied AI
por: Paolo, Giuseppe, et al.
Publicado: (2024)
por: Paolo, Giuseppe, et al.
Publicado: (2024)
Deep reinforcement learning-based spacecraft attitude control with pointing keep-out constraint
por: Yang, Juntang, et al.
Publicado: (2025)
por: Yang, Juntang, et al.
Publicado: (2025)
Deep autoregressive density nets vs neural ensembles for model-based offline reinforcement learning
por: Benechehab, Abdelhakim, et al.
Publicado: (2024)
por: Benechehab, Abdelhakim, et al.
Publicado: (2024)
Contingency-constrained economic dispatch with safe reinforcement learning
por: Eichelbeck, Michael, et al.
Publicado: (2022)
por: Eichelbeck, Michael, et al.
Publicado: (2022)
Real-time system optimal traffic routing under uncertainties -- Can physics models boost reinforcement learning?
por: Ke, Zemian, et al.
Publicado: (2024)
por: Ke, Zemian, et al.
Publicado: (2024)
Managing power grids through topology actions: A comparative study between advanced rule-based and reinforcement learning agents
por: Lehna, Malte, et al.
Publicado: (2023)
por: Lehna, Malte, et al.
Publicado: (2023)
Using reinforcement learning to probe the role of feedback in skill acquisition
por: Terpin, Antonio, et al.
Publicado: (2025)
por: Terpin, Antonio, et al.
Publicado: (2025)
Stabilizing reinforcement learning control: A modular framework for optimizing over all stable behavior
por: Lawrence, Nathan P., et al.
Publicado: (2023)
por: Lawrence, Nathan P., et al.
Publicado: (2023)
Learning a local trading strategy: deep reinforcement learning for grid-scale renewable energy integration
por: Ju, Caleb, et al.
Publicado: (2024)
por: Ju, Caleb, et al.
Publicado: (2024)
Learning to Fly in Seconds
por: Eschmann, Jonas, et al.
Publicado: (2023)
por: Eschmann, Jonas, et al.
Publicado: (2023)
Multi-agent deep reinforcement learning with centralized training and decentralized execution for transportation infrastructure management
por: Saifullah, M., et al.
Publicado: (2024)
por: Saifullah, M., et al.
Publicado: (2024)
Constrained Reinforcement Learning for Safe Heat Pump Control
por: Zhang, Baohe, et al.
Publicado: (2024)
por: Zhang, Baohe, et al.
Publicado: (2024)
Real-world validation of safe reinforcement learning, model predictive control and decision tree-based home energy management systems
por: Ruddick, Julian, et al.
Publicado: (2024)
por: Ruddick, Julian, et al.
Publicado: (2024)
Learning to Drive Safely with Hybrid Options
por: De Cooman, Bram, et al.
Publicado: (2025)
por: De Cooman, Bram, et al.
Publicado: (2025)
Multi-agent assignment via state augmented reinforcement learning
por: Agorio, Leopoldo, et al.
Publicado: (2024)
por: Agorio, Leopoldo, et al.
Publicado: (2024)
DeepSafeMPC: Deep Learning-Based Model Predictive Control for Safe Multi-Agent Reinforcement Learning
por: Wang, Xuefeng, et al.
Publicado: (2024)
por: Wang, Xuefeng, et al.
Publicado: (2024)
Optimal Power Grid Operations with Foundation Models
por: Puech, Alban, et al.
Publicado: (2024)
por: Puech, Alban, et al.
Publicado: (2024)
Towards a Practical Understanding of Lagrangian Methods in Safe Reinforcement Learning
por: Spoor, Lindsay, et al.
Publicado: (2025)
por: Spoor, Lindsay, et al.
Publicado: (2025)
Provably Safe Generative Sampling with Constricting Barrier Functions
por: Gadginmath, Darshan, et al.
Publicado: (2026)
por: Gadginmath, Darshan, et al.
Publicado: (2026)
Approximate Model-Based Shielding for Safe Reinforcement Learning
por: Goodall, Alexander W., et al.
Publicado: (2023)
por: Goodall, Alexander W., et al.
Publicado: (2023)
SafeAuto: Knowledge-Enhanced Safe Autonomous Driving with Multimodal Foundation Models
por: Zhang, Jiawei, et al.
Publicado: (2025)
por: Zhang, Jiawei, et al.
Publicado: (2025)
Automatic driving lane change safety prediction model based on LSTM
por: Sun, Wenjian, et al.
Publicado: (2024)
por: Sun, Wenjian, et al.
Publicado: (2024)
Learning Contextual Runtime Monitors for Safe AI-Based Autonomy
por: Luque-Cerpa, Alejandro, et al.
Publicado: (2026)
por: Luque-Cerpa, Alejandro, et al.
Publicado: (2026)
Safe Deep Model-Based Reinforcement Learning with Lyapunov Functions
por: Zhang, Harry
Publicado: (2024)
por: Zhang, Harry
Publicado: (2024)
Intersection of Reinforcement Learning and Bayesian Optimization for Intelligent Control of Industrial Processes: A Safe MPC-based DPG using Multi-Objective BO
por: Esfahani, Hossein Nejatbakhsh, et al.
Publicado: (2025)
por: Esfahani, Hossein Nejatbakhsh, et al.
Publicado: (2025)
Balancing SoC in Battery Cells using Safe Action Perturbations
por: Yadav, E Harshith Kumar, et al.
Publicado: (2025)
por: Yadav, E Harshith Kumar, et al.
Publicado: (2025)
Natural-gas storage modelling by deep reinforcement learning
por: Balaconi, Tiziano, et al.
Publicado: (2025)
por: Balaconi, Tiziano, et al.
Publicado: (2025)
Certifiable Safe RLHF: Fixed-Penalty Constraint Optimization for Safer Language Models
por: Pandit, Kartik, et al.
Publicado: (2025)
por: Pandit, Kartik, et al.
Publicado: (2025)
Safe Deployment of Offline Reinforcement Learning via Input Convex Action Correction
por: Durkin, Alex, et al.
Publicado: (2025)
por: Durkin, Alex, et al.
Publicado: (2025)
Meta SAC-Lag: Towards Deployable Safe Reinforcement Learning via MetaGradient-based Hyperparameter Tuning
por: Honari, Homayoun, et al.
Publicado: (2024)
por: Honari, Homayoun, et al.
Publicado: (2024)
GenSafe: A Generalizable Safety Enhancer for Safe Reinforcement Learning Algorithms Based on Reduced Order Markov Decision Process Model
por: Zhou, Zhehua, et al.
Publicado: (2024)
por: Zhou, Zhehua, et al.
Publicado: (2024)
Continual uncertainty learning
por: Yonezawa, Heisei, et al.
Publicado: (2026)
por: Yonezawa, Heisei, et al.
Publicado: (2026)
Trustworthy and Explainable Deep Reinforcement Learning for Safe and Energy-Efficient Process Control: A Use Case in Industrial Compressed Air Systems
por: Bezold, Vincent, et al.
Publicado: (2025)
por: Bezold, Vincent, et al.
Publicado: (2025)
Bregman Centroid Guided Cross-Entropy Method
por: Gu, Yuliang, et al.
Publicado: (2025)
por: Gu, Yuliang, et al.
Publicado: (2025)
An Efficient Reachability-Based Framework for Provably Safe Autonomous Navigation in Unknown Environments
por: Bajcsy, Andrea, et al.
Publicado: (2019)
por: Bajcsy, Andrea, et al.
Publicado: (2019)
Verification of Neural Reachable Tubes via Scenario Optimization and Conformal Prediction
por: Lin, Albert, et al.
Publicado: (2023)
por: Lin, Albert, et al.
Publicado: (2023)
Federated reinforcement learning for robot motion planning with zero-shot generalization
por: Yuan, Zhenyuan, et al.
Publicado: (2024)
por: Yuan, Zhenyuan, et al.
Publicado: (2024)
Tacit algorithmic collusion in deep reinforcement learning guided price competition: A study using EV charge pricing game
por: Paudel, Diwas, et al.
Publicado: (2024)
por: Paudel, Diwas, et al.
Publicado: (2024)
Enhanced Transformer architecture for in-context learning of dynamical systems
por: Rufolo, Matteo, et al.
Publicado: (2024)
por: Rufolo, Matteo, et al.
Publicado: (2024)
Ejemplares similares
-
TAG: A Decentralized Framework for Multi-Agent Hierarchical Reinforcement Learning
por: Paolo, Giuseppe, et al.
Publicado: (2025) -
A call for embodied AI
por: Paolo, Giuseppe, et al.
Publicado: (2024) -
Deep reinforcement learning-based spacecraft attitude control with pointing keep-out constraint
por: Yang, Juntang, et al.
Publicado: (2025) -
Deep autoregressive density nets vs neural ensembles for model-based offline reinforcement learning
por: Benechehab, Abdelhakim, et al.
Publicado: (2024) -
Contingency-constrained economic dispatch with safe reinforcement learning
por: Eichelbeck, Michael, et al.
Publicado: (2022)