Leveraging Analytic Gradients in Provably Safe Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Walter, Tim, Markgraf, Hannah, Külz, Jonathan, Althoff, Matthias |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Optimizing Modular Robot Composition: A Lexicographic Genetic Algorithm Approach
par: Külz, Jonathan, et autres
Publié: (2023)
par: Külz, Jonathan, et autres
Publié: (2023)
A Design Co-Pilot for Task-Tailored Manipulators
par: Külz, Jonathan, et autres
Publié: (2025)
par: Külz, Jonathan, et autres
Publié: (2025)
Implicit Safe Set Algorithm for Provably Safe Reinforcement Learning
par: Zhao, Weiye, et autres
Publié: (2024)
par: Zhao, Weiye, et autres
Publié: (2024)
Contingency-constrained economic dispatch with safe reinforcement learning
par: Eichelbeck, Michael, et autres
Publié: (2022)
par: Eichelbeck, Michael, et autres
Publié: (2022)
A Provable Approach for End-to-End Safe Reinforcement Learning
par: Wachi, Akifumi, et autres
Publié: (2025)
par: Wachi, Akifumi, et autres
Publié: (2025)
Automatic Geometric Decomposition for Analytical Inverse Kinematics
par: Ostermeier, Daniel, et autres
Publié: (2024)
par: Ostermeier, Daniel, et autres
Publié: (2024)
Holistic Construction Automation with Modular Robots: From High-Level Task Specification to Execution
par: Külz, Jonathan, et autres
Publié: (2024)
par: Külz, Jonathan, et autres
Publié: (2024)
Sampling-Based Safe Reinforcement Learning
par: Vignola, Luca, et autres
Publié: (2026)
par: Vignola, Luca, et autres
Publié: (2026)
GUARD: A Safe Reinforcement Learning Benchmark
par: Zhao, Weiye, et autres
Publié: (2023)
par: Zhao, Weiye, et autres
Publié: (2023)
Revisiting Safe Exploration in Safe Reinforcement learning
par: Eckel, David, et autres
Publié: (2024)
par: Eckel, David, et autres
Publié: (2024)
Boundary-to-Region Supervision for Offline Safe Reinforcement Learning
par: Su, Huikang, et autres
Publié: (2025)
par: Su, Huikang, et autres
Publié: (2025)
Long-term Safe Reinforcement Learning with Binary Feedback
par: Wachi, Akifumi, et autres
Publié: (2024)
par: Wachi, Akifumi, et autres
Publié: (2024)
Safe Reinforcement Learning in a Simulated Robotic Arm
par: Kovač, Luka, et autres
Publié: (2023)
par: Kovač, Luka, et autres
Publié: (2023)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
par: Zheng, Yinan, et autres
Publié: (2024)
par: Zheng, Yinan, et autres
Publié: (2024)
Safe Offline Reinforcement Learning with Real-Time Budget Constraints
par: Lin, Qian, et autres
Publié: (2023)
par: Lin, Qian, et autres
Publié: (2023)
Physics-model-guided Worst-case Sampling for Safe Reinforcement Learning
par: Cao, Hongpeng, et autres
Publié: (2024)
par: Cao, Hongpeng, et autres
Publié: (2024)
Leveraging Sub-Optimal Data for Human-in-the-Loop Reinforcement Learning
par: Muslimani, Calarina, et autres
Publié: (2024)
par: Muslimani, Calarina, et autres
Publié: (2024)
TreeIRL: Safe Urban Driving with Tree Search and Inverse Reinforcement Learning
par: Tomov, Momchil S., et autres
Publié: (2025)
par: Tomov, Momchil S., et autres
Publié: (2025)
Long and Short-Term Constraints Driven Safe Reinforcement Learning for Autonomous Driving
par: Hu, Xuemin, et autres
Publié: (2024)
par: Hu, Xuemin, et autres
Publié: (2024)
Beyond Hard Constraints: Budget-Conditioned Reachability For Safe Offline Reinforcement Learning
par: Brahmanage, Janaka Chathuranga, et autres
Publié: (2026)
par: Brahmanage, Janaka Chathuranga, et autres
Publié: (2026)
Meta SAC-Lag: Towards Deployable Safe Reinforcement Learning via MetaGradient-based Hyperparameter Tuning
par: Honari, Homayoun, et autres
Publié: (2024)
par: Honari, Homayoun, et autres
Publié: (2024)
Model Predictive Robustness of Signal Temporal Logic Predicates
par: Lin, Yuanfei, et autres
Publié: (2022)
par: Lin, Yuanfei, et autres
Publié: (2022)
HAIM-DRL: Enhanced Human-in-the-loop Reinforcement Learning for Safe and Efficient Autonomous Driving
par: Huang, Zilin, et autres
Publié: (2024)
par: Huang, Zilin, et autres
Publié: (2024)
How to Provably Improve Return Conditioned Supervised Learning?
par: Liu, Zhishuai, et autres
Publié: (2025)
par: Liu, Zhishuai, et autres
Publié: (2025)
Ethics-Aware Safe Reinforcement Learning for Rare-Event Risk Control in Interactive Urban Driving
par: Li, Dianzhao, et autres
Publié: (2025)
par: Li, Dianzhao, et autres
Publié: (2025)
Beyond Scalar Rewards: Distributional Reinforcement Learning with Preordered Objectives for Safe and Reliable Autonomous Driving
par: Abouelazm, Ahmed, et autres
Publié: (2026)
par: Abouelazm, Ahmed, et autres
Publié: (2026)
CoBRA: A Composable Benchmark for Robotics Applications
par: Mayer, Matthias, et autres
Publié: (2022)
par: Mayer, Matthias, et autres
Publié: (2022)
An Efficient Reachability-Based Framework for Provably Safe Autonomous Navigation in Unknown Environments
par: Bajcsy, Andrea, et autres
Publié: (2019)
par: Bajcsy, Andrea, et autres
Publié: (2019)
Rethinking Policy Diversity in Ensemble Policy Gradient in Large-Scale Reinforcement Learning
par: Shitanda, Naoki, et autres
Publié: (2026)
par: Shitanda, Naoki, et autres
Publié: (2026)
Enhancing Hardware Fault Tolerance in Machines with Reinforcement Learning Policy Gradient Algorithms
par: Schoepp, Sheila, et autres
Publié: (2024)
par: Schoepp, Sheila, et autres
Publié: (2024)
Subwords as Skills: Tokenization for Sparse-Reward Reinforcement Learning
par: Yunis, David, et autres
Publié: (2023)
par: Yunis, David, et autres
Publié: (2023)
CommonPower: A Framework for Safe Data-Driven Smart Grid Control
par: Eichelbeck, Michael, et autres
Publié: (2024)
par: Eichelbeck, Michael, et autres
Publié: (2024)
Less is more -- the Dispatcher/ Executor principle for multi-task Reinforcement Learning
par: Riedmiller, Martin, et autres
Publié: (2023)
par: Riedmiller, Martin, et autres
Publié: (2023)
SEAL: Towards Safe Autonomous Driving via Skill-Enabled Adversary Learning for Closed-Loop Scenario Generation
par: Stoler, Benjamin, et autres
Publié: (2024)
par: Stoler, Benjamin, et autres
Publié: (2024)
A Safety Modulator Actor-Critic Method in Model-Free Safe Reinforcement Learning and Application in UAV Hovering
par: Qi, Qihan, et autres
Publié: (2024)
par: Qi, Qihan, et autres
Publié: (2024)
Distilling Reinforcement Learning Policies for Interpretable Robot Locomotion: Gradient Boosting Machines and Symbolic Regression
par: Acero, Fernando, et autres
Publié: (2024)
par: Acero, Fernando, et autres
Publié: (2024)
Distributional Soft Actor-Critic with Harmonic Gradient for Safe and Efficient Autonomous Driving in Multi-lane Scenarios
par: Zhang, Feihong, et autres
Publié: (2025)
par: Zhang, Feihong, et autres
Publié: (2025)
Multi-Agent Reinforcement Learning for Unmanned Aerial Vehicle Coordination by Multi-Critic Policy Gradient Optimization
par: Alon, Yoav, et autres
Publié: (2020)
par: Alon, Yoav, et autres
Publié: (2020)
Dream-MPC: Gradient-Based Model Predictive Control with Latent Imagination
par: Spieler, Jonathan, et autres
Publié: (2026)
par: Spieler, Jonathan, et autres
Publié: (2026)
Simplex-enabled Safe Continual Learning Machine
par: Cao, Hongpeng, et autres
Publié: (2024)
par: Cao, Hongpeng, et autres
Publié: (2024)
Documents similaires
-
Optimizing Modular Robot Composition: A Lexicographic Genetic Algorithm Approach
par: Külz, Jonathan, et autres
Publié: (2023) -
A Design Co-Pilot for Task-Tailored Manipulators
par: Külz, Jonathan, et autres
Publié: (2025) -
Implicit Safe Set Algorithm for Provably Safe Reinforcement Learning
par: Zhao, Weiye, et autres
Publié: (2024) -
Contingency-constrained economic dispatch with safe reinforcement learning
par: Eichelbeck, Michael, et autres
Publié: (2022) -
A Provable Approach for End-to-End Safe Reinforcement Learning
par: Wachi, Akifumi, et autres
Publié: (2025)