Composing Reinforcement Learning Policies, with Formal Guarantees
Fuente:
arXiv
Salvato in:
| Autori principali: | Delgrange, Florent, Avni, Guy, Lukina, Anna, Schilling, Christian, Nowé, Ann, Pérez, Guillermo A. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Foundation World Models for Agents that Learn, Verify, and Adapt Reliably Beyond Static Environments
di: Delgrange, Florent
Pubblicazione: (2026)
di: Delgrange, Florent
Pubblicazione: (2026)
In Search of Trees: Decision-Tree Policy Synthesis for Black-Box Systems via Search
di: Demirović, Emir, et al.
Pubblicazione: (2024)
di: Demirović, Emir, et al.
Pubblicazione: (2024)
Deep SPI: Safe Policy Improvement via World Models
di: Delgrange, Florent, et al.
Pubblicazione: (2025)
di: Delgrange, Florent, et al.
Pubblicazione: (2025)
Interactive Explanations for Reinforcement-Learning Agents
di: Amitai, Yotam, et al.
Pubblicazione: (2025)
di: Amitai, Yotam, et al.
Pubblicazione: (2025)
Human-Readable Programs as Actors of Reinforcement Learning Agents Using Critic-Moderated Evolution
di: Deproost, Senne, et al.
Pubblicazione: (2024)
di: Deproost, Senne, et al.
Pubblicazione: (2024)
Explainable RL Policies by Distilling to Locally-Specialized Linear Policies with Voronoi State Partitioning
di: Deproost, Senne, et al.
Pubblicazione: (2025)
di: Deproost, Senne, et al.
Pubblicazione: (2025)
Critic-Driven Voronoi-Quantization for Distilling Deep RL Policies to Explainable Models
di: Deproost, Senne, et al.
Pubblicazione: (2026)
di: Deproost, Senne, et al.
Pubblicazione: (2026)
VeRecycle: Reclaiming Guarantees from Probabilistic Certificates for Stochastic Dynamical Systems after Change
di: Lutz, Sterre, et al.
Pubblicazione: (2025)
di: Lutz, Sterre, et al.
Pubblicazione: (2025)
Inclusive Fitness as a Key Step Towards More Advanced Social Behaviors in Multi-Agent Reinforcement Learning Settings
di: Rosseau, Andries, et al.
Pubblicazione: (2025)
di: Rosseau, Andries, et al.
Pubblicazione: (2025)
Explainable AI Based Diagnosis of Poisoning Attacks in Evolutionary Swarms
di: Asadi, Mehrdad, et al.
Pubblicazione: (2025)
di: Asadi, Mehrdad, et al.
Pubblicazione: (2025)
Fairness-Aware Reinforcement Learning (FAReL): A Framework for Transparent and Balanced Sequential Decision-Making
di: Cimpean, Alexandra, et al.
Pubblicazione: (2025)
di: Cimpean, Alexandra, et al.
Pubblicazione: (2025)
Neural Continuous-Time Supermartingale Certificates
di: Neustroev, Grigory, et al.
Pubblicazione: (2024)
di: Neustroev, Grigory, et al.
Pubblicazione: (2024)
Do LLMs Follow Their Own Rules? A Reflexive Audit of Self-Stated Safety Policies
di: Mittal, Avni
Pubblicazione: (2026)
di: Mittal, Avni
Pubblicazione: (2026)
R2L: Reliable Reinforcement Learning: Guaranteed Return & Reliable Policies in Reinforcement Learning
di: Farhi, Nadir
Pubblicazione: (2025)
di: Farhi, Nadir
Pubblicazione: (2025)
Laser Learning Environment: A new environment for coordination-critical multi-agent tasks
di: Molinghen, Yannick, et al.
Pubblicazione: (2024)
di: Molinghen, Yannick, et al.
Pubblicazione: (2024)
Formal Ethical Obligations in Reinforcement Learning Agents: Verification and Policy Updates
di: Shea-Blymyer, Colin, et al.
Pubblicazione: (2024)
di: Shea-Blymyer, Colin, et al.
Pubblicazione: (2024)
Composing Diffusion Policies for Few-shot Learning of Movement Trajectories
di: Patil, Omkar, et al.
Pubblicazione: (2024)
di: Patil, Omkar, et al.
Pubblicazione: (2024)
Formal Verification of Noisy Quantum Reinforcement Learning Policies
di: Gross, Dennis
Pubblicazione: (2025)
di: Gross, Dennis
Pubblicazione: (2025)
Online Planning in POMDPs with State-Requests
di: Avalos, Raphael, et al.
Pubblicazione: (2024)
di: Avalos, Raphael, et al.
Pubblicazione: (2024)
Formally Verifying Deep Reinforcement Learning Controllers with Lyapunov Barrier Certificates
di: Mandal, Udayan, et al.
Pubblicazione: (2024)
di: Mandal, Udayan, et al.
Pubblicazione: (2024)
Quantifying Multimodal Capabilities: Formal Generalization Guarantees in Pairwise Metric Learning
di: Zhou, Richeng, et al.
Pubblicazione: (2026)
di: Zhou, Richeng, et al.
Pubblicazione: (2026)
Hybrid Reinforcement Learning and Search for Flight Trajectory Planning
di: Luise, Alberto, et al.
Pubblicazione: (2025)
di: Luise, Alberto, et al.
Pubblicazione: (2025)
Compositional Shielding and Reinforcement Learning for Multi-Agent Systems
di: Brorholt, Asger Horn, et al.
Pubblicazione: (2024)
di: Brorholt, Asger Horn, et al.
Pubblicazione: (2024)
Modeling Unseen Environments with Language-guided Composable Causal Components in Reinforcement Learning
di: Wang, Xinyue, et al.
Pubblicazione: (2025)
di: Wang, Xinyue, et al.
Pubblicazione: (2025)
Auction-Based Scheduling
di: Avni, Guy, et al.
Pubblicazione: (2023)
di: Avni, Guy, et al.
Pubblicazione: (2023)
A three-Level Framework for LLM-Enhanced eXplainable AI: From technical explanations to natural language
di: Bello, Marilyn, et al.
Pubblicazione: (2025)
di: Bello, Marilyn, et al.
Pubblicazione: (2025)
Learning to Move in Rhythm: Task-Conditioned Motion Policies with Orbital Stability Guarantees
di: Stölzle, Maximilian, et al.
Pubblicazione: (2025)
di: Stölzle, Maximilian, et al.
Pubblicazione: (2025)
Evaluating COVID-19 vaccine allocation policies using Bayesian $m$-top exploration
di: Cimpean, Alexandra, et al.
Pubblicazione: (2023)
di: Cimpean, Alexandra, et al.
Pubblicazione: (2023)
Did You Forget What I Asked? Prospective Memory Failures in Large Language Models
di: Mittal, Avni
Pubblicazione: (2026)
di: Mittal, Avni
Pubblicazione: (2026)
Formal Policy Enforcement for Real-World Agentic Systems
di: Palumbo, Nils, et al.
Pubblicazione: (2026)
di: Palumbo, Nils, et al.
Pubblicazione: (2026)
Learning Optimal and Sample-Efficient Decision Policies with Guarantees
di: Shao, Daqian
Pubblicazione: (2026)
di: Shao, Daqian
Pubblicazione: (2026)
Safety Guarantees in Zero-Shot Reinforcement Learning for Cascade Dynamical Systems
di: Rabiei, Shima, et al.
Pubblicazione: (2026)
di: Rabiei, Shima, et al.
Pubblicazione: (2026)
Learning to Ball: Composing Policies for Long-Horizon Basketball Moves
di: Xu, Pei, et al.
Pubblicazione: (2025)
di: Xu, Pei, et al.
Pubblicazione: (2025)
Spectral-Risk Safe Reinforcement Learning with Convergence Guarantees
di: Kim, Dohyeong, et al.
Pubblicazione: (2024)
di: Kim, Dohyeong, et al.
Pubblicazione: (2024)
Probabilistic Performance Guarantees for Multi-Task Reinforcement Learning
di: Schnitzer, Yannik, et al.
Pubblicazione: (2026)
di: Schnitzer, Yannik, et al.
Pubblicazione: (2026)
Composing Dextrous Grasping and In-hand Manipulation via Scoring with a Reinforcement Learning Critic
di: Röstel, Lennart, et al.
Pubblicazione: (2025)
di: Röstel, Lennart, et al.
Pubblicazione: (2025)
The Formalism-Implementation Gap in Reinforcement Learning Research
di: Castro, Pablo Samuel
Pubblicazione: (2025)
di: Castro, Pablo Samuel
Pubblicazione: (2025)
C2-Faith: Benchmarking LLM Judges for Causal and Coverage Faithfulness in Chain-of-Thought Reasoning
di: Mittal, Avni, et al.
Pubblicazione: (2026)
di: Mittal, Avni, et al.
Pubblicazione: (2026)
Local Success Does Not Compose: Benchmarking Large Language Models for Compositional Formal Verification
di: Xu, Xu, et al.
Pubblicazione: (2025)
di: Xu, Xu, et al.
Pubblicazione: (2025)
Preference Guided Iterated Pareto Referent Optimisation for Accessible Route Planning
di: Speziali, Paolo, et al.
Pubblicazione: (2026)
di: Speziali, Paolo, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Foundation World Models for Agents that Learn, Verify, and Adapt Reliably Beyond Static Environments
di: Delgrange, Florent
Pubblicazione: (2026) -
In Search of Trees: Decision-Tree Policy Synthesis for Black-Box Systems via Search
di: Demirović, Emir, et al.
Pubblicazione: (2024) -
Deep SPI: Safe Policy Improvement via World Models
di: Delgrange, Florent, et al.
Pubblicazione: (2025) -
Interactive Explanations for Reinforcement-Learning Agents
di: Amitai, Yotam, et al.
Pubblicazione: (2025) -
Human-Readable Programs as Actors of Reinforcement Learning Agents Using Critic-Moderated Evolution
di: Deproost, Senne, et al.
Pubblicazione: (2024)