Safety through feedback in Constrained RL
Fuente:
arXiv
Salvato in:
| Autori principali: | Chirra, Shashank Reddy, Varakantham, Pradeep, Paruchuri, Praveen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Preserving the Privacy of Reward Functions in MDPs through Deception
di: Chirra, Shashank Reddy, et al.
Pubblicazione: (2024)
di: Chirra, Shashank Reddy, et al.
Pubblicazione: (2024)
On Discovering Algorithms for Adversarial Imitation Learning
di: Chirra, Shashank Reddy, et al.
Pubblicazione: (2025)
di: Chirra, Shashank Reddy, et al.
Pubblicazione: (2025)
Handling Long and Richly Constrained Tasks through Constrained Hierarchical Reinforcement Learning
di: Lu, Yuxiao, et al.
Pubblicazione: (2023)
di: Lu, Yuxiao, et al.
Pubblicazione: (2023)
On Minimizing Adversarial Counterfactual Error in Adversarial RL
di: Belaire, Roman, et al.
Pubblicazione: (2024)
di: Belaire, Roman, et al.
Pubblicazione: (2024)
Imitating Cost-Constrained Behaviors in Reinforcement Learning
di: Shao, Qian, et al.
Pubblicazione: (2024)
di: Shao, Qian, et al.
Pubblicazione: (2024)
Efficient Unsupervised Environment Design through Hierarchical Policy Representation Learning
di: Li, Dexun, et al.
Pubblicazione: (2026)
di: Li, Dexun, et al.
Pubblicazione: (2026)
PyVRP$^+$: LLM-Driven Metacognitive Heuristic Evolution for Hybrid Genetic Search in Vehicle Routing Problems
di: Malik, Manuj, et al.
Pubblicazione: (2026)
di: Malik, Manuj, et al.
Pubblicazione: (2026)
Enhancing the Hierarchical Environment Design via Generative Trajectory Modeling
di: Li, Dexun, et al.
Pubblicazione: (2023)
di: Li, Dexun, et al.
Pubblicazione: (2023)
Unlocking Large Language Model's Planning Capabilities with Maximum Diversity Fine-tuning
di: Li, Wenjun, et al.
Pubblicazione: (2024)
di: Li, Wenjun, et al.
Pubblicazione: (2024)
Offline Safe Policy Optimization From Heterogeneous Feedback
di: Gong, Ze, et al.
Pubblicazione: (2025)
di: Gong, Ze, et al.
Pubblicazione: (2025)
EduQate: Generating Adaptive Curricula through RMABs in Education Settings
di: Tio, Sidney, et al.
Pubblicazione: (2024)
di: Tio, Sidney, et al.
Pubblicazione: (2024)
Optimizing Ride-Pooling Operations with Extended Pickup and Drop-Off Flexibility
di: Jiang, Hao, et al.
Pubblicazione: (2025)
di: Jiang, Hao, et al.
Pubblicazione: (2025)
UNIQ: Offline Inverse Q-learning for Avoiding Undesirable Demonstrations
di: Hoang, Huy, et al.
Pubblicazione: (2024)
di: Hoang, Huy, et al.
Pubblicazione: (2024)
Offline Safe Reinforcement Learning Using Trajectory Classification
di: Gong, Ze, et al.
Pubblicazione: (2024)
di: Gong, Ze, et al.
Pubblicazione: (2024)
SPRINQL: Sub-optimal Demonstrations driven Offline Imitation Learning
di: Hoang, Huy, et al.
Pubblicazione: (2024)
di: Hoang, Huy, et al.
Pubblicazione: (2024)
Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs
di: Lu, Yuxiao, et al.
Pubblicazione: (2024)
di: Lu, Yuxiao, et al.
Pubblicazione: (2024)
Imitate the Good and Avoid the Bad: An Incremental Approach to Safe Reinforcement Learning
di: Hoang, Huy, et al.
Pubblicazione: (2023)
di: Hoang, Huy, et al.
Pubblicazione: (2023)
Automatic LLM Red Teaming
di: Belaire, Roman, et al.
Pubblicazione: (2025)
di: Belaire, Roman, et al.
Pubblicazione: (2025)
A Factored MDP Approach To Moving Target Defense With Dynamic Threat Modeling and Cost Efficiency
di: Bose, Megha, et al.
Pubblicazione: (2024)
di: Bose, Megha, et al.
Pubblicazione: (2024)
Towards Neural Network based Cognitive Models of Dynamic Decision-Making by Humans
di: Chen, Changyu, et al.
Pubblicazione: (2024)
di: Chen, Changyu, et al.
Pubblicazione: (2024)
On Learning Informative Trajectory Embeddings for Imitation, Classification and Regression
di: Ge, Zichang, et al.
Pubblicazione: (2025)
di: Ge, Zichang, et al.
Pubblicazione: (2025)
Regret-Based Defense in Adversarial Reinforcement Learning
di: Belaire, Roman, et al.
Pubblicazione: (2023)
di: Belaire, Roman, et al.
Pubblicazione: (2023)
Learning What to Do and What Not To Do: Offline Imitation from Expert and Undesirable Demonstrations
di: Hoang, Huy, et al.
Pubblicazione: (2025)
di: Hoang, Huy, et al.
Pubblicazione: (2025)
IRL for Restless Multi-Armed Bandits with Applications in Maternal and Child Health
di: Jain, Gauri, et al.
Pubblicazione: (2024)
di: Jain, Gauri, et al.
Pubblicazione: (2024)
Preventing Another Tessa: Modular Safety Middleware For Health-Adjacent AI Assistants
di: Reddy, Pavan, et al.
Pubblicazione: (2025)
di: Reddy, Pavan, et al.
Pubblicazione: (2025)
Depth-Constrained ASV Navigation with Deep RL and Limited Sensing
di: Zhalehmehrabi, Amirhossein, et al.
Pubblicazione: (2025)
di: Zhalehmehrabi, Amirhossein, et al.
Pubblicazione: (2025)
Deep RL With Information Constrained Policies: Generalization in Continuous Control
di: Malloy, Tailia, et al.
Pubblicazione: (2020)
di: Malloy, Tailia, et al.
Pubblicazione: (2020)
CaseEdit: Enhancing Localized Commonsense Reasoning via Null-Space Constrained Knowledge Editing in Small Parameter Language Models
di: Reddy, Varun, et al.
Pubblicazione: (2025)
di: Reddy, Varun, et al.
Pubblicazione: (2025)
Dynamics-Aligned Shared Hypernetworks for Contextual RL under Discontinuous Shifts
di: Benad, Jan, et al.
Pubblicazione: (2026)
di: Benad, Jan, et al.
Pubblicazione: (2026)
Optimizing Vital Sign Monitoring in Resource-Constrained Maternal Care: An RL-Based Restless Bandit Approach
di: Boehmer, Niclas, et al.
Pubblicazione: (2024)
di: Boehmer, Niclas, et al.
Pubblicazione: (2024)
ConstrainedZero: Chance-Constrained POMDP Planning using Learned Probabilistic Failure Surrogates and Adaptive Safety Constraints
di: Moss, Robert J., et al.
Pubblicazione: (2024)
di: Moss, Robert J., et al.
Pubblicazione: (2024)
Mind Your Entropy: From Maximum Entropy to Trajectory Entropy-Constrained RL
di: Zhan, Guojian, et al.
Pubblicazione: (2025)
di: Zhan, Guojian, et al.
Pubblicazione: (2025)
Safety Alignment via Constrained Knowledge Unlearning
di: Shi, Zesheng, et al.
Pubblicazione: (2025)
di: Shi, Zesheng, et al.
Pubblicazione: (2025)
SortedRL: Accelerating RL Training for LLMs through Online Length-Aware Scheduling
di: Zhang, Yiqi, et al.
Pubblicazione: (2026)
di: Zhang, Yiqi, et al.
Pubblicazione: (2026)
COSMO-RL: Towards Trustworthy LMRMs via Joint Safety and Stability
di: Ding, Yizhuo, et al.
Pubblicazione: (2025)
di: Ding, Yizhuo, et al.
Pubblicazione: (2025)
GLIDE-RL: Grounded Language Instruction through DEmonstration in RL
di: Kharyal, Chaitanya, et al.
Pubblicazione: (2024)
di: Kharyal, Chaitanya, et al.
Pubblicazione: (2024)
Balancing Progress and Safety: A Novel Risk-Aware Objective for RL in Autonomous Driving
di: Abouelazm, Ahmed, et al.
Pubblicazione: (2025)
di: Abouelazm, Ahmed, et al.
Pubblicazione: (2025)
Solving Richly Constrained Reinforcement Learning through State Augmentation and Reward Penalties
di: Jiang, Hao, et al.
Pubblicazione: (2023)
di: Jiang, Hao, et al.
Pubblicazione: (2023)
Uniformly Safe RL with Objective Suppression for Multi-Constraint Safety-Critical Applications
di: Zhou, Zihan, et al.
Pubblicazione: (2024)
di: Zhou, Zihan, et al.
Pubblicazione: (2024)
Combining Cost-Constrained Runtime Monitors for AI Safety
di: Hua, Tim Tian, et al.
Pubblicazione: (2025)
di: Hua, Tim Tian, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Preserving the Privacy of Reward Functions in MDPs through Deception
di: Chirra, Shashank Reddy, et al.
Pubblicazione: (2024) -
On Discovering Algorithms for Adversarial Imitation Learning
di: Chirra, Shashank Reddy, et al.
Pubblicazione: (2025) -
Handling Long and Richly Constrained Tasks through Constrained Hierarchical Reinforcement Learning
di: Lu, Yuxiao, et al.
Pubblicazione: (2023) -
On Minimizing Adversarial Counterfactual Error in Adversarial RL
di: Belaire, Roman, et al.
Pubblicazione: (2024) -
Imitating Cost-Constrained Behaviors in Reinforcement Learning
di: Shao, Qian, et al.
Pubblicazione: (2024)