Safe Reinforcement Learning with Preference-based Constraint Inference
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Chenglin, Ruan, Grant, Geng, Hua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Differentiable Symbolic Planning: A Neural Architecture for Constraint Reasoning with Learned Feasibility
di: Oruganti, Venkatakrishna Reddy
Pubblicazione: (2026)
di: Oruganti, Venkatakrishna Reddy
Pubblicazione: (2026)
CORE: Towards Scalable and Efficient Causal Discovery with Reinforcement Learning
di: Sauter, Andreas W. M., et al.
Pubblicazione: (2024)
di: Sauter, Andreas W. M., et al.
Pubblicazione: (2024)
GIRL: Generative Imagination Reinforcement Learning via Information-Theoretic Hallucination Control
di: Hiremath, Prakul Sunil
Pubblicazione: (2026)
di: Hiremath, Prakul Sunil
Pubblicazione: (2026)
Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems
di: Nuzhin, Egor E., et al.
Pubblicazione: (2024)
di: Nuzhin, Egor E., et al.
Pubblicazione: (2024)
AI and Machine Learning Approaches for Predicting Nanoparticles Toxicity The Critical Role of Physiochemical Properties
di: Yousaf, Iqra
Pubblicazione: (2024)
di: Yousaf, Iqra
Pubblicazione: (2024)
SafeRL-Lite: A Lightweight, Explainable, and Constrained Reinforcement Learning Library
di: Mishra, Satyam, et al.
Pubblicazione: (2025)
di: Mishra, Satyam, et al.
Pubblicazione: (2025)
From Cumulative Constraints to Adaptive Runtime Safety Control for Nonstationary Reinforcement Learning
di: Tomashevskiy, Timofey
Pubblicazione: (2026)
di: Tomashevskiy, Timofey
Pubblicazione: (2026)
SCULPT: Constraint-Guided Pruned MCTS that Carves Efficient Paths for Mathematical Reasoning
di: Fang, Qitong, et al.
Pubblicazione: (2026)
di: Fang, Qitong, et al.
Pubblicazione: (2026)
What Do World Models Learn in RL? Probing Latent Representations in Learned Environment Simulators
di: Zhang, Xinyu
Pubblicazione: (2026)
di: Zhang, Xinyu
Pubblicazione: (2026)
Hybrid-AIRL: Enhancing Inverse Reinforcement Learning with Supervised Expert Guidance
di: Silue, Bram, et al.
Pubblicazione: (2025)
di: Silue, Bram, et al.
Pubblicazione: (2025)
Working Paper: Active Causal Structure Learning with Latent Variables: Towards Learning to Detour in Autonomous Robots
di: Riscos, Pablo de los, et al.
Pubblicazione: (2024)
di: Riscos, Pablo de los, et al.
Pubblicazione: (2024)
Score-informed Neural Operator for Enhancing Ordering-based Causal Discovery
di: Kang, Jiyeon, et al.
Pubblicazione: (2025)
di: Kang, Jiyeon, et al.
Pubblicazione: (2025)
Adaptable Hindsight Experience Replay for Search-Based Learning
di: Vazaios, Alexandros, et al.
Pubblicazione: (2025)
di: Vazaios, Alexandros, et al.
Pubblicazione: (2025)
SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks
di: Vincze, Mátyás, et al.
Pubblicazione: (2024)
di: Vincze, Mátyás, et al.
Pubblicazione: (2024)
AGWM: Affordance-Grounded World Models for Environments with Compositional Prerequisites
di: Zhang, Qinshi, et al.
Pubblicazione: (2026)
di: Zhang, Qinshi, et al.
Pubblicazione: (2026)
Social Interpretable Reinforcement Learning
di: Custode, Leonardo Lucio, et al.
Pubblicazione: (2024)
di: Custode, Leonardo Lucio, et al.
Pubblicazione: (2024)
Sketch Decompositions for Classical Planning via Deep Reinforcement Learning
di: Aichmüller, Michael, et al.
Pubblicazione: (2024)
di: Aichmüller, Michael, et al.
Pubblicazione: (2024)
Regret-Aware Policy Optimization: Environment-Level Memory for Replay Suppression under Delayed Harm
di: Hiremath, Prakul Sunil
Pubblicazione: (2026)
di: Hiremath, Prakul Sunil
Pubblicazione: (2026)
On the Generalization Gap in LLM Planning: Tests and Verifier-Reward RL
di: Belcamino, Valerio, et al.
Pubblicazione: (2026)
di: Belcamino, Valerio, et al.
Pubblicazione: (2026)
Not All Transitions Matter: Evidence from PPO
di: Basnet, Ajhesh
Pubblicazione: (2026)
di: Basnet, Ajhesh
Pubblicazione: (2026)
Embedded Safety-Aligned Intelligence via Differentiable Internal Alignment Embeddings
di: Rathva, Harsh, et al.
Pubblicazione: (2025)
di: Rathva, Harsh, et al.
Pubblicazione: (2025)
Fast and Precise: Adjusting Planning Horizon with Adaptive Subgoal Search
di: Zawalski, Michał, et al.
Pubblicazione: (2022)
di: Zawalski, Michał, et al.
Pubblicazione: (2022)
Incentives for Responsiveness, Instrumental Control and Impact
di: Carey, Ryan, et al.
Pubblicazione: (2020)
di: Carey, Ryan, et al.
Pubblicazione: (2020)
Building Minimal and Reusable Causal State Abstractions for Reinforcement Learning
di: Wang, Zizhao, et al.
Pubblicazione: (2024)
di: Wang, Zizhao, et al.
Pubblicazione: (2024)
Learning Natural Language Constraints for Safe Reinforcement Learning of Language Agents
di: Chua, Jaymari, et al.
Pubblicazione: (2025)
di: Chua, Jaymari, et al.
Pubblicazione: (2025)
Fractional Policy Gradients: Reinforcement Learning with Long-Term Memory
di: Pawar, Urvi, et al.
Pubblicazione: (2025)
di: Pawar, Urvi, et al.
Pubblicazione: (2025)
A Parallel Hybrid Action Space Reinforcement Learning Model for Real-world Adaptive Traffic Signal Control
di: Wang, Yuxuan, et al.
Pubblicazione: (2025)
di: Wang, Yuxuan, et al.
Pubblicazione: (2025)
Zero-Shot Context Generalization in Reinforcement Learning from Few Training Contexts
di: Chapman, James, et al.
Pubblicazione: (2025)
di: Chapman, James, et al.
Pubblicazione: (2025)
On the Limits of Learned Importance Scoring for KV Cache Compression
di: Steele, Brady
Pubblicazione: (2026)
di: Steele, Brady
Pubblicazione: (2026)
FlowRL: Flow-Augmented Few-Shot Reinforcement Learning for Semi-Structured Sensor Data
di: Pivezhandi, Mohammad, et al.
Pubblicazione: (2024)
di: Pivezhandi, Mohammad, et al.
Pubblicazione: (2024)
Combining Trained Models in Reinforcement Learning
di: Patil, Ujjwal, et al.
Pubblicazione: (2026)
di: Patil, Ujjwal, et al.
Pubblicazione: (2026)
Learning to Select Goals in Automated Planning with Deep-Q Learning
di: Núñez-Molina, Carlos, et al.
Pubblicazione: (2024)
di: Núñez-Molina, Carlos, et al.
Pubblicazione: (2024)
Resolving Action Bottleneck: Agentic Reinforcement Learning Informed by Token-Level Energy
di: He, Langzhou, et al.
Pubblicazione: (2026)
di: He, Langzhou, et al.
Pubblicazione: (2026)
Scaling Trends for Multi-Hop Contextual Reasoning in Mid-Scale Language Models
di: Steele, Brady, et al.
Pubblicazione: (2026)
di: Steele, Brady, et al.
Pubblicazione: (2026)
The ARC of Progress towards AGI: A Living Survey of Abstraction and Reasoning
di: Vahdati, Sahar, et al.
Pubblicazione: (2026)
di: Vahdati, Sahar, et al.
Pubblicazione: (2026)
NeSIG: A Neuro-Symbolic Method for Learning to Generate Planning Problems
di: Núñez-Molina, Carlos, et al.
Pubblicazione: (2023)
di: Núñez-Molina, Carlos, et al.
Pubblicazione: (2023)
Dynamic Policy Induction for Adaptive Prompt Optimization: Bridging the Efficiency-Accuracy Gap via Lightweight Reinforcement Learning
di: Xu, Jiexi
Pubblicazione: (2025)
di: Xu, Jiexi
Pubblicazione: (2025)
The Shortcomings of Force-from-Motion in Robot Learning
di: Aljalbout, Elie, et al.
Pubblicazione: (2024)
di: Aljalbout, Elie, et al.
Pubblicazione: (2024)
MathLedger: A Verifiable Learning Substrate with Ledger-Attested Feedback
di: Abdullah, Ismail Ahmad
Pubblicazione: (2025)
di: Abdullah, Ismail Ahmad
Pubblicazione: (2025)
Predicting Future Actions of Reinforcement Learning Agents
di: Chung, Stephen, et al.
Pubblicazione: (2024)
di: Chung, Stephen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Differentiable Symbolic Planning: A Neural Architecture for Constraint Reasoning with Learned Feasibility
di: Oruganti, Venkatakrishna Reddy
Pubblicazione: (2026) -
CORE: Towards Scalable and Efficient Causal Discovery with Reinforcement Learning
di: Sauter, Andreas W. M., et al.
Pubblicazione: (2024) -
GIRL: Generative Imagination Reinforcement Learning via Information-Theoretic Hallucination Control
di: Hiremath, Prakul Sunil
Pubblicazione: (2026) -
Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems
di: Nuzhin, Egor E., et al.
Pubblicazione: (2024) -
AI and Machine Learning Approaches for Predicting Nanoparticles Toxicity The Critical Role of Physiochemical Properties
di: Yousaf, Iqra
Pubblicazione: (2024)