Social Interpretable Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Custode, Leonardo Lucio, Iacca, Giovanni |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks
par: Vincze, Mátyás, et autres
Publié: (2024)
par: Vincze, Mátyás, et autres
Publié: (2024)
Autonomous Decision Making for UAV Cooperative Pursuit-Evasion Game with Reinforcement Learning
par: Zhao, Yang, et autres
Publié: (2024)
par: Zhao, Yang, et autres
Publié: (2024)
Centrally Coordinated Multi-Agent Reinforcement Learning for Power Grid Topology Control
par: de Mol, Barbera, et autres
Publié: (2025)
par: de Mol, Barbera, et autres
Publié: (2025)
PillagerBench: Benchmarking LLM-Based Agents in Competitive Minecraft Team Environments
par: Schipper, Olivier, et autres
Publié: (2025)
par: Schipper, Olivier, et autres
Publié: (2025)
A Systematic Study of Multi-Agent Deep Reinforcement Learning for Safe and Robust Autonomous Highway Ramp Entry
par: Schester, Larry, et autres
Publié: (2024)
par: Schester, Larry, et autres
Publié: (2024)
On Convex Optimal Value Functions For POSGs
par: Cunha, Rafael F., et autres
Publié: (2023)
par: Cunha, Rafael F., et autres
Publié: (2023)
A survey of air combat behavior modeling using machine learning
par: Gorton, Patrick Ribu, et autres
Publié: (2024)
par: Gorton, Patrick Ribu, et autres
Publié: (2024)
ROTATE: Regret-driven Open-ended Training for Ad Hoc Teamwork
par: Wang, Caroline, et autres
Publié: (2025)
par: Wang, Caroline, et autres
Publié: (2025)
Safe Reinforcement Learning with Preference-based Constraint Inference
par: Li, Chenglin, et autres
Publié: (2026)
par: Li, Chenglin, et autres
Publié: (2026)
CORE: Towards Scalable and Efficient Causal Discovery with Reinforcement Learning
par: Sauter, Andreas W. M., et autres
Publié: (2024)
par: Sauter, Andreas W. M., et autres
Publié: (2024)
Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems
par: Nuzhin, Egor E., et autres
Publié: (2024)
par: Nuzhin, Egor E., et autres
Publié: (2024)
GIRL: Generative Imagination Reinforcement Learning via Information-Theoretic Hallucination Control
par: Hiremath, Prakul Sunil
Publié: (2026)
par: Hiremath, Prakul Sunil
Publié: (2026)
AI and Machine Learning Approaches for Predicting Nanoparticles Toxicity The Critical Role of Physiochemical Properties
par: Yousaf, Iqra
Publié: (2024)
par: Yousaf, Iqra
Publié: (2024)
EcoNet: Multiagent Planning and Control Of Household Energy Resources Using Active Inference
par: Boik, John C., et autres
Publié: (2025)
par: Boik, John C., et autres
Publié: (2025)
What Do World Models Learn in RL? Probing Latent Representations in Learned Environment Simulators
par: Zhang, Xinyu
Publié: (2026)
par: Zhang, Xinyu
Publié: (2026)
Hybrid-AIRL: Enhancing Inverse Reinforcement Learning with Supervised Expert Guidance
par: Silue, Bram, et autres
Publié: (2025)
par: Silue, Bram, et autres
Publié: (2025)
Working Paper: Active Causal Structure Learning with Latent Variables: Towards Learning to Detour in Autonomous Robots
par: Riscos, Pablo de los, et autres
Publié: (2024)
par: Riscos, Pablo de los, et autres
Publié: (2024)
Adaptable Hindsight Experience Replay for Search-Based Learning
par: Vazaios, Alexandros, et autres
Publié: (2025)
par: Vazaios, Alexandros, et autres
Publié: (2025)
Differentiable Symbolic Planning: A Neural Architecture for Constraint Reasoning with Learned Feasibility
par: Oruganti, Venkatakrishna Reddy
Publié: (2026)
par: Oruganti, Venkatakrishna Reddy
Publié: (2026)
Mimosa Framework: Toward Evolving Multi-Agent Systems for Scientific Research
par: Legrand, Martin, et autres
Publié: (2026)
par: Legrand, Martin, et autres
Publié: (2026)
Accuracy, Memory Efficiency and Generalization: A Comparative Study on Liquid Neural Networks and Recurrent Neural Networks
par: Zong, Shilong, et autres
Publié: (2025)
par: Zong, Shilong, et autres
Publié: (2025)
When Gradients Collide: Failure Modes of Multi-Objective Prompt Optimization for LLM Judges
par: Darshan, Parth, et autres
Publié: (2026)
par: Darshan, Parth, et autres
Publié: (2026)
Pioneer Agent: Continual Improvement of Small Language Models in Production
par: Atreja, Dhruv, et autres
Publié: (2026)
par: Atreja, Dhruv, et autres
Publié: (2026)
Deep Reinforcement Learning for Day-to-day Dynamic Tolling in Tradable Credit Schemes
par: Wu, Xiaoyi, et autres
Publié: (2025)
par: Wu, Xiaoyi, et autres
Publié: (2025)
Sketch Decompositions for Classical Planning via Deep Reinforcement Learning
par: Aichmüller, Michael, et autres
Publié: (2024)
par: Aichmüller, Michael, et autres
Publié: (2024)
Embedded Safety-Aligned Intelligence via Differentiable Internal Alignment Embeddings
par: Rathva, Harsh, et autres
Publié: (2025)
par: Rathva, Harsh, et autres
Publié: (2025)
Fast and Precise: Adjusting Planning Horizon with Adaptive Subgoal Search
par: Zawalski, Michał, et autres
Publié: (2022)
par: Zawalski, Michał, et autres
Publié: (2022)
Incentives for Responsiveness, Instrumental Control and Impact
par: Carey, Ryan, et autres
Publié: (2020)
par: Carey, Ryan, et autres
Publié: (2020)
Score-informed Neural Operator for Enhancing Ordering-based Causal Discovery
par: Kang, Jiyeon, et autres
Publié: (2025)
par: Kang, Jiyeon, et autres
Publié: (2025)
Regret-Aware Policy Optimization: Environment-Level Memory for Replay Suppression under Delayed Harm
par: Hiremath, Prakul Sunil
Publié: (2026)
par: Hiremath, Prakul Sunil
Publié: (2026)
On the Generalization Gap in LLM Planning: Tests and Verifier-Reward RL
par: Belcamino, Valerio, et autres
Publié: (2026)
par: Belcamino, Valerio, et autres
Publié: (2026)
Not All Transitions Matter: Evidence from PPO
par: Basnet, Ajhesh
Publié: (2026)
par: Basnet, Ajhesh
Publié: (2026)
AGWM: Affordance-Grounded World Models for Environments with Compositional Prerequisites
par: Zhang, Qinshi, et autres
Publié: (2026)
par: Zhang, Qinshi, et autres
Publié: (2026)
Building Minimal and Reusable Causal State Abstractions for Reinforcement Learning
par: Wang, Zizhao, et autres
Publié: (2024)
par: Wang, Zizhao, et autres
Publié: (2024)
Fractional Policy Gradients: Reinforcement Learning with Long-Term Memory
par: Pawar, Urvi, et autres
Publié: (2025)
par: Pawar, Urvi, et autres
Publié: (2025)
A Parallel Hybrid Action Space Reinforcement Learning Model for Real-world Adaptive Traffic Signal Control
par: Wang, Yuxuan, et autres
Publié: (2025)
par: Wang, Yuxuan, et autres
Publié: (2025)
SafeRL-Lite: A Lightweight, Explainable, and Constrained Reinforcement Learning Library
par: Mishra, Satyam, et autres
Publié: (2025)
par: Mishra, Satyam, et autres
Publié: (2025)
Zero-Shot Context Generalization in Reinforcement Learning from Few Training Contexts
par: Chapman, James, et autres
Publié: (2025)
par: Chapman, James, et autres
Publié: (2025)
From Cumulative Constraints to Adaptive Runtime Safety Control for Nonstationary Reinforcement Learning
par: Tomashevskiy, Timofey
Publié: (2026)
par: Tomashevskiy, Timofey
Publié: (2026)
On the Limits of Learned Importance Scoring for KV Cache Compression
par: Steele, Brady
Publié: (2026)
par: Steele, Brady
Publié: (2026)
Documents similaires
-
SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks
par: Vincze, Mátyás, et autres
Publié: (2024) -
Autonomous Decision Making for UAV Cooperative Pursuit-Evasion Game with Reinforcement Learning
par: Zhao, Yang, et autres
Publié: (2024) -
Centrally Coordinated Multi-Agent Reinforcement Learning for Power Grid Topology Control
par: de Mol, Barbera, et autres
Publié: (2025) -
PillagerBench: Benchmarking LLM-Based Agents in Competitive Minecraft Team Environments
par: Schipper, Olivier, et autres
Publié: (2025) -
A Systematic Study of Multi-Agent Deep Reinforcement Learning for Safe and Robust Autonomous Highway Ramp Entry
par: Schester, Larry, et autres
Publié: (2024)