'Explaining RL Decisions with Trajectories': A Reproducibility Study
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sadek, Karim Abdel, Nulli, Matteo, Velja, Joan, Vincenti, Jort |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Dynamic Vocabulary Pruning in Early-Exit LLMs
par: Vincenti, Jort, et autres
Publié: (2024)
par: Vincenti, Jort, et autres
Publié: (2024)
Explaining RL Decisions with Trajectories
par: Deshmukh, Shripad Vilasrao, et autres
Publié: (2023)
par: Deshmukh, Shripad Vilasrao, et autres
Publié: (2023)
Studying Cross-cluster Modularity in Neural Networks
par: Golechha, Satvik, et autres
Publié: (2025)
par: Golechha, Satvik, et autres
Publié: (2025)
Learning the Preferences of a Learning Agent
par: Sadek, Karim Abdel, et autres
Publié: (2026)
par: Sadek, Karim Abdel, et autres
Publié: (2026)
In-Context Learning Improves Compositional Understanding of Vision-Language Models
par: Nulli, Matteo, et autres
Publié: (2024)
par: Nulli, Matteo, et autres
Publié: (2024)
When can we trust untrusted monitoring? A safety case sketch across collusion strategies
par: Gardner-Challis, Nelson, et autres
Publié: (2026)
par: Gardner-Challis, Nelson, et autres
Publié: (2026)
Semantic segmentation with coarse annotations
par: de Jong, Jort, et autres
Publié: (2025)
par: de Jong, Jort, et autres
Publié: (2025)
Dynamic Mixture-of-Experts for Visual Autoregressive Model
par: Vincenti, Jort, et autres
Publié: (2025)
par: Vincenti, Jort, et autres
Publié: (2025)
Explaining Decisions of Agents in Mixed-Motive Games
par: Orner, Maayan, et autres
Publié: (2024)
par: Orner, Maayan, et autres
Publié: (2024)
Explaining Learned Reward Functions with Counterfactual Trajectories
par: Wehner, Jan, et autres
Publié: (2024)
par: Wehner, Jan, et autres
Publié: (2024)
The Effective Horizon Explains Deep RL Performance in Stochastic Environments
par: Laidlaw, Cassidy, et autres
Publié: (2023)
par: Laidlaw, Cassidy, et autres
Publié: (2023)
A Uniform Language to Explain Decision Trees
par: Arenas, Marcelo, et autres
Publié: (2023)
par: Arenas, Marcelo, et autres
Publié: (2023)
ACTER: Diverse and Actionable Counterfactual Sequences for Explaining and Diagnosing RL Policies
par: Gajcin, Jasmina, et autres
Publié: (2024)
par: Gajcin, Jasmina, et autres
Publié: (2024)
COOL-MC: Verifying and Explaining RL Policies for Platelet Inventory Management
par: Gross, Dennis
Publié: (2026)
par: Gross, Dennis
Publié: (2026)
Meeting SLOs, Slashing Hours: Automated Enterprise LLM Optimization with OptiKIT
par: Santavas, Nicholas, et autres
Publié: (2026)
par: Santavas, Nicholas, et autres
Publié: (2026)
Explaining Hitori Puzzles: Neurosymbolic Proof Staging for Sequential Decisions
par: Pacheco, Maria Leonor, et autres
Publié: (2025)
par: Pacheco, Maria Leonor, et autres
Publié: (2025)
A Comprehensive Survey of Belief Rule Base (BRB) Hybrid Expert system: Bridging Decision Science and Professional Services
par: Derrick, Karim
Publié: (2024)
par: Derrick, Karim
Publié: (2024)
COOL-MC: Verifying and Explaining RL Policies for Multi-bridge Network Maintenance
par: Gross, Dennis
Publié: (2026)
par: Gross, Dennis
Publié: (2026)
Explaining Control Policies through Predicate Decision Diagrams
par: Chakraborty, Debraj, et autres
Publié: (2025)
par: Chakraborty, Debraj, et autres
Publié: (2025)
XAI-LAW: A Logic Programming Tool for Modeling, Explaining, and Learning Legal Decisions
par: Dovier, Agostino, et autres
Publié: (2026)
par: Dovier, Agostino, et autres
Publié: (2026)
AI Copilots for Reproducibility in Science: A Case Study
par: Bibal, Adrien, et autres
Publié: (2025)
par: Bibal, Adrien, et autres
Publié: (2025)
Explaining Decisions in ML Models: a Parameterized Complexity Analysis
par: Ordyniak, Sebastian, et autres
Publié: (2024)
par: Ordyniak, Sebastian, et autres
Publié: (2024)
Explaining and Improving Information Complementarities in Multi-Agent Decision-making
par: Guo, Ziyang, et autres
Publié: (2025)
par: Guo, Ziyang, et autres
Publié: (2025)
Explaining Decisions in ML Models: a Parameterized Complexity Analysis (Part I)
par: Ordyniak, Sebastian, et autres
Publié: (2025)
par: Ordyniak, Sebastian, et autres
Publié: (2025)
Online Finetuning Decision Transformers with Pure RL Gradients
par: Luo, Junkai, et autres
Publié: (2026)
par: Luo, Junkai, et autres
Publié: (2026)
Stitching Sub-Trajectories with Conditional Diffusion Model for Goal-Conditioned Offline RL
par: Kim, Sungyoon, et autres
Publié: (2024)
par: Kim, Sungyoon, et autres
Publié: (2024)
Teaching LLMs to Think Mathematically: A Critical Study of Decision-Making via Optimization
par: Abdel-Rahman, Mohammad J., et autres
Publié: (2025)
par: Abdel-Rahman, Mohammad J., et autres
Publié: (2025)
Formally Explaining Decision Tree Models with Answer Set Programming
par: Takemura, Akihiro, et autres
Publié: (2026)
par: Takemura, Akihiro, et autres
Publié: (2026)
BET: Explaining Deep Reinforcement Learning through The Error-Prone Decisions
par: Liu, Xiao, et autres
Publié: (2024)
par: Liu, Xiao, et autres
Publié: (2024)
On Explaining Proxy Discrimination and Unfairness in Individual Decisions Made by AI Systems
par: Sonna, Belona, et autres
Publié: (2025)
par: Sonna, Belona, et autres
Publié: (2025)
Retrieval-Augmented Decision Transformer: External Memory for In-context RL
par: Schmied, Thomas, et autres
Publié: (2024)
par: Schmied, Thomas, et autres
Publié: (2024)
Crafting Desirable Climate Trajectories with RL Explored Socio-Environmental Simulations
par: Rudd-Jones, James, et autres
Publié: (2024)
par: Rudd-Jones, James, et autres
Publié: (2024)
Explaining Large Language Models Decisions Using Shapley Values
par: Mohammadi, Behnam
Publié: (2024)
par: Mohammadi, Behnam
Publié: (2024)
Med-CAM: Minimal Evidence for Explaining Medical Decision Making
par: Suhail, Pirzada, et autres
Publié: (2026)
par: Suhail, Pirzada, et autres
Publié: (2026)
A Systematic Reproducibility Study of BSARec for Sequential Recommendation
par: Hutter, Jan, et autres
Publié: (2025)
par: Hutter, Jan, et autres
Publié: (2025)
Using Reinforcement Learning to Train Large Language Models to Explain Human Decisions
par: Zhu, Jian-Qiao, et autres
Publié: (2025)
par: Zhu, Jian-Qiao, et autres
Publié: (2025)
Multi-Armed Bandits-Based Optimization of Decision Trees
par: Shanto, Hasibul Karim, et autres
Publié: (2025)
par: Shanto, Hasibul Karim, et autres
Publié: (2025)
Explaining Explaining
par: Nirenburg, Sergei, et autres
Publié: (2024)
par: Nirenburg, Sergei, et autres
Publié: (2024)
Towards Self-Evolving Benchmarks: Synthesizing Agent Trajectories via Test-Time Exploration under Validate-by-Reproduce Paradigm
par: Guo, Dadi, et autres
Publié: (2025)
par: Guo, Dadi, et autres
Publié: (2025)
Mind Your Entropy: From Maximum Entropy to Trajectory Entropy-Constrained RL
par: Zhan, Guojian, et autres
Publié: (2025)
par: Zhan, Guojian, et autres
Publié: (2025)
Documents similaires
-
Dynamic Vocabulary Pruning in Early-Exit LLMs
par: Vincenti, Jort, et autres
Publié: (2024) -
Explaining RL Decisions with Trajectories
par: Deshmukh, Shripad Vilasrao, et autres
Publié: (2023) -
Studying Cross-cluster Modularity in Neural Networks
par: Golechha, Satvik, et autres
Publié: (2025) -
Learning the Preferences of a Learning Agent
par: Sadek, Karim Abdel, et autres
Publié: (2026) -
In-Context Learning Improves Compositional Understanding of Vision-Language Models
par: Nulli, Matteo, et autres
Publié: (2024)