Selecting Decision-Relevant Concepts in Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Raman, Naveen, Milani, Stephanie, Fang, Fei |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
LICORICE: Label-Efficient Concept-Based Interpretable Reinforcement Learning
von: Ye, Zhuorui, et al.
Veröffentlicht: (2024)
von: Ye, Zhuorui, et al.
Veröffentlicht: (2024)
Global Rewards in Restless Multi-Armed Bandits
von: Raman, Naveen, et al.
Veröffentlicht: (2024)
von: Raman, Naveen, et al.
Veröffentlicht: (2024)
Do Concept Bottleneck Models Respect Localities?
von: Raman, Naveen, et al.
Veröffentlicht: (2024)
von: Raman, Naveen, et al.
Veröffentlicht: (2024)
Contextual Budget Bandit for Food Rescue Volunteer Engagement
von: Tang, Ariana, et al.
Veröffentlicht: (2025)
von: Tang, Ariana, et al.
Veröffentlicht: (2025)
Healthcare LLM Benchmarks Are Only as Good as Their Explicit Assumptions
von: Raman, Naveen, et al.
Veröffentlicht: (2026)
von: Raman, Naveen, et al.
Veröffentlicht: (2026)
On The Statistical Complexity of Offline Decision-Making
von: Nguyen-Tang, Thanh, et al.
Veröffentlicht: (2025)
von: Nguyen-Tang, Thanh, et al.
Veröffentlicht: (2025)
On Sample-Efficient Offline Reinforcement Learning: Data Diversity, Posterior Sampling, and Beyond
von: Nguyen-Tang, Thanh, et al.
Veröffentlicht: (2024)
von: Nguyen-Tang, Thanh, et al.
Veröffentlicht: (2024)
Decision Mamba: Reinforcement Learning via Sequence Modeling with Selective State Spaces
von: Ota, Toshihiro
Veröffentlicht: (2024)
von: Ota, Toshihiro
Veröffentlicht: (2024)
Offline Inverse Constrained Reinforcement Learning for Safe-Critical Decision Making in Healthcare
von: Fang, Nan, et al.
Veröffentlicht: (2024)
von: Fang, Nan, et al.
Veröffentlicht: (2024)
To Measure or Not: A Cost-Sensitive, Selective Measuring Environment for Agricultural Management Decisions with Reinforcement Learning
von: Baja, Hilmy, et al.
Veröffentlicht: (2025)
von: Baja, Hilmy, et al.
Veröffentlicht: (2025)
Cyclical Log Annealing as a Learning Rate Scheduler
von: Naveen, Philip
Veröffentlicht: (2024)
von: Naveen, Philip
Veröffentlicht: (2024)
Compositional Learning of Visually-Grounded Concepts Using Reinforcement
von: Lin, Zijun, et al.
Veröffentlicht: (2023)
von: Lin, Zijun, et al.
Veröffentlicht: (2023)
LearnAlign: Data Selection for LLM Reinforcement Learning with Improved Gradient Alignment
von: Li, Shipeng, et al.
Veröffentlicht: (2025)
von: Li, Shipeng, et al.
Veröffentlicht: (2025)
From Attribution Maps to Human-Understandable Explanations through Concept Relevance Propagation
von: Achtibat, Reduan, et al.
Veröffentlicht: (2022)
von: Achtibat, Reduan, et al.
Veröffentlicht: (2022)
GRAIL: Autonomous Concept Grounding for Neuro-Symbolic Reinforcement Learning
von: Shindo, Hikaru, et al.
Veröffentlicht: (2026)
von: Shindo, Hikaru, et al.
Veröffentlicht: (2026)
A Survey on Explainable Reinforcement Learning: Concepts, Algorithms, Challenges
von: Qing, Yunpeng, et al.
Veröffentlicht: (2022)
von: Qing, Yunpeng, et al.
Veröffentlicht: (2022)
Solving Continual Offline Reinforcement Learning with Decision Transformer
von: Huang, Kaixin, et al.
Veröffentlicht: (2024)
von: Huang, Kaixin, et al.
Veröffentlicht: (2024)
Why the Agent Made that Decision: Contrastive Explanation Learning for Reinforcement Learning
von: Zuo, Rui, et al.
Veröffentlicht: (2024)
von: Zuo, Rui, et al.
Veröffentlicht: (2024)
Reinforcement Learning with Pairwise Preferences in Long-Term Decision Problems
von: Carr, Jonathan Colaço, et al.
Veröffentlicht: (2026)
von: Carr, Jonathan Colaço, et al.
Veröffentlicht: (2026)
Decision-Focused Model-based Reinforcement Learning for Reward Transfer
von: Sharma, Abhishek, et al.
Veröffentlicht: (2023)
von: Sharma, Abhishek, et al.
Veröffentlicht: (2023)
Reinforcement Learning Gradients as Vitamin for Online Finetuning Decision Transformers
von: Yan, Kai, et al.
Veröffentlicht: (2024)
von: Yan, Kai, et al.
Veröffentlicht: (2024)
Generating Query-Relevant Document Summaries via Reinforcement Learning
von: Yadav, Nitin, et al.
Veröffentlicht: (2025)
von: Yadav, Nitin, et al.
Veröffentlicht: (2025)
Quantifying First-Order Markov Violations in Noisy Reinforcement Learning: A Causal Discovery Approach
von: Mysore, Naveen
Veröffentlicht: (2025)
von: Mysore, Naveen
Veröffentlicht: (2025)
ConceptTracer: Interactive Analysis of Concept Saliency and Selectivity in Neural Representations
von: Knauer, Ricardo, et al.
Veröffentlicht: (2026)
von: Knauer, Ricardo, et al.
Veröffentlicht: (2026)
Operator-Guided Invariance Learning for Continuous Reinforcement Learning
von: Zhang, Zuyuan, et al.
Veröffentlicht: (2026)
von: Zhang, Zuyuan, et al.
Veröffentlicht: (2026)
Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?
von: Omori, Yumi, et al.
Veröffentlicht: (2025)
von: Omori, Yumi, et al.
Veröffentlicht: (2025)
Diffusion-Augmented Markov Decision Processes for Maximum Entropy Reinforcement Learning
von: Sanokowski, Sebastian, et al.
Veröffentlicht: (2025)
von: Sanokowski, Sebastian, et al.
Veröffentlicht: (2025)
BET: Explaining Deep Reinforcement Learning through The Error-Prone Decisions
von: Liu, Xiao, et al.
Veröffentlicht: (2024)
von: Liu, Xiao, et al.
Veröffentlicht: (2024)
When should we prefer Decision Transformers for Offline Reinforcement Learning?
von: Bhargava, Prajjwal, et al.
Veröffentlicht: (2023)
von: Bhargava, Prajjwal, et al.
Veröffentlicht: (2023)
In-Context Decision Transformer: Reinforcement Learning via Hierarchical Chain-of-Thought
von: Huang, Sili, et al.
Veröffentlicht: (2024)
von: Huang, Sili, et al.
Veröffentlicht: (2024)
$λ$-models: Effective Decision-Aware Reinforcement Learning with Latent Models
von: Voelcker, Claas A, et al.
Veröffentlicht: (2023)
von: Voelcker, Claas A, et al.
Veröffentlicht: (2023)
Post-Hoc Reversal: Are We Selecting Models Prematurely?
von: Ranjan, Rishabh, et al.
Veröffentlicht: (2024)
von: Ranjan, Rishabh, et al.
Veröffentlicht: (2024)
Reinforcement Learning Methods for Neighborhood Selection in Local Search
von: Molinghen, Yannick, et al.
Veröffentlicht: (2026)
von: Molinghen, Yannick, et al.
Veröffentlicht: (2026)
Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review
von: Zhou, Chengmin, et al.
Veröffentlicht: (2025)
von: Zhou, Chengmin, et al.
Veröffentlicht: (2025)
Task-Aware Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
von: Fan, Ziqing, et al.
Veröffentlicht: (2024)
von: Fan, Ziqing, et al.
Veröffentlicht: (2024)
Soft Conflict-Resolution Decision Transformer for Offline Multi-Task Reinforcement Learning
von: Wang, Shudong, et al.
Veröffentlicht: (2025)
von: Wang, Shudong, et al.
Veröffentlicht: (2025)
Quantum Decision Transformers (QDT): Synergistic Entanglement and Interference for Offline Reinforcement Learning
von: Weinberg, Abraham Itzhak
Veröffentlicht: (2025)
von: Weinberg, Abraham Itzhak
Veröffentlicht: (2025)
Temporal Logic Specification-Conditioned Decision Transformer for Offline Safe Reinforcement Learning
von: Guo, Zijian, et al.
Veröffentlicht: (2024)
von: Guo, Zijian, et al.
Veröffentlicht: (2024)
Provably Efficient Reward Transfer in Reinforcement Learning with Discrete Markov Decision Processes
von: Vora, Kevin, et al.
Veröffentlicht: (2025)
von: Vora, Kevin, et al.
Veröffentlicht: (2025)
Globally Optimal Hierarchical Reinforcement Learning for Linearly-Solvable Markov Decision Processes
von: Infante, Guillermo, et al.
Veröffentlicht: (2021)
von: Infante, Guillermo, et al.
Veröffentlicht: (2021)
Ähnliche Einträge
-
LICORICE: Label-Efficient Concept-Based Interpretable Reinforcement Learning
von: Ye, Zhuorui, et al.
Veröffentlicht: (2024) -
Global Rewards in Restless Multi-Armed Bandits
von: Raman, Naveen, et al.
Veröffentlicht: (2024) -
Do Concept Bottleneck Models Respect Localities?
von: Raman, Naveen, et al.
Veröffentlicht: (2024) -
Contextual Budget Bandit for Food Rescue Volunteer Engagement
von: Tang, Ariana, et al.
Veröffentlicht: (2025) -
Healthcare LLM Benchmarks Are Only as Good as Their Explicit Assumptions
von: Raman, Naveen, et al.
Veröffentlicht: (2026)