A Unified Theory of Compositionality, Modularity, and Interpretability in Markov Decision Processes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ringstrom, Thomas J., Schrater, Paul R. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Structured Relational Representations
par: Kumar, Arun, et autres
Publié: (2025)
par: Kumar, Arun, et autres
Publié: (2025)
Knowledge-Centric Metacognitive Learning
par: Kumar, Arun, et autres
Publié: (2024)
par: Kumar, Arun, et autres
Publié: (2024)
Optimal Decision Tree Policies for Markov Decision Processes
par: Vos, Daniël, et autres
Publié: (2023)
par: Vos, Daniël, et autres
Publié: (2023)
Markov Decision Processes under External Temporal Processes
par: Ayyagari, Ranga Shaarad, et autres
Publié: (2023)
par: Ayyagari, Ranga Shaarad, et autres
Publié: (2023)
Policy Gradient for Robust Markov Decision Processes
par: Wang, Qiuhao, et autres
Publié: (2024)
par: Wang, Qiuhao, et autres
Publié: (2024)
SPOT: Scalable Policy Optimization with Trees for Markov Decision Processes
par: Xiong, Xuyuan, et autres
Publié: (2025)
par: Xiong, Xuyuan, et autres
Publié: (2025)
Act as You Learn: Adaptive Decision-Making in Non-Stationary Markov Decision Processes
par: Luo, Baiting, et autres
Publié: (2024)
par: Luo, Baiting, et autres
Publié: (2024)
Solving Robust Markov Decision Processes: Generic, Reliable, Efficient
par: Meggendorfer, Tobias, et autres
Publié: (2024)
par: Meggendorfer, Tobias, et autres
Publié: (2024)
Hierarchical Average-Reward Linearly-solvable Markov Decision Processes
par: Infante, Guillermo, et autres
Publié: (2024)
par: Infante, Guillermo, et autres
Publié: (2024)
Linear Mixture Distributionally Robust Markov Decision Processes
par: Liu, Zhishuai, et autres
Publié: (2025)
par: Liu, Zhishuai, et autres
Publié: (2025)
Diffusion-Augmented Markov Decision Processes for Maximum Entropy Reinforcement Learning
par: Sanokowski, Sebastian, et autres
Publié: (2025)
par: Sanokowski, Sebastian, et autres
Publié: (2025)
Homomorphic Mappings for Value-Preserving State Aggregation in Markov Decision Processes
par: Zhao, Shuo, et autres
Publié: (2025)
par: Zhao, Shuo, et autres
Publié: (2025)
Dual Formulation for Non-Rectangular Lp Robust Markov Decision Processes
par: Kumar, Navdeep, et autres
Publié: (2025)
par: Kumar, Navdeep, et autres
Publié: (2025)
Efficient and Sharp Off-Policy Evaluation in Robust Markov Decision Processes
par: Bennett, Andrew, et autres
Publié: (2024)
par: Bennett, Andrew, et autres
Publié: (2024)
Optimistic Regret Bounds for Online Learning in Adversarial Markov Decision Processes
par: Moon, Sang Bin, et autres
Publié: (2024)
par: Moon, Sang Bin, et autres
Publié: (2024)
OCMDP: Observation-Constrained Markov Decision Process
par: Wang, Taiyi, et autres
Publié: (2024)
par: Wang, Taiyi, et autres
Publié: (2024)
Rethinking Large Language Model Distillation: A Constrained Markov Decision Process Perspective
par: Zimmer, Matthieu, et autres
Publié: (2025)
par: Zimmer, Matthieu, et autres
Publié: (2025)
A Cantor-Kantorovich Metric Between Markov Decision Processes with Application to Transfer Learning
par: Banse, Adrien, et autres
Publié: (2024)
par: Banse, Adrien, et autres
Publié: (2024)
Provably Efficient Reward Transfer in Reinforcement Learning with Discrete Markov Decision Processes
par: Vora, Kevin, et autres
Publié: (2025)
par: Vora, Kevin, et autres
Publié: (2025)
Policy Regularized Distributionally Robust Markov Decision Processes with Linear Function Approximation
par: Gu, Jingwen, et autres
Publié: (2025)
par: Gu, Jingwen, et autres
Publié: (2025)
MATE: Solving Contextual Markov Decision Processes with Memory of Accumulated Transition Embeddings
par: Hwang, Himchan, et autres
Publié: (2026)
par: Hwang, Himchan, et autres
Publié: (2026)
REValueD: Regularised Ensemble Value-Decomposition for Factorisable Markov Decision Processes
par: Ireland, David, et autres
Publié: (2024)
par: Ireland, David, et autres
Publié: (2024)
Globally Optimal Hierarchical Reinforcement Learning for Linearly-Solvable Markov Decision Processes
par: Infante, Guillermo, et autres
Publié: (2021)
par: Infante, Guillermo, et autres
Publié: (2021)
Conformal Off-Policy Evaluation in Markov Decision Processes
par: Foffano, Daniele, et autres
Publié: (2023)
par: Foffano, Daniele, et autres
Publié: (2023)
Reinforcement Learning in Switching Non-Stationary Markov Decision Processes: Algorithms and Convergence Analysis
par: Amiri, Mohsen, et autres
Publié: (2025)
par: Amiri, Mohsen, et autres
Publié: (2025)
Policy Gradient Algorithms with Monte Carlo Tree Learning for Non-Markov Decision Processes
par: Morimura, Tetsuro, et autres
Publié: (2022)
par: Morimura, Tetsuro, et autres
Publié: (2022)
On the Convergence of Modified Policy Iteration in Risk Sensitive Exponential Cost Markov Decision Processes
par: Murthy, Yashaswini, et autres
Publié: (2023)
par: Murthy, Yashaswini, et autres
Publié: (2023)
Almost Sure Convergence of Differential Temporal Difference Learning for Average Reward Markov Decision Processes
par: Blaser, Ethan, et autres
Publié: (2026)
par: Blaser, Ethan, et autres
Publié: (2026)
Regret Analysis of Policy Gradient Algorithm for Infinite Horizon Average Reward Markov Decision Processes
par: Bai, Qinbo, et autres
Publié: (2023)
par: Bai, Qinbo, et autres
Publié: (2023)
A Generalized Bisimulation Metric of State Similarity between Markov Decision Processes: From Theoretical Propositions to Applications
par: Tao, Zhenyu, et autres
Publié: (2025)
par: Tao, Zhenyu, et autres
Publié: (2025)
A Unified Theory of Sparse Dictionary Learning in Mechanistic Interpretability: Piecewise Biconvexity and Spurious Minima
par: Tang, Yiming, et autres
Publié: (2025)
par: Tang, Yiming, et autres
Publié: (2025)
Training Neural Networks for Modularity aids Interpretability
par: Golechha, Satvik, et autres
Publié: (2024)
par: Golechha, Satvik, et autres
Publié: (2024)
Observation Adaptation via Annealed Importance Resampling for Partially Observable Markov Decision Processes
par: Zhang, Yunuo, et autres
Publié: (2025)
par: Zhang, Yunuo, et autres
Publié: (2025)
Burning RED: Unlocking Subtask-Driven Reinforcement Learning and Risk-Awareness in Average-Reward Markov Decision Processes
par: Rojas, Juan Sebastian, et autres
Publié: (2024)
par: Rojas, Juan Sebastian, et autres
Publié: (2024)
Playing games with knowledge: AI-Induced delusions need game theoretic interventions
par: Beaumaster, Will, et autres
Publié: (2026)
par: Beaumaster, Will, et autres
Publié: (2026)
Structural Estimation of Markov Decision Processes in High-Dimensional State Space with Finite-Time Guarantees
par: Zeng, Siliang, et autres
Publié: (2022)
par: Zeng, Siliang, et autres
Publié: (2022)
An Offline Risk-aware Policy Selection Method for Bayesian Markov Decision Processes
par: Angelotti, Giorgio, et autres
Publié: (2021)
par: Angelotti, Giorgio, et autres
Publié: (2021)
A Theory of Interpretable Approximations
par: Bressan, Marco, et autres
Publié: (2024)
par: Bressan, Marco, et autres
Publié: (2024)
Inferring Reward Machines and Transition Machines from Partially Observable Markov Decision Processes
par: Wu, Yuly, et autres
Publié: (2025)
par: Wu, Yuly, et autres
Publié: (2025)
Quantum Speedups in Regret Analysis of Infinite Horizon Average-Reward Markov Decision Processes
par: Ganguly, Bhargav, et autres
Publié: (2023)
par: Ganguly, Bhargav, et autres
Publié: (2023)
Documents similaires
-
Structured Relational Representations
par: Kumar, Arun, et autres
Publié: (2025) -
Knowledge-Centric Metacognitive Learning
par: Kumar, Arun, et autres
Publié: (2024) -
Optimal Decision Tree Policies for Markov Decision Processes
par: Vos, Daniël, et autres
Publié: (2023) -
Markov Decision Processes under External Temporal Processes
par: Ayyagari, Ranga Shaarad, et autres
Publié: (2023) -
Policy Gradient for Robust Markov Decision Processes
par: Wang, Qiuhao, et autres
Publié: (2024)