Salvato in:
| Autori principali: | Hudák, David, Galesloot, Maris F. L., Tappler, Martin, Kurečka, Martin, Jansen, Nils, Češka, Milan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.08734 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Robust Finite-Memory Policy Gradients for Hidden-Model POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2025)
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2025)
Missingness-MDPs: Bridging the Theory of Missing Data and POMDPs
di: Wendland, Joshua, et al.
Pubblicazione: (2026)
di: Wendland, Joshua, et al.
Pubblicazione: (2026)
Factored Online Planning in Many-Agent POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2023)
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2023)
Robust Probabilistic Shielding for Safe Offline Reinforcement Learning
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2026)
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2026)
Pessimistic Iterative Planning with RNNs for Robust POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2024)
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2024)
Tighter Value-Function Approximations for POMDPs
di: Krale, Merlijn, et al.
Pubblicazione: (2025)
di: Krale, Merlijn, et al.
Pubblicazione: (2025)
Threshold UCT: Cost-Constrained Monte Carlo Tree Search with Pareto Curves
di: Kurečka, Martin, et al.
Pubblicazione: (2024)
di: Kurečka, Martin, et al.
Pubblicazione: (2024)
Multi-Environment POMDPs: Discrete Model Uncertainty Under Partial Observability
di: Bovy, Eline M., et al.
Pubblicazione: (2025)
di: Bovy, Eline M., et al.
Pubblicazione: (2025)
Imprecise Probabilities Meet Partial Observability: Game Semantics for Robust POMDPs
di: Bovy, Eline M., et al.
Pubblicazione: (2024)
di: Bovy, Eline M., et al.
Pubblicazione: (2024)
Constrained and Robust Policy Synthesis with Satisfiability-Modulo-Probabilistic-Model-Checking
di: Heck, Linus, et al.
Pubblicazione: (2025)
di: Heck, Linus, et al.
Pubblicazione: (2025)
Solving Collaborative Dec-POMDPs with Deep Reinforcement Learning Heuristics
di: Soffair, Nitsan
Pubblicazione: (2022)
di: Soffair, Nitsan
Pubblicazione: (2022)
A Finite-State Controller Based Offline Solver for Deterministic POMDPs
di: Schutz, Alex, et al.
Pubblicazione: (2025)
di: Schutz, Alex, et al.
Pubblicazione: (2025)
Multi-Environment POMDPs with Finite-Horizon Objectives
di: Brice, Léonard, et al.
Pubblicazione: (2026)
di: Brice, Léonard, et al.
Pubblicazione: (2026)
Bidding Games on Markov Decision Processes with Quantitative Reachability Objectives
di: Avni, Guy, et al.
Pubblicazione: (2024)
di: Avni, Guy, et al.
Pubblicazione: (2024)
Generalizing Multi-Step Inverse Models for Representation Learning to Finite-Memory POMDPs
di: Wu, Lili, et al.
Pubblicazione: (2024)
di: Wu, Lili, et al.
Pubblicazione: (2024)
BetaZero: Belief-State Planning for Long-Horizon POMDPs using Learned Approximations
di: Moss, Robert J., et al.
Pubblicazione: (2023)
di: Moss, Robert J., et al.
Pubblicazione: (2023)
Explainable Representation of Finite-Memory Policies for POMDPs using Decision Trees
di: Azeem, Muqsit, et al.
Pubblicazione: (2024)
di: Azeem, Muqsit, et al.
Pubblicazione: (2024)
Online Planning in POMDPs with State-Requests
di: Avalos, Raphael, et al.
Pubblicazione: (2024)
di: Avalos, Raphael, et al.
Pubblicazione: (2024)
Decentralized Planning Using Probabilistic Hyperproperties
di: Pontiggia, Francesco, et al.
Pubblicazione: (2025)
di: Pontiggia, Francesco, et al.
Pubblicazione: (2025)
Shields to Guarantee Probabilistic Safety in MDPs
di: Heck, Linus, et al.
Pubblicazione: (2026)
di: Heck, Linus, et al.
Pubblicazione: (2026)
Interpreting systems as solving POMDPs: a step towards a formal understanding of agency
di: Biehl, Martin, et al.
Pubblicazione: (2022)
di: Biehl, Martin, et al.
Pubblicazione: (2022)
Belief-State Query Policies for User-Aligned POMDPs
di: Bramblett, Daniel, et al.
Pubblicazione: (2024)
di: Bramblett, Daniel, et al.
Pubblicazione: (2024)
Maintenance Strategies for Sewer Pipes with Multi-State Degradation and Deep Reinforcement Learning
di: Jimenez-Roa, Lisandro A., et al.
Pubblicazione: (2024)
di: Jimenez-Roa, Lisandro A., et al.
Pubblicazione: (2024)
Learning Interpretable Policies in Hindsight-Observable POMDPs through Partially Supervised Reinforcement Learning
di: Lanier, Michael, et al.
Pubblicazione: (2024)
di: Lanier, Michael, et al.
Pubblicazione: (2024)
Toward Learning POMDPs Beyond Full-Rank Actions and State Observability
di: Shaw, Seiji, et al.
Pubblicazione: (2026)
di: Shaw, Seiji, et al.
Pubblicazione: (2026)
Homomorphisms and Embeddings of STRIPS Planning Models
di: Lequen, Arnaud, et al.
Pubblicazione: (2024)
di: Lequen, Arnaud, et al.
Pubblicazione: (2024)
How to Explore with Belief: State Entropy Maximization in POMDPs
di: Zamboni, Riccardo, et al.
Pubblicazione: (2024)
di: Zamboni, Riccardo, et al.
Pubblicazione: (2024)
Test Where Decisions Matter: Importance-driven Testing for Deep Reinforcement Learning
di: Pranger, Stefan, et al.
Pubblicazione: (2024)
di: Pranger, Stefan, et al.
Pubblicazione: (2024)
Comparing Reinforcement Learning and Human Learning using the Game of Hidden Rules
di: Pulick, Eric, et al.
Pubblicazione: (2023)
di: Pulick, Eric, et al.
Pubblicazione: (2023)
Sum-Product-Set Networks: Deep Tractable Models for Tree-Structured Graphs
di: Papež, Milan, et al.
Pubblicazione: (2024)
di: Papež, Milan, et al.
Pubblicazione: (2024)
Solving Truly Massive Budgeted Monotonic POMDPs with Oracle-Guided Meta-Reinforcement Learning
di: Vora, Manav, et al.
Pubblicazione: (2024)
di: Vora, Manav, et al.
Pubblicazione: (2024)
Inducing Individual Students' Learning Strategies through Homomorphic POMDPs
di: Gao, Huifan, et al.
Pubblicazione: (2024)
di: Gao, Huifan, et al.
Pubblicazione: (2024)
Vehicle Routing with Finite Time Horizon using Deep Reinforcement Learning with Improved Network Embedding
di: Maity, Ayan, et al.
Pubblicazione: (2026)
di: Maity, Ayan, et al.
Pubblicazione: (2026)
Probabilistic Graph Circuits: Deep Generative Models for Tractable Probabilistic Inference over Graphs
di: Papež, Milan, et al.
Pubblicazione: (2025)
di: Papež, Milan, et al.
Pubblicazione: (2025)
Reinforcement Learning by Guided Safe Exploration
di: Yang, Qisong, et al.
Pubblicazione: (2023)
di: Yang, Qisong, et al.
Pubblicazione: (2023)
Rethinking Transformers in Solving POMDPs
di: Lu, Chenhao, et al.
Pubblicazione: (2024)
di: Lu, Chenhao, et al.
Pubblicazione: (2024)
Optimizing Traffic Signal Control using High-Dimensional State Representation and Efficient Deep Reinforcement Learning
di: Francis, Lawrence, et al.
Pubblicazione: (2024)
di: Francis, Lawrence, et al.
Pubblicazione: (2024)
Simplification of Risk Averse POMDPs with Performance Guarantees
di: Pariente, Yaacov, et al.
Pubblicazione: (2024)
di: Pariente, Yaacov, et al.
Pubblicazione: (2024)
What should be observed for optimal reward in POMDPs?
di: Konsta, Alyzia-Maria, et al.
Pubblicazione: (2024)
di: Konsta, Alyzia-Maria, et al.
Pubblicazione: (2024)
Planning under Distribution Shifts with Causal POMDPs
di: Ceriscioli, Matteo, et al.
Pubblicazione: (2026)
di: Ceriscioli, Matteo, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Robust Finite-Memory Policy Gradients for Hidden-Model POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2025) -
Missingness-MDPs: Bridging the Theory of Missing Data and POMDPs
di: Wendland, Joshua, et al.
Pubblicazione: (2026) -
Factored Online Planning in Many-Agent POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2023) -
Robust Probabilistic Shielding for Safe Offline Reinforcement Learning
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2026) -
Pessimistic Iterative Planning with RNNs for Robust POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2024)