Tighter Value-Function Approximations for POMDPs
Fuente:
arXiv
Salvato in:
| Autori principali: | Krale, Merlijn, Koops, Wietze, Junges, Sebastian, Simão, Thiago D., Jansen, Nils |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Approximate Dec-POMDP Solving Using Multi-Agent A*
di: Koops, Wietze, et al.
Pubblicazione: (2024)
di: Koops, Wietze, et al.
Pubblicazione: (2024)
Factored Online Planning in Many-Agent POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2023)
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2023)
Perception-Based Beliefs for POMDPs with Visual Observations
di: Schäfers, Miriam, et al.
Pubblicazione: (2026)
di: Schäfers, Miriam, et al.
Pubblicazione: (2026)
Imprecise Probabilities Meet Partial Observability: Game Semantics for Robust POMDPs
di: Bovy, Eline M., et al.
Pubblicazione: (2024)
di: Bovy, Eline M., et al.
Pubblicazione: (2024)
Policy Verification in Stochastic Dynamical Systems Using Logarithmic Neural Certificates
di: Badings, Thom, et al.
Pubblicazione: (2024)
di: Badings, Thom, et al.
Pubblicazione: (2024)
Robust Finite-Memory Policy Gradients for Hidden-Model POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2025)
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2025)
Pessimistic Iterative Planning with RNNs for Robust POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2024)
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2024)
Missingness-MDPs: Bridging the Theory of Missing Data and POMDPs
di: Wendland, Joshua, et al.
Pubblicazione: (2026)
di: Wendland, Joshua, et al.
Pubblicazione: (2026)
Multi-Environment POMDPs: Discrete Model Uncertainty Under Partial Observability
di: Bovy, Eline M., et al.
Pubblicazione: (2025)
di: Bovy, Eline M., et al.
Pubblicazione: (2025)
Finite-State Controllers for (Hidden-Model) POMDPs using Deep Reinforcement Learning
di: Hudák, David, et al.
Pubblicazione: (2026)
di: Hudák, David, et al.
Pubblicazione: (2026)
Online Risk-Averse Planning in POMDPs Using Iterated CVaR Value Function
di: Pariente, Yaacov, et al.
Pubblicazione: (2026)
di: Pariente, Yaacov, et al.
Pubblicazione: (2026)
Reinforcement Learning by Guided Safe Exploration
di: Yang, Qisong, et al.
Pubblicazione: (2023)
di: Yang, Qisong, et al.
Pubblicazione: (2023)
Value of Information and Reward Specification in Active Inference and POMDPs
di: Wei, Ran
Pubblicazione: (2024)
di: Wei, Ran
Pubblicazione: (2024)
Computing the Reachability Value of Posterior-Deterministic POMDPs
di: Fijalkow, Nathanaël, et al.
Pubblicazione: (2026)
di: Fijalkow, Nathanaël, et al.
Pubblicazione: (2026)
Point-Based Value Iteration for POMDPs with Neural Perception Mechanisms
di: Yan, Rui, et al.
Pubblicazione: (2023)
di: Yan, Rui, et al.
Pubblicazione: (2023)
BetaZero: Belief-State Planning for Long-Horizon POMDPs using Learned Approximations
di: Moss, Robert J., et al.
Pubblicazione: (2023)
di: Moss, Robert J., et al.
Pubblicazione: (2023)
Finite-Memory Policies for Robust POMDPs via Convex Optimization (implementation)
di: Cubuktepe, Murat, et al.
Pubblicazione: (2021)
di: Cubuktepe, Murat, et al.
Pubblicazione: (2021)
Rethinking Transformers in Solving POMDPs
di: Lu, Chenhao, et al.
Pubblicazione: (2024)
di: Lu, Chenhao, et al.
Pubblicazione: (2024)
Multi-Environment POMDPs with Finite-Horizon Objectives
di: Brice, Léonard, et al.
Pubblicazione: (2026)
di: Brice, Léonard, et al.
Pubblicazione: (2026)
Simplification of Risk Averse POMDPs with Performance Guarantees
di: Pariente, Yaacov, et al.
Pubblicazione: (2024)
di: Pariente, Yaacov, et al.
Pubblicazione: (2024)
What should be observed for optimal reward in POMDPs?
di: Konsta, Alyzia-Maria, et al.
Pubblicazione: (2024)
di: Konsta, Alyzia-Maria, et al.
Pubblicazione: (2024)
Planning under Distribution Shifts with Causal POMDPs
di: Ceriscioli, Matteo, et al.
Pubblicazione: (2026)
di: Ceriscioli, Matteo, et al.
Pubblicazione: (2026)
Maintenance Strategies for Sewer Pipes with Multi-State Degradation and Deep Reinforcement Learning
di: Jimenez-Roa, Lisandro A., et al.
Pubblicazione: (2024)
di: Jimenez-Roa, Lisandro A., et al.
Pubblicazione: (2024)
Sound Heuristic Search Value Iteration for Undiscounted POMDPs with Reachability Objectives
di: Ho, Qi Heng, et al.
Pubblicazione: (2024)
di: Ho, Qi Heng, et al.
Pubblicazione: (2024)
Scalable Solution Methods for Dec-POMDPs with Deterministic Dynamics
di: You, Yang, et al.
Pubblicazione: (2025)
di: You, Yang, et al.
Pubblicazione: (2025)
Belief-State Query Policies for User-Aligned POMDPs
di: Bramblett, Daniel, et al.
Pubblicazione: (2024)
di: Bramblett, Daniel, et al.
Pubblicazione: (2024)
Online Planning in POMDPs with State-Requests
di: Avalos, Raphael, et al.
Pubblicazione: (2024)
di: Avalos, Raphael, et al.
Pubblicazione: (2024)
Inducing Individual Students' Learning Strategies through Homomorphic POMDPs
di: Gao, Huifan, et al.
Pubblicazione: (2024)
di: Gao, Huifan, et al.
Pubblicazione: (2024)
Hierarchical Universal Value Function Approximators
di: Arora, Rushiv
Pubblicazione: (2024)
di: Arora, Rushiv
Pubblicazione: (2024)
Scalable Policy-Based RL Algorithms for POMDPs
di: Anjarlekar, Ameya, et al.
Pubblicazione: (2025)
di: Anjarlekar, Ameya, et al.
Pubblicazione: (2025)
Achieving Tighter Finite-Time Rates for Heterogeneous Federated Stochastic Approximation under Markovian Sampling
di: Zhu, Feng, et al.
Pubblicazione: (2025)
di: Zhu, Feng, et al.
Pubblicazione: (2025)
Sample-Efficient Policy Space Response Oracles with Joint Experience Best Response
di: Bighashdel, Ariyan, et al.
Pubblicazione: (2026)
di: Bighashdel, Ariyan, et al.
Pubblicazione: (2026)
Tensor Low-rank Approximation of Finite-horizon Value Functions
di: Rozada, Sergio, et al.
Pubblicazione: (2024)
di: Rozada, Sergio, et al.
Pubblicazione: (2024)
Sequential Monte Carlo for Policy Optimization in Continuous POMDPs
di: Abdulsamad, Hany, et al.
Pubblicazione: (2025)
di: Abdulsamad, Hany, et al.
Pubblicazione: (2025)
Optimizing Task Completion Time Updates Using POMDPs
di: Eddy, Duncan, et al.
Pubblicazione: (2026)
di: Eddy, Duncan, et al.
Pubblicazione: (2026)
How to Explore with Belief: State Entropy Maximization in POMDPs
di: Zamboni, Riccardo, et al.
Pubblicazione: (2024)
di: Zamboni, Riccardo, et al.
Pubblicazione: (2024)
Constrained and Robust Policy Synthesis with Satisfiability-Modulo-Probabilistic-Model-Checking
di: Heck, Linus, et al.
Pubblicazione: (2025)
di: Heck, Linus, et al.
Pubblicazione: (2025)
Tensor and Matrix Low-Rank Value-Function Approximation in Reinforcement Learning
di: Rozada, Sergio, et al.
Pubblicazione: (2022)
di: Rozada, Sergio, et al.
Pubblicazione: (2022)
Synthetic POMDPs to Challenge Memory-Augmented RL: Memory Demand Structure Modeling
di: Wang, Yongyi, et al.
Pubblicazione: (2025)
di: Wang, Yongyi, et al.
Pubblicazione: (2025)
Interpreting systems as solving POMDPs: a step towards a formal understanding of agency
di: Biehl, Martin, et al.
Pubblicazione: (2022)
di: Biehl, Martin, et al.
Pubblicazione: (2022)
Documenti analoghi
-
Approximate Dec-POMDP Solving Using Multi-Agent A*
di: Koops, Wietze, et al.
Pubblicazione: (2024) -
Factored Online Planning in Many-Agent POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2023) -
Perception-Based Beliefs for POMDPs with Visual Observations
di: Schäfers, Miriam, et al.
Pubblicazione: (2026) -
Imprecise Probabilities Meet Partial Observability: Game Semantics for Robust POMDPs
di: Bovy, Eline M., et al.
Pubblicazione: (2024) -
Policy Verification in Stochastic Dynamical Systems Using Logarithmic Neural Certificates
di: Badings, Thom, et al.
Pubblicazione: (2024)