Pessimistic Iterative Planning with RNNs for Robust POMDPs
Fuente:
arXiv
Salvato in:
| Autori principali: | Galesloot, Maris F. L., Suilen, Marnix, Simão, Thiago D., Carr, Steven, Spaan, Matthijs T. J., Topcu, Ufuk, Jansen, Nils |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Factored Online Planning in Many-Agent POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2023)
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2023)
Multi-Environment POMDPs: Discrete Model Uncertainty Under Partial Observability
di: Bovy, Eline M., et al.
Pubblicazione: (2025)
di: Bovy, Eline M., et al.
Pubblicazione: (2025)
Imprecise Probabilities Meet Partial Observability: Game Semantics for Robust POMDPs
di: Bovy, Eline M., et al.
Pubblicazione: (2024)
di: Bovy, Eline M., et al.
Pubblicazione: (2024)
Robust Finite-Memory Policy Gradients for Hidden-Model POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2025)
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2025)
Finite-Memory Policies for Robust POMDPs via Convex Optimization (implementation)
di: Cubuktepe, Murat, et al.
Pubblicazione: (2021)
di: Cubuktepe, Murat, et al.
Pubblicazione: (2021)
Missingness-MDPs: Bridging the Theory of Missing Data and POMDPs
di: Wendland, Joshua, et al.
Pubblicazione: (2026)
di: Wendland, Joshua, et al.
Pubblicazione: (2026)
Robust Probabilistic Shielding for Safe Offline Reinforcement Learning
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2026)
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2026)
Finite-State Controllers for (Hidden-Model) POMDPs using Deep Reinforcement Learning
di: Hudák, David, et al.
Pubblicazione: (2026)
di: Hudák, David, et al.
Pubblicazione: (2026)
Tighter Value-Function Approximations for POMDPs
di: Krale, Merlijn, et al.
Pubblicazione: (2025)
di: Krale, Merlijn, et al.
Pubblicazione: (2025)
Reinforcement Learning by Guided Safe Exploration
di: Yang, Qisong, et al.
Pubblicazione: (2023)
di: Yang, Qisong, et al.
Pubblicazione: (2023)
Robust Markov Decision Processes: A Place Where AI and Formal Methods Meet
di: Suilen, Marnix, et al.
Pubblicazione: (2024)
di: Suilen, Marnix, et al.
Pubblicazione: (2024)
Data-Efficient Safe Policy Improvement Using Parametric Structure
di: Engelen, Kasper, et al.
Pubblicazione: (2025)
di: Engelen, Kasper, et al.
Pubblicazione: (2025)
Multimodal Pretrained Models for Verifiable Sequential Decision-Making: Planning, Grounding, and Perception
di: Yang, Yunhao, et al.
Pubblicazione: (2023)
di: Yang, Yunhao, et al.
Pubblicazione: (2023)
Online Risk-Averse Planning in POMDPs Using Iterated CVaR Value Function
di: Pariente, Yaacov, et al.
Pubblicazione: (2026)
di: Pariente, Yaacov, et al.
Pubblicazione: (2026)
Reasoning, Memorization, and Fine-Tuning Language Models for Non-Cooperative Games
di: Yang, Yunhao, et al.
Pubblicazione: (2024)
di: Yang, Yunhao, et al.
Pubblicazione: (2024)
VeRecycle: Reclaiming Guarantees from Probabilistic Certificates for Stochastic Dynamical Systems after Change
di: Lutz, Sterre, et al.
Pubblicazione: (2025)
di: Lutz, Sterre, et al.
Pubblicazione: (2025)
Zero-Shot Reinforcement Learning via Function Encoders
di: Ingebrand, Tyler, et al.
Pubblicazione: (2024)
di: Ingebrand, Tyler, et al.
Pubblicazione: (2024)
Positive Experience Reflection for Agents in Interactive Text Environments
di: Lippmann, Philip, et al.
Pubblicazione: (2024)
di: Lippmann, Philip, et al.
Pubblicazione: (2024)
On the Complexity of Robust Markov Decision Processes and Bisimulation Metrics
di: Suilen, Marnix, et al.
Pubblicazione: (2026)
di: Suilen, Marnix, et al.
Pubblicazione: (2026)
Diverse Projection Ensembles for Distributional Reinforcement Learning
di: Zanger, Moritz A., et al.
Pubblicazione: (2023)
di: Zanger, Moritz A., et al.
Pubblicazione: (2023)
Planning under Distribution Shifts with Causal POMDPs
di: Ceriscioli, Matteo, et al.
Pubblicazione: (2026)
di: Ceriscioli, Matteo, et al.
Pubblicazione: (2026)
Perception-Based Beliefs for POMDPs with Visual Observations
di: Schäfers, Miriam, et al.
Pubblicazione: (2026)
di: Schäfers, Miriam, et al.
Pubblicazione: (2026)
Human-Agent Cooperation in Games under Incomplete Information through Natural Language Communication
di: Chen, Shenghui, et al.
Pubblicazione: (2024)
di: Chen, Shenghui, et al.
Pubblicazione: (2024)
Robust Multi-Agent Reinforcement Learning for Small UAS Separation Assurance under GPS Degradation and Spoofing
di: Zongo, Alex, et al.
Pubblicazione: (2026)
di: Zongo, Alex, et al.
Pubblicazione: (2026)
Online Planning in POMDPs with State-Requests
di: Avalos, Raphael, et al.
Pubblicazione: (2024)
di: Avalos, Raphael, et al.
Pubblicazione: (2024)
Neural Port-Hamiltonian Differential Algebraic Equations for Compositional Learning of Electrical Networks
di: Neary, Cyrus, et al.
Pubblicazione: (2024)
di: Neary, Cyrus, et al.
Pubblicazione: (2024)
Institutional AI Sovereignty Through Gateway Architecture: Implementation Report from Fontys ICT
di: Huijts, Ruud, et al.
Pubblicazione: (2025)
di: Huijts, Ruud, et al.
Pubblicazione: (2025)
Epistemic Monte Carlo Tree Search
di: Oren, Yaniv, et al.
Pubblicazione: (2022)
di: Oren, Yaniv, et al.
Pubblicazione: (2022)
Exploration Implies Data Augmentation: Reachability and Generalisation in Contextual MDPs
di: Weltevrede, Max, et al.
Pubblicazione: (2024)
di: Weltevrede, Max, et al.
Pubblicazione: (2024)
Explore-Go: Leveraging Exploration for Generalisation in Deep Reinforcement Learning
di: Weltevrede, Max, et al.
Pubblicazione: (2024)
di: Weltevrede, Max, et al.
Pubblicazione: (2024)
Point-Based Value Iteration for POMDPs with Neural Perception Mechanisms
di: Yan, Rui, et al.
Pubblicazione: (2023)
di: Yan, Rui, et al.
Pubblicazione: (2023)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
di: Bai, Chenjia, et al.
Pubblicazione: (2024)
di: Bai, Chenjia, et al.
Pubblicazione: (2024)
IG-MCTS: Human-in-the-Loop Cooperative Navigation under Incomplete Information
di: Chen, Shenghui, et al.
Pubblicazione: (2025)
di: Chen, Shenghui, et al.
Pubblicazione: (2025)
Learning to Coordinate without Communication under Incomplete Information
di: Chen, Shenghui, et al.
Pubblicazione: (2024)
di: Chen, Shenghui, et al.
Pubblicazione: (2024)
Fine-Tuning Language Models Using Formal Methods Feedback
di: Yang, Yunhao, et al.
Pubblicazione: (2023)
di: Yang, Yunhao, et al.
Pubblicazione: (2023)
How Ensembles of Distilled Policies Improve Generalisation in Reinforcement Learning
di: Weltevrede, Max, et al.
Pubblicazione: (2025)
di: Weltevrede, Max, et al.
Pubblicazione: (2025)
Adaptive Shielding for Safe Reinforcement Learning under Hidden-Parameter Dynamics Shifts
di: Kwon, Minjae, et al.
Pubblicazione: (2025)
di: Kwon, Minjae, et al.
Pubblicazione: (2025)
Sequential Resource Trading Using Comparison-Based Gradient Estimation
di: Murthy, Surya, et al.
Pubblicazione: (2024)
di: Murthy, Surya, et al.
Pubblicazione: (2024)
Vibe coding before the trend
di: van Bokhorst, Leon, et al.
Pubblicazione: (2026)
di: van Bokhorst, Leon, et al.
Pubblicazione: (2026)
Neural Value Iteration
di: You, Yang, et al.
Pubblicazione: (2025)
di: You, Yang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Factored Online Planning in Many-Agent POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2023) -
Multi-Environment POMDPs: Discrete Model Uncertainty Under Partial Observability
di: Bovy, Eline M., et al.
Pubblicazione: (2025) -
Imprecise Probabilities Meet Partial Observability: Game Semantics for Robust POMDPs
di: Bovy, Eline M., et al.
Pubblicazione: (2024) -
Robust Finite-Memory Policy Gradients for Hidden-Model POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2025) -
Finite-Memory Policies for Robust POMDPs via Convex Optimization (implementation)
di: Cubuktepe, Murat, et al.
Pubblicazione: (2021)