Pessimistic Iterative Planning with RNNs for Robust POMDPs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Galesloot, Maris F. L., Suilen, Marnix, Simão, Thiago D., Carr, Steven, Spaan, Matthijs T. J., Topcu, Ufuk, Jansen, Nils |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Factored Online Planning in Many-Agent POMDPs
par: Galesloot, Maris F. L., et autres
Publié: (2023)
par: Galesloot, Maris F. L., et autres
Publié: (2023)
Multi-Environment POMDPs: Discrete Model Uncertainty Under Partial Observability
par: Bovy, Eline M., et autres
Publié: (2025)
par: Bovy, Eline M., et autres
Publié: (2025)
Imprecise Probabilities Meet Partial Observability: Game Semantics for Robust POMDPs
par: Bovy, Eline M., et autres
Publié: (2024)
par: Bovy, Eline M., et autres
Publié: (2024)
Robust Finite-Memory Policy Gradients for Hidden-Model POMDPs
par: Galesloot, Maris F. L., et autres
Publié: (2025)
par: Galesloot, Maris F. L., et autres
Publié: (2025)
Finite-Memory Policies for Robust POMDPs via Convex Optimization (implementation)
par: Cubuktepe, Murat, et autres
Publié: (2021)
par: Cubuktepe, Murat, et autres
Publié: (2021)
Missingness-MDPs: Bridging the Theory of Missing Data and POMDPs
par: Wendland, Joshua, et autres
Publié: (2026)
par: Wendland, Joshua, et autres
Publié: (2026)
Robust Probabilistic Shielding for Safe Offline Reinforcement Learning
par: Galesloot, Maris F. L., et autres
Publié: (2026)
par: Galesloot, Maris F. L., et autres
Publié: (2026)
Finite-State Controllers for (Hidden-Model) POMDPs using Deep Reinforcement Learning
par: Hudák, David, et autres
Publié: (2026)
par: Hudák, David, et autres
Publié: (2026)
Tighter Value-Function Approximations for POMDPs
par: Krale, Merlijn, et autres
Publié: (2025)
par: Krale, Merlijn, et autres
Publié: (2025)
Reinforcement Learning by Guided Safe Exploration
par: Yang, Qisong, et autres
Publié: (2023)
par: Yang, Qisong, et autres
Publié: (2023)
Robust Markov Decision Processes: A Place Where AI and Formal Methods Meet
par: Suilen, Marnix, et autres
Publié: (2024)
par: Suilen, Marnix, et autres
Publié: (2024)
Data-Efficient Safe Policy Improvement Using Parametric Structure
par: Engelen, Kasper, et autres
Publié: (2025)
par: Engelen, Kasper, et autres
Publié: (2025)
Multimodal Pretrained Models for Verifiable Sequential Decision-Making: Planning, Grounding, and Perception
par: Yang, Yunhao, et autres
Publié: (2023)
par: Yang, Yunhao, et autres
Publié: (2023)
Online Risk-Averse Planning in POMDPs Using Iterated CVaR Value Function
par: Pariente, Yaacov, et autres
Publié: (2026)
par: Pariente, Yaacov, et autres
Publié: (2026)
Reasoning, Memorization, and Fine-Tuning Language Models for Non-Cooperative Games
par: Yang, Yunhao, et autres
Publié: (2024)
par: Yang, Yunhao, et autres
Publié: (2024)
VeRecycle: Reclaiming Guarantees from Probabilistic Certificates for Stochastic Dynamical Systems after Change
par: Lutz, Sterre, et autres
Publié: (2025)
par: Lutz, Sterre, et autres
Publié: (2025)
Zero-Shot Reinforcement Learning via Function Encoders
par: Ingebrand, Tyler, et autres
Publié: (2024)
par: Ingebrand, Tyler, et autres
Publié: (2024)
Positive Experience Reflection for Agents in Interactive Text Environments
par: Lippmann, Philip, et autres
Publié: (2024)
par: Lippmann, Philip, et autres
Publié: (2024)
On the Complexity of Robust Markov Decision Processes and Bisimulation Metrics
par: Suilen, Marnix, et autres
Publié: (2026)
par: Suilen, Marnix, et autres
Publié: (2026)
Diverse Projection Ensembles for Distributional Reinforcement Learning
par: Zanger, Moritz A., et autres
Publié: (2023)
par: Zanger, Moritz A., et autres
Publié: (2023)
Planning under Distribution Shifts with Causal POMDPs
par: Ceriscioli, Matteo, et autres
Publié: (2026)
par: Ceriscioli, Matteo, et autres
Publié: (2026)
Perception-Based Beliefs for POMDPs with Visual Observations
par: Schäfers, Miriam, et autres
Publié: (2026)
par: Schäfers, Miriam, et autres
Publié: (2026)
Human-Agent Cooperation in Games under Incomplete Information through Natural Language Communication
par: Chen, Shenghui, et autres
Publié: (2024)
par: Chen, Shenghui, et autres
Publié: (2024)
Robust Multi-Agent Reinforcement Learning for Small UAS Separation Assurance under GPS Degradation and Spoofing
par: Zongo, Alex, et autres
Publié: (2026)
par: Zongo, Alex, et autres
Publié: (2026)
Online Planning in POMDPs with State-Requests
par: Avalos, Raphael, et autres
Publié: (2024)
par: Avalos, Raphael, et autres
Publié: (2024)
Neural Port-Hamiltonian Differential Algebraic Equations for Compositional Learning of Electrical Networks
par: Neary, Cyrus, et autres
Publié: (2024)
par: Neary, Cyrus, et autres
Publié: (2024)
Institutional AI Sovereignty Through Gateway Architecture: Implementation Report from Fontys ICT
par: Huijts, Ruud, et autres
Publié: (2025)
par: Huijts, Ruud, et autres
Publié: (2025)
Epistemic Monte Carlo Tree Search
par: Oren, Yaniv, et autres
Publié: (2022)
par: Oren, Yaniv, et autres
Publié: (2022)
Exploration Implies Data Augmentation: Reachability and Generalisation in Contextual MDPs
par: Weltevrede, Max, et autres
Publié: (2024)
par: Weltevrede, Max, et autres
Publié: (2024)
Explore-Go: Leveraging Exploration for Generalisation in Deep Reinforcement Learning
par: Weltevrede, Max, et autres
Publié: (2024)
par: Weltevrede, Max, et autres
Publié: (2024)
Point-Based Value Iteration for POMDPs with Neural Perception Mechanisms
par: Yan, Rui, et autres
Publié: (2023)
par: Yan, Rui, et autres
Publié: (2023)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
par: Bai, Chenjia, et autres
Publié: (2024)
par: Bai, Chenjia, et autres
Publié: (2024)
IG-MCTS: Human-in-the-Loop Cooperative Navigation under Incomplete Information
par: Chen, Shenghui, et autres
Publié: (2025)
par: Chen, Shenghui, et autres
Publié: (2025)
Learning to Coordinate without Communication under Incomplete Information
par: Chen, Shenghui, et autres
Publié: (2024)
par: Chen, Shenghui, et autres
Publié: (2024)
Fine-Tuning Language Models Using Formal Methods Feedback
par: Yang, Yunhao, et autres
Publié: (2023)
par: Yang, Yunhao, et autres
Publié: (2023)
How Ensembles of Distilled Policies Improve Generalisation in Reinforcement Learning
par: Weltevrede, Max, et autres
Publié: (2025)
par: Weltevrede, Max, et autres
Publié: (2025)
Adaptive Shielding for Safe Reinforcement Learning under Hidden-Parameter Dynamics Shifts
par: Kwon, Minjae, et autres
Publié: (2025)
par: Kwon, Minjae, et autres
Publié: (2025)
Sequential Resource Trading Using Comparison-Based Gradient Estimation
par: Murthy, Surya, et autres
Publié: (2024)
par: Murthy, Surya, et autres
Publié: (2024)
Vibe coding before the trend
par: van Bokhorst, Leon, et autres
Publié: (2026)
par: van Bokhorst, Leon, et autres
Publié: (2026)
Neural Value Iteration
par: You, Yang, et autres
Publié: (2025)
par: You, Yang, et autres
Publié: (2025)
Documents similaires
-
Factored Online Planning in Many-Agent POMDPs
par: Galesloot, Maris F. L., et autres
Publié: (2023) -
Multi-Environment POMDPs: Discrete Model Uncertainty Under Partial Observability
par: Bovy, Eline M., et autres
Publié: (2025) -
Imprecise Probabilities Meet Partial Observability: Game Semantics for Robust POMDPs
par: Bovy, Eline M., et autres
Publié: (2024) -
Robust Finite-Memory Policy Gradients for Hidden-Model POMDPs
par: Galesloot, Maris F. L., et autres
Publié: (2025) -
Finite-Memory Policies for Robust POMDPs via Convex Optimization (implementation)
par: Cubuktepe, Murat, et autres
Publié: (2021)