Finite-Memory Policies for Robust POMDPs via Convex Optimization (implementation)
Fuente:
Zenodo
Guardado en:
| Autores principales: | Cubuktepe, Murat, Jansen, Nils, Junges, Sebastian, Marandi, Ahmadreza, Suilen, Marnix, Topcu, Ufuk |
|---|---|
| Formato: | Recurso digital |
| Publicado: |
Zenodo
2021
|
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Imprecise Probabilities Meet Partial Observability: Game Semantics for Robust POMDPs
por: Bovy, Eline M., et al.
Publicado: (2024)
por: Bovy, Eline M., et al.
Publicado: (2024)
Multi-Environment POMDPs: Discrete Model Uncertainty Under Partial Observability
por: Bovy, Eline M., et al.
Publicado: (2025)
por: Bovy, Eline M., et al.
Publicado: (2025)
Pessimistic Iterative Planning with RNNs for Robust POMDPs
por: Galesloot, Maris F. L., et al.
Publicado: (2024)
por: Galesloot, Maris F. L., et al.
Publicado: (2024)
Robust Finite-Memory Policy Gradients for Hidden-Model POMDPs
por: Galesloot, Maris F. L., et al.
Publicado: (2025)
por: Galesloot, Maris F. L., et al.
Publicado: (2025)
A PSPACE Algorithm for Almost-Sure Rabin Objectives in Multi-Environment MDPs
por: Suilen, Marnix, et al.
Publicado: (2024)
por: Suilen, Marnix, et al.
Publicado: (2024)
On the Complexity of Robust Markov Decision Processes and Bisimulation Metrics
por: Suilen, Marnix, et al.
Publicado: (2026)
por: Suilen, Marnix, et al.
Publicado: (2026)
Robust Markov Decision Processes: A Place Where AI and Formal Methods Meet
por: Suilen, Marnix, et al.
Publicado: (2024)
por: Suilen, Marnix, et al.
Publicado: (2024)
Tighter Value-Function Approximations for POMDPs
por: Krale, Merlijn, et al.
Publicado: (2025)
por: Krale, Merlijn, et al.
Publicado: (2025)
Factored Online Planning in Many-Agent POMDPs
por: Galesloot, Maris F. L., et al.
Publicado: (2023)
por: Galesloot, Maris F. L., et al.
Publicado: (2023)
Data-Efficient Safe Policy Improvement Using Parametric Structure
por: Engelen, Kasper, et al.
Publicado: (2025)
por: Engelen, Kasper, et al.
Publicado: (2025)
Policy Verification in Stochastic Dynamical Systems Using Logarithmic Neural Certificates
por: Badings, Thom, et al.
Publicado: (2024)
por: Badings, Thom, et al.
Publicado: (2024)
Robust Almost-Sure Reachability in Multi-Environment MDPs
por: van der Vegt, Marck, et al.
Publicado: (2023)
por: van der Vegt, Marck, et al.
Publicado: (2023)
Approximate Dec-POMDP Solving Using Multi-Agent A*
por: Koops, Wietze, et al.
Publicado: (2024)
por: Koops, Wietze, et al.
Publicado: (2024)
Explainable Representation of Finite-Memory Policies for POMDPs using Decision Trees
por: Azeem, Muqsit, et al.
Publicado: (2024)
por: Azeem, Muqsit, et al.
Publicado: (2024)
The Distributionally Robust Cyclic Inventory Routing Problem
por: Jia, Menglei, et al.
Publicado: (2026)
por: Jia, Menglei, et al.
Publicado: (2026)
Finite-State Controllers for (Hidden-Model) POMDPs using Deep Reinforcement Learning
por: Hudák, David, et al.
Publicado: (2026)
por: Hudák, David, et al.
Publicado: (2026)
Learning POMDPs with Linear Function Approximation and Finite Memory
por: Kara, Ali Devran
Publicado: (2025)
por: Kara, Ali Devran
Publicado: (2025)
Chance-Constrained Correlated Equilibria for Robust Noncooperative Coordination
por: Im, Jaehan, et al.
Publicado: (2026)
por: Im, Jaehan, et al.
Publicado: (2026)
Adversarial Observability and Performance Trade-offs in Optimal Control
por: Fotiadis, Filippos, et al.
Publicado: (2025)
por: Fotiadis, Filippos, et al.
Publicado: (2025)
Perception-Based Beliefs for POMDPs with Visual Observations
por: Schäfers, Miriam, et al.
Publicado: (2026)
por: Schäfers, Miriam, et al.
Publicado: (2026)
Zero-Shot Reinforcement Learning via Function Encoders
por: Ingebrand, Tyler, et al.
Publicado: (2024)
por: Ingebrand, Tyler, et al.
Publicado: (2024)
Deceptive Sequential Decision-Making via Regularized Policy Optimization
por: Kim, Yerin, et al.
Publicado: (2025)
por: Kim, Yerin, et al.
Publicado: (2025)
CTMCs with Imprecisely Timed Observations
por: Badings, Thom, et al.
Publicado: (2024)
por: Badings, Thom, et al.
Publicado: (2024)
On the Benefits of Inducing Local Lipschitzness for Robust Generative Adversarial Imitation Learning
por: Memarian, Farzan, et al.
Publicado: (2021)
por: Memarian, Farzan, et al.
Publicado: (2021)
Model-Based Learning of Near-Optimal Finite-Window Policies in POMDPs
por: Jordan, Philip, et al.
Publicado: (2026)
por: Jordan, Philip, et al.
Publicado: (2026)
Constrained and Robust Policy Synthesis with Satisfiability-Modulo-Probabilistic-Model-Checking
por: Heck, Linus, et al.
Publicado: (2025)
por: Heck, Linus, et al.
Publicado: (2025)
Noncooperative Virtual Queue Coordination via Uncertainty-Aware Correlated Equilibria
por: Im, Jaehan, et al.
Publicado: (2026)
por: Im, Jaehan, et al.
Publicado: (2026)
Robust Multi-Agent Reinforcement Learning for Small UAS Separation Assurance under GPS Degradation and Spoofing
por: Zongo, Alex, et al.
Publicado: (2026)
por: Zongo, Alex, et al.
Publicado: (2026)
Scalable Coordination with Chance-Constrained Correlated Equilibria via Reduced-Rank Structure
por: Im, Jaehan, et al.
Publicado: (2026)
por: Im, Jaehan, et al.
Publicado: (2026)
Generalizing Multi-Step Inverse Models for Representation Learning to Finite-Memory POMDPs
por: Wu, Lili, et al.
Publicado: (2024)
por: Wu, Lili, et al.
Publicado: (2024)
Sequential Monte Carlo for Policy Optimization in Continuous POMDPs
por: Abdulsamad, Hany, et al.
Publicado: (2025)
por: Abdulsamad, Hany, et al.
Publicado: (2025)
Refined Bounds on Near Optimality Finite Window Policies in POMDPs and Their Reinforcement Learning
por: Demirci, Yunus Emre, et al.
Publicado: (2024)
por: Demirci, Yunus Emre, et al.
Publicado: (2024)
Human-Agent Cooperation in Games under Incomplete Information through Natural Language Communication
por: Chen, Shenghui, et al.
Publicado: (2024)
por: Chen, Shenghui, et al.
Publicado: (2024)
Categorical semantics of compositional reinforcement learning
por: Bakirtzis, Georgios, et al.
Publicado: (2022)
por: Bakirtzis, Georgios, et al.
Publicado: (2022)
Privacy-preserving Nash Equilibrium Synthesis with Partially Ordered Temporal Objectives
por: Probine, Caleb, et al.
Publicado: (2025)
por: Probine, Caleb, et al.
Publicado: (2025)
Reasoning, Memorization, and Fine-Tuning Language Models for Non-Cooperative Games
por: Yang, Yunhao, et al.
Publicado: (2024)
por: Yang, Yunhao, et al.
Publicado: (2024)
Neural Port-Hamiltonian Differential Algebraic Equations for Compositional Learning of Electrical Networks
por: Neary, Cyrus, et al.
Publicado: (2024)
por: Neary, Cyrus, et al.
Publicado: (2024)
Compositional shield synthesis for safe reinforcement learning in partial observability
por: Carr, Steven, et al.
Publicado: (2025)
por: Carr, Steven, et al.
Publicado: (2025)
Multimodal Pretrained Models for Verifiable Sequential Decision-Making: Planning, Grounding, and Perception
por: Yang, Yunhao, et al.
Publicado: (2023)
por: Yang, Yunhao, et al.
Publicado: (2023)
Human-Agent Coordination in Games under Incomplete Information via Multi-Step Intent
por: Chen, Shenghui, et al.
Publicado: (2024)
por: Chen, Shenghui, et al.
Publicado: (2024)
Ejemplares similares
-
Imprecise Probabilities Meet Partial Observability: Game Semantics for Robust POMDPs
por: Bovy, Eline M., et al.
Publicado: (2024) -
Multi-Environment POMDPs: Discrete Model Uncertainty Under Partial Observability
por: Bovy, Eline M., et al.
Publicado: (2025) -
Pessimistic Iterative Planning with RNNs for Robust POMDPs
por: Galesloot, Maris F. L., et al.
Publicado: (2024) -
Robust Finite-Memory Policy Gradients for Hidden-Model POMDPs
por: Galesloot, Maris F. L., et al.
Publicado: (2025) -
A PSPACE Algorithm for Almost-Sure Rabin Objectives in Multi-Environment MDPs
por: Suilen, Marnix, et al.
Publicado: (2024)