Learning Optimal Defender Strategies for CAGE-2 using a POMDP Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Le, Duc Huy, Stadler, Rolf |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Optimal Defender Strategies for CAGE-2 using Causal Modeling and Tree Search
par: Hammar, Kim, et autres
Publié: (2024)
par: Hammar, Kim, et autres
Publié: (2024)
Learning Intrusion Prevention Policies through Optimal Stopping
par: Hammar, Kim, et autres
Publié: (2021)
par: Hammar, Kim, et autres
Publié: (2021)
Intrusion Prevention through Optimal Stopping
par: Hammar, Kim, et autres
Publié: (2021)
par: Hammar, Kim, et autres
Publié: (2021)
Learning Explainable and Better Performing Representations of POMDP Strategies
par: Bork, Alexander, et autres
Publié: (2024)
par: Bork, Alexander, et autres
Publié: (2024)
Expert-Guided POMDP Learning for Data-Efficient Modeling in Healthcare
par: Locatelli, Marco, et autres
Publié: (2025)
par: Locatelli, Marco, et autres
Publié: (2025)
Deep Belief Markov Models for POMDP Inference
par: Arcieri, Giacomo, et autres
Publié: (2025)
par: Arcieri, Giacomo, et autres
Publié: (2025)
Rao-Blackwellized POMDP Planning
par: Lee, Jiho, et autres
Publié: (2024)
par: Lee, Jiho, et autres
Publié: (2024)
SOAP-RL: Sequential Option Advantage Propagation for Reinforcement Learning in POMDP Environments
par: Ishida, Shu, et autres
Publié: (2024)
par: Ishida, Shu, et autres
Publié: (2024)
Explanation through Reward Model Reconciliation using POMDP Tree Search
par: Kraske, Benjamin D., et autres
Publié: (2023)
par: Kraske, Benjamin D., et autres
Publié: (2023)
Anytime Incremental $ρ$POMDP Planning in Continuous Spaces
par: Benchetrit, Ron, et autres
Publié: (2025)
par: Benchetrit, Ron, et autres
Publié: (2025)
The Context Gathering Decision Process: A POMDP Framework for Agentic Search
par: Kausik, Chinmaya, et autres
Publié: (2026)
par: Kausik, Chinmaya, et autres
Publié: (2026)
World Models Unlock Optimal Foraging Strategies in Reinforcement Learning Agents
par: Fonseca, Yesid, et autres
Publié: (2025)
par: Fonseca, Yesid, et autres
Publié: (2025)
Defending Deep Regression Models against Backdoor Attacks
par: Du, Lingyu, et autres
Publié: (2024)
par: Du, Lingyu, et autres
Publié: (2024)
Robust Federated Learning on Edge Devices with Domain Heterogeneity
par: Le, Huy Q., et autres
Publié: (2025)
par: Le, Huy Q., et autres
Publié: (2025)
Enhance Exploration in Safe Reinforcement Learning with Contrastive Representation Learning
par: Doan, Duc Kien, et autres
Publié: (2025)
par: Doan, Duc Kien, et autres
Publié: (2025)
CDKT-FL: Cross-Device Knowledge Transfer using Proxy Dataset in Federated Learning
par: Le, Huy Q., et autres
Publié: (2022)
par: Le, Huy Q., et autres
Publié: (2022)
DmC: Nearest Neighbor Guidance Diffusion Model for Offline Cross-domain Reinforcement Learning
par: Van, Linh Le Pham, et autres
Publié: (2025)
par: Van, Linh Le Pham, et autres
Publié: (2025)
Bridging Models to Defend: A Population-Based Strategy for Robust Adversarial Defense
par: Wang, Ren, et autres
Publié: (2023)
par: Wang, Ren, et autres
Publié: (2023)
SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks
par: Robey, Alexander, et autres
Publié: (2023)
par: Robey, Alexander, et autres
Publié: (2023)
BRIDGE: Bundle Recommendation via Instruction-Driven Generation
par: Bui, Tuan-Nghia, et autres
Publié: (2024)
par: Bui, Tuan-Nghia, et autres
Publié: (2024)
Momentum Contrastive Learning with Enhanced Negative Sampling and Hard Negative Filtering
par: Hoang, Duy, et autres
Publié: (2025)
par: Hoang, Duy, et autres
Publié: (2025)
Hierarchical Object-Oriented POMDP Planning for Object Rearrangement
par: Mangannavar, Rajesh, et autres
Publié: (2024)
par: Mangannavar, Rajesh, et autres
Publié: (2024)
Learning to Defend by Attacking (and Vice-Versa): Transfer of Learning in Cybersecurity Games
par: Malloy, Tailia, et autres
Publié: (2023)
par: Malloy, Tailia, et autres
Publié: (2023)
Optimal Transport for Structure Learning Under Missing Data
par: Vo, Vy, et autres
Publié: (2024)
par: Vo, Vy, et autres
Publié: (2024)
SPRINQL: Sub-optimal Demonstrations driven Offline Imitation Learning
par: Hoang, Huy, et autres
Publié: (2024)
par: Hoang, Huy, et autres
Publié: (2024)
Imitate the Good and Avoid the Bad: An Incremental Approach to Safe Reinforcement Learning
par: Hoang, Huy, et autres
Publié: (2023)
par: Hoang, Huy, et autres
Publié: (2023)
Defending Membership Inference Attacks via Privacy-aware Sparsity Tuning
par: Hu, Qiang, et autres
Publié: (2024)
par: Hu, Qiang, et autres
Publié: (2024)
Understanding Expert Structures on Minimax Parameter Estimation in Contaminated Mixture of Experts
par: Yan, Fanqi, et autres
Publié: (2024)
par: Yan, Fanqi, et autres
Publié: (2024)
Variational Flow Models: Flowing in Your Style
par: Do, Kien, et autres
Publié: (2024)
par: Do, Kien, et autres
Publié: (2024)
Contraction Actor-Critic: Contraction Metric-Guided Reinforcement Learning for Robust Path Tracking
par: Cho, Minjae, et autres
Publié: (2025)
par: Cho, Minjae, et autres
Publié: (2025)
Automated Security Response through Online Learning with Adaptive Conjectures
par: Hammar, Kim, et autres
Publié: (2024)
par: Hammar, Kim, et autres
Publié: (2024)
Defending the Edge: Representative-Attention Defense against Backdoor Attacks in Federated Learning
par: Obioma, Chibueze Peace, et autres
Publié: (2025)
par: Obioma, Chibueze Peace, et autres
Publié: (2025)
Playing Along: Learning a Double-Agent Defender for Belief Steering via Theory of Mind
par: Xiao, Hanqi, et autres
Publié: (2026)
par: Xiao, Hanqi, et autres
Publié: (2026)
Learning What to Do and What Not To Do: Offline Imitation from Expert and Undesirable Demonstrations
par: Hoang, Huy, et autres
Publié: (2025)
par: Hoang, Huy, et autres
Publié: (2025)
Reinforcement Learning with LTL and $ω$-Regular Objectives via Optimality-Preserving Translation to Average Rewards
par: Le, Xuan-Bach, et autres
Publié: (2024)
par: Le, Xuan-Bach, et autres
Publié: (2024)
Divide and Refine: Enhancing Multimodal Representation and Explainability for Emotion Recognition in Conversation
par: Mai, Anh-Tuan, et autres
Publié: (2026)
par: Mai, Anh-Tuan, et autres
Publié: (2026)
Optimal Kernel Tuning Parameter Prediction using Deep Sequence Models
par: Mahmood, Khawir, et autres
Publié: (2024)
par: Mahmood, Khawir, et autres
Publié: (2024)
Resource-efficient Layer-wise Federated Self-supervised Learning
par: Tun, Ye Lin, et autres
Publié: (2024)
par: Tun, Ye Lin, et autres
Publié: (2024)
Large-Scale Multipurpose Benchmark Datasets For Assessing Data-Driven Deep Learning Approaches For Water Distribution Networks
par: Tello, Andres, et autres
Publié: (2024)
par: Tello, Andres, et autres
Publié: (2024)
Towards Layer-Wise Personalized Federated Learning: Adaptive Layer Disentanglement via Conflicting Gradients
par: Nguyen, Minh Duong, et autres
Publié: (2024)
par: Nguyen, Minh Duong, et autres
Publié: (2024)
Documents similaires
-
Optimal Defender Strategies for CAGE-2 using Causal Modeling and Tree Search
par: Hammar, Kim, et autres
Publié: (2024) -
Learning Intrusion Prevention Policies through Optimal Stopping
par: Hammar, Kim, et autres
Publié: (2021) -
Intrusion Prevention through Optimal Stopping
par: Hammar, Kim, et autres
Publié: (2021) -
Learning Explainable and Better Performing Representations of POMDP Strategies
par: Bork, Alexander, et autres
Publié: (2024) -
Expert-Guided POMDP Learning for Data-Efficient Modeling in Healthcare
par: Locatelli, Marco, et autres
Publié: (2025)