Enregistré dans:
| Auteurs principaux: | Bates, Elizabeth, Hicks, Chris, Mavroudis, Vasilios |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.04809 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Less is more? Rewards in RL for Cyber Defence
par: Bates, Elizabeth, et autres
Publié: (2025)
par: Bates, Elizabeth, et autres
Publié: (2025)
Autonomous Network Defence using Reinforcement Learning
par: Foley, Myles, et autres
Publié: (2024)
par: Foley, Myles, et autres
Publié: (2024)
An Attentive Graph Agent for Topology-Adaptive Cyber Defence
par: Sandoval, Ilya Orson, et autres
Publié: (2025)
par: Sandoval, Ilya Orson, et autres
Publié: (2025)
Mitigating Deep Reinforcement Learning Backdoors in the Neural Activation Space
par: Vyas, Sanyam, et autres
Publié: (2024)
par: Vyas, Sanyam, et autres
Publié: (2024)
Entity-based Reinforcement Learning for Autonomous Cyber Defence
par: Thompson, Isaac Symes, et autres
Publié: (2024)
par: Thompson, Isaac Symes, et autres
Publié: (2024)
Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning
par: Vyas, Sanyam, et autres
Publié: (2025)
par: Vyas, Sanyam, et autres
Publié: (2025)
CybORG++: An Enhanced Gym for the Development of Autonomous Cyber Agents
par: Emerson, Harry, et autres
Publié: (2024)
par: Emerson, Harry, et autres
Publié: (2024)
On Efficient Bayesian Exploration in Model-Based Reinforcement Learning
par: Caron, Alberto, et autres
Publié: (2025)
par: Caron, Alberto, et autres
Publié: (2025)
Inherently Interpretable and Uncertainty-Aware Models for Online Learning in Cyber-Security Problems
par: Kolicic, Benjamin, et autres
Publié: (2024)
par: Kolicic, Benjamin, et autres
Publié: (2024)
Towards Causal Model-Based Policy Optimization
par: Caron, Alberto, et autres
Publié: (2025)
par: Caron, Alberto, et autres
Publié: (2025)
A View on Out-of-Distribution Identification from a Statistical Testing Theory Perspective
par: Caron, Alberto, et autres
Publié: (2024)
par: Caron, Alberto, et autres
Publié: (2024)
Nearest Neighbour with Bandit Feedback
par: Pasteris, Stephen, et autres
Publié: (2023)
par: Pasteris, Stephen, et autres
Publié: (2023)
Fairness with Exponential Weights
par: Pasteris, Stephen, et autres
Publié: (2024)
par: Pasteris, Stephen, et autres
Publié: (2024)
Extraction Propagation
par: Pasteris, Stephen, et autres
Publié: (2024)
par: Pasteris, Stephen, et autres
Publié: (2024)
HonestCyberEval: An AI Cyber Risk Benchmark for Automated Software Exploitation
par: Ristea, Dan, et autres
Publié: (2024)
par: Ristea, Dan, et autres
Publié: (2024)
SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity
par: McFadden, Shae, et autres
Publié: (2026)
par: McFadden, Shae, et autres
Publié: (2026)
Machine Theory of Mind for Autonomous Cyber-Defence
par: Swaby, Luke, et autres
Publié: (2024)
par: Swaby, Luke, et autres
Publié: (2024)
Online Convex Optimisation: The Optimal Switching Regret for all Segmentations Simultaneously
par: Pasteris, Stephen, et autres
Publié: (2024)
par: Pasteris, Stephen, et autres
Publié: (2024)
Environment Complexity and Nash Equilibria in a Sequential Social Dilemma
par: Yasir, Mustafa, et autres
Publié: (2024)
par: Yasir, Mustafa, et autres
Publié: (2024)
Learning Communication Between Heterogeneous Agents in Multi-Agent Reinforcement Learning for Autonomous Cyber Defence
par: Popa, Alex, et autres
Publié: (2026)
par: Popa, Alex, et autres
Publié: (2026)
Building Better Environments for Autonomous Cyber Defence
par: Hicks, Chris, et autres
Publié: (2026)
par: Hicks, Chris, et autres
Publié: (2026)
DRMD: Deep Reinforcement Learning for Malware Detection under Concept Drift
par: McFadden, Shae, et autres
Publié: (2025)
par: McFadden, Shae, et autres
Publié: (2025)
Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains
par: Gunjal, Anisha, et autres
Publié: (2025)
par: Gunjal, Anisha, et autres
Publié: (2025)
Deep Reinforcement Learning for Autonomous Cyber Defence: A Survey
par: Palmer, Gregory, et autres
Publié: (2023)
par: Palmer, Gregory, et autres
Publié: (2023)
Referential Security as a New Paradigm for AI Evaluations
par: Ristea, Dan, et autres
Publié: (2026)
par: Ristea, Dan, et autres
Publié: (2026)
Large Language Model-Based Reward Design for Deep Reinforcement Learning-Driven Autonomous Cyber Defense
par: Mukherjee, Sayak, et autres
Publié: (2025)
par: Mukherjee, Sayak, et autres
Publié: (2025)
Beyond Binary: Turning Partial Success into Dense Verifiable Rewards for Reinforcement Learning in Code Generation
par: Wang, Longwen, et autres
Publié: (2026)
par: Wang, Longwen, et autres
Publié: (2026)
Reinforcement Learning with Symbolic Reward Machines
par: Krug, Thomas, et autres
Publié: (2026)
par: Krug, Thomas, et autres
Publié: (2026)
Reinforcement Learning with Exogenous States and Rewards
par: Trimponias, George, et autres
Publié: (2023)
par: Trimponias, George, et autres
Publié: (2023)
Reinforcement Learning with Stochastic Reward Machines
par: Corazza, Jan, et autres
Publié: (2025)
par: Corazza, Jan, et autres
Publié: (2025)
Offline Reinforcement Learning with Imputed Rewards
par: Romeo, Carlo, et autres
Publié: (2024)
par: Romeo, Carlo, et autres
Publié: (2024)
Beyond Scalar Rewards: Distributional Reinforcement Learning with Preordered Objectives for Safe and Reliable Autonomous Driving
par: Abouelazm, Ahmed, et autres
Publié: (2026)
par: Abouelazm, Ahmed, et autres
Publié: (2026)
Constraints as Rewards: Reinforcement Learning for Robots without Reward Functions
par: Ishihara, Yu, et autres
Publié: (2025)
par: Ishihara, Yu, et autres
Publié: (2025)
RLSR: Reinforcement Learning from Self Reward
par: Simonds, Toby, et autres
Publié: (2025)
par: Simonds, Toby, et autres
Publié: (2025)
Efficient Reinforcement Learning in Probabilistic Reward Machines
par: Lin, Xiaofeng, et autres
Publié: (2024)
par: Lin, Xiaofeng, et autres
Publié: (2024)
Which Rewards Matter? Reward Selection for Reinforcement Learning under Limited Feedback
par: Chaudhari, Shreyas, et autres
Publié: (2025)
par: Chaudhari, Shreyas, et autres
Publié: (2025)
Continual Reinforcement Learning for Cyber-Physical Systems: Lessons Learned and Open Challenges
par: Nolle, Kim N., et autres
Publié: (2025)
par: Nolle, Kim N., et autres
Publié: (2025)
In Defence of Post-hoc Explainability
par: Oh, Nick
Publié: (2024)
par: Oh, Nick
Publié: (2024)
Adaptive Correlation-Weighted Intrinsic Rewards for Reinforcement Learning
par: Nguyen, Viet Bac, et autres
Publié: (2026)
par: Nguyen, Viet Bac, et autres
Publié: (2026)
Contextual Rollout Bandits for Reinforcement Learning with Verifiable Rewards
par: Lu, Xiaodong, et autres
Publié: (2026)
par: Lu, Xiaodong, et autres
Publié: (2026)
Documents similaires
-
Less is more? Rewards in RL for Cyber Defence
par: Bates, Elizabeth, et autres
Publié: (2025) -
Autonomous Network Defence using Reinforcement Learning
par: Foley, Myles, et autres
Publié: (2024) -
An Attentive Graph Agent for Topology-Adaptive Cyber Defence
par: Sandoval, Ilya Orson, et autres
Publié: (2025) -
Mitigating Deep Reinforcement Learning Backdoors in the Neural Activation Space
par: Vyas, Sanyam, et autres
Publié: (2024) -
Entity-based Reinforcement Learning for Autonomous Cyber Defence
par: Thompson, Isaac Symes, et autres
Publié: (2024)