On the Surprising Efficacy of LLMs for Penetration-Testing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Happe, Andreas, Cito, Jürgen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Can LLMs Hack Enterprise Networks? Autonomous Assumed Breach Penetration-Testing Active Directory Networks
par: Happe, Andreas, et autres
Publié: (2025)
par: Happe, Andreas, et autres
Publié: (2025)
Ethics Statements in Autonomous Penetration-Testing Agent Research
par: Happe, Andreas, et autres
Publié: (2025)
par: Happe, Andreas, et autres
Publié: (2025)
Cochise: A Reference Harness for Autonomous Penetration Testing
par: Happe, Andreas, et autres
Publié: (2026)
par: Happe, Andreas, et autres
Publié: (2026)
Can LLMs Hack Enterprise Networks? -- Replicated Computational Results (RCR) Report
par: Happe, Andreas, et autres
Publié: (2026)
par: Happe, Andreas, et autres
Publié: (2026)
Got Root? A Linux Priv-Esc Benchmark
par: Happe, Andreas, et autres
Publié: (2024)
par: Happe, Andreas, et autres
Publié: (2024)
Benchmarking Practices in LLM-driven Offensive Security: Testbeds, Metrics, and Experiment Design
par: Happe, Andreas, et autres
Publié: (2025)
par: Happe, Andreas, et autres
Publié: (2025)
LLMs as Hackers: Autonomous Linux Privilege Escalation Attacks
par: Happe, Andreas, et autres
Publié: (2023)
par: Happe, Andreas, et autres
Publié: (2023)
Enhancing Linux Privilege Escalation Attack Capabilities of Local LLM Agents
par: Probst, Benjamin, et autres
Publié: (2026)
par: Probst, Benjamin, et autres
Publié: (2026)
Post-Training Local LLM Agents for Linux Privilege Escalation with Verifiable Rewards
par: Normann, Philipp, et autres
Publié: (2026)
par: Normann, Philipp, et autres
Publié: (2026)
Insider Threats Mitigation: Role of Penetration Testing
par: Chauhan, Krutarth
Publié: (2024)
par: Chauhan, Krutarth
Publié: (2024)
Penetration Testing for System Security: Methods and Practical Approaches
par: Zhang, Wei, et autres
Publié: (2025)
par: Zhang, Wei, et autres
Publié: (2025)
Automated Penetration Testing with LLM Agents and Classical Planning
par: Wang, Lingzhi, et autres
Publié: (2025)
par: Wang, Lingzhi, et autres
Publié: (2025)
A Comprehensive Evaluation and Practice of System Penetration Testing
par: Zhang, Chunyi, et autres
Publié: (2025)
par: Zhang, Chunyi, et autres
Publié: (2025)
Advanced Penetration Testing for Enhancing 5G Security
par: Smith-Haynes, Shari-Ann
Publié: (2024)
par: Smith-Haynes, Shari-Ann
Publié: (2024)
Penetration Testing of 5G Core Network Web Technologies
par: Giambartolomei, Filippo, et autres
Publié: (2024)
par: Giambartolomei, Filippo, et autres
Publié: (2024)
Critical Infrastructure Security: Penetration Testing and Exploit Development Perspectives
par: Orleans-Bosomtwe, Papa Kobina
Publié: (2024)
par: Orleans-Bosomtwe, Papa Kobina
Publié: (2024)
PTHelper: An open source tool to support the Penetration Testing process
par: de Gracia, Jacobo Casado, et autres
Publié: (2024)
par: de Gracia, Jacobo Casado, et autres
Publié: (2024)
PentestAgent: Incorporating LLM Agents to Automated Penetration Testing
par: Shen, Xiangmin, et autres
Publié: (2024)
par: Shen, Xiangmin, et autres
Publié: (2024)
Automated Penetration Testing: Formalization and Realization
par: Skandylas, Charilaos, et autres
Publié: (2024)
par: Skandylas, Charilaos, et autres
Publié: (2024)
Towards Supporting Penetration Testing Education with Large Language Models: an Evaluation and Comparison
par: Nizon-Deladoeuille, Martin, et autres
Publié: (2025)
par: Nizon-Deladoeuille, Martin, et autres
Publié: (2025)
Multi-Agent Penetration Testing AI for the Web
par: David, Isaac, et autres
Publié: (2025)
par: David, Isaac, et autres
Publié: (2025)
Reinforcement Learning for Automated Cybersecurity Penetration Testing
par: López-Montero, Daniel, et autres
Publié: (2025)
par: López-Montero, Daniel, et autres
Publié: (2025)
Vulnerability Mitigation System (VMS): LLM Agent and Evaluation Framework for Autonomous Penetration Testing
par: Abdulzada, Farzana
Publié: (2025)
par: Abdulzada, Farzana
Publié: (2025)
Shell or Nothing: Real-World Benchmarks and Memory-Activated Agents for Automated Penetration Testing
par: Mai, Wuyuao, et autres
Publié: (2025)
par: Mai, Wuyuao, et autres
Publié: (2025)
ICSSPulse: A Modular LLM-Assisted Platform for Industrial Control System Penetration Testing
par: Takaronis, Michail, et autres
Publié: (2026)
par: Takaronis, Michail, et autres
Publié: (2026)
Enhancing Security Testing Software for Systems that Cannot be Subjected to the Risks of Penetration Testing Through the Incorporation of Multi-threading and and Other Capabilities
par: Tassava, Matthew, et autres
Publié: (2024)
par: Tassava, Matthew, et autres
Publié: (2024)
PentestMCP: A Toolkit for Agentic Penetration Testing
par: Ezetta, Zachary, et autres
Publié: (2025)
par: Ezetta, Zachary, et autres
Publié: (2025)
AWE: Adaptive Agents for Dynamic Web Penetration Testing
par: Jaswal, Akshat Singh, et autres
Publié: (2026)
par: Jaswal, Akshat Singh, et autres
Publié: (2026)
Red-MIRROR: Agentic LLM-based Autonomous Penetration Testing with Reflective Verification and Knowledge-augmented Interaction
par: Khang, Tran Vy, et autres
Publié: (2026)
par: Khang, Tran Vy, et autres
Publié: (2026)
Lessons from Penetration Tests on Large-Scale Agent Systems
par: Eykholt, Kevin, et autres
Publié: (2026)
par: Eykholt, Kevin, et autres
Publié: (2026)
PentestGPT: An LLM-empowered Automatic Penetration Testing Tool
par: Deng, Gelei, et autres
Publié: (2023)
par: Deng, Gelei, et autres
Publié: (2023)
AutoPenBench: Benchmarking Generative Agents for Penetration Testing
par: Gioacchini, Luca, et autres
Publié: (2024)
par: Gioacchini, Luca, et autres
Publié: (2024)
Outer Space Cyberattacks: Generating Novel Scenarios to Avoid Surprise
par: Lin, Patrick, et autres
Publié: (2024)
par: Lin, Patrick, et autres
Publié: (2024)
Towards Automated Penetration Testing: Introducing LLM Benchmark, Analysis, and Improvements
par: Isozaki, Isamu, et autres
Publié: (2024)
par: Isozaki, Isamu, et autres
Publié: (2024)
NASimJax: GPU-Accelerated Policy Learning Framework for Penetration Testing
par: Simon, Raphael, et autres
Publié: (2026)
par: Simon, Raphael, et autres
Publié: (2026)
APT-Agent: Automated Penetration Testing using Large Language Models
par: Li, William Guanting, et autres
Publié: (2026)
par: Li, William Guanting, et autres
Publié: (2026)
Guided Reasoning in LLM-Driven Penetration Testing Using Structured Attack Trees
par: Nakano, Katsuaki, et autres
Publié: (2025)
par: Nakano, Katsuaki, et autres
Publié: (2025)
What Makes a Good LLM Agent for Real-world Penetration Testing?
par: Deng, Gelei, et autres
Publié: (2026)
par: Deng, Gelei, et autres
Publié: (2026)
Pen-Strategist: A Reasoning Framework for Penetration Testing Strategy Formation and Analysis
par: Ginige, Yasod, et autres
Publié: (2026)
par: Ginige, Yasod, et autres
Publié: (2026)
Learning Robust Penetration-Testing Policies under Partial Observability: A systematic evaluation
par: Simon, Raphael, et autres
Publié: (2025)
par: Simon, Raphael, et autres
Publié: (2025)
Documents similaires
-
Can LLMs Hack Enterprise Networks? Autonomous Assumed Breach Penetration-Testing Active Directory Networks
par: Happe, Andreas, et autres
Publié: (2025) -
Ethics Statements in Autonomous Penetration-Testing Agent Research
par: Happe, Andreas, et autres
Publié: (2025) -
Cochise: A Reference Harness for Autonomous Penetration Testing
par: Happe, Andreas, et autres
Publié: (2026) -
Can LLMs Hack Enterprise Networks? -- Replicated Computational Results (RCR) Report
par: Happe, Andreas, et autres
Publié: (2026) -
Got Root? A Linux Priv-Esc Benchmark
par: Happe, Andreas, et autres
Publié: (2024)